Primary sources
模型厂商官方动态
优先展示模型厂商、研究机构和项目维护者的原始发布,并保留官方链接和发布时间。
Anthropic对开源权重模型的立场引发讨论,科技公司纷纷表态
Anthropic首席执行官Dario Amodei发布文章阐述公司对开源权重模型的立场,回应了近期关于中国开源模型及潜在禁令的讨论。文章指出,许多科技公司已对此事作出回应。同时,行业动态显示,英伟达等公司组建“开放安全AI联盟”,强调开源模型与安全性的结合,但Anthropic尚未加入相关联盟或签署公开信,其具体立场有待进一步确认。
英伟达开源视觉语言模型实现量子计算机全自动校准
英伟达发布名为NVIDIA Ising Calibration的开源视觉语言模型,该模型旨在解读量子处理器的诊断输出并自动确定校准参数。该系统通过增强的上下文学习能力,无需人工干预即可完成量子计算机的校准流程,是推动量子计算自动化的重要进展。该模型目前以开源形式发布。
Hugging Face 发布 pwc-cli 0.1.2 版本
根据来自 GitHub AI 组织监控的官方信息,Hugging Face 组织已发布其命令行工具 pwc-cli 的 0.1.2 版本。这是一个已确认的软件版本发布事件。摘要中未提供关于此版本具体更新内容或修复问题的细节信息。
NVIDIA强调AI驱动下半导体材料与制造的创新进展
随着AI工作负载增加,爆发性的计算需求正推动半导体行业满足前所未有的性能目标。NVIDIA开发者博客指出,即使是小的延迟也可能产生重大影响,这突显了在材料工程和制造领域持续创新的重要性,以应对日益增长的算力需求。
NVIDIA Nemotron 3 Ultra模型在代理RTL编码中领先开源模型
根据NVIDIA开发者博客的官方文章,现代芯片设计日益受限于工程时间。寄存器传输级开发和验证需要专业知识和时间。文章指出,NVIDIA的Nemotron 3 Ultra模型在代理RTL编码任务中,在准确性和效率方面领先于其他开源模型。该模型旨在辅助工程师加速芯片设计流程。这些信息基于NVIDIA的官方发布。
NVIDIA开发者博客探讨提升AI智能体性能的六项关键架构能力
NVIDIA官方开发者博客指出,构建高性能AI智能体不仅依赖于模型选择,其核心在于围绕模型的“驾驭框架”架构。该架构决定了如何渲染上下文、执行任务等关键环节。文章探讨了六项能够提升模型性能的关键驾驭框架能力。
OpenAI研究揭示AI如何拓展工作职能
OpenAI官方研究发现,ChatGPT用户正在跨越传统角色承担更多任务,这正重塑工作边界。研究表明,AI工具正扩展人们的工作内容,使员工能够处理更广泛、跨职能的任务,从而改变原有的工作结构。
NVIDIA发布ModelExpress:加速模型分发,应对大模型存储挑战
NVIDIA开发者博客发布了一篇关于ModelExpress的官方文章。该文章指出,随着模型检查点文件规模增长至数百GB甚至TB级别,移动数据的“每字节成本”变得高昂。ModelExpress旨在以极高的速度分发模型工件,以应对这一日益严峻的效率与成本挑战。文章附有示意图,并强调了优化模型分发流程的重要性。
OpenAI 多个项目发布新版本更新,涵盖 Codex、CLI 与 Fence
根据 GitHub AI 组织监控的官方信息,OpenAI 旗下的多个软件项目近期发布了版本更新。其中,Codex 项目已连续发布从 0.146.0-alpha.5 到 0.146.0-alpha.9 的多个增量更新版本,具体优化内容未详细说明。此外,openai-cli 发布了 v1.5.0 版本,新增了管理服务账户 API 密钥、配置 spend_limit 以及改进工作流模板等功能。openai/fence 项目也发布了 v0.9.1 版本。所有信息均来自官方代码库发布。
ChatGPT 推出健康功能,美国用户可连接医疗记录
OpenAI 官方宣布,ChatGPT 现已推出“健康”功能。符合条件的美国用户可以安全地连接其医疗记录和 Apple Health 数据,从而获得更个性化的健康见解,更好地了解自身健康状况。该功能旨在整合健康信息,提供定制化的健康管理支持。
新基准WorldVQA发布:衡量多模态大模型对基本世界知识的掌握
Kimi官方博客发布文章,介绍了名为“WorldVQA”的新基准,旨在评估多模态大语言模型(MLLMs)对“原子世界知识”的掌握程度。该基准关注模型是否理解物理、生物等领域的基础事实,是衡量模型真实世界理解能力的重要工具。文章还提及了Kimi平台旗下的一系列AI产品和功能。
Kimi发布K2.5技术博客与Agent Swarm:强化视觉智能体与子智能体部署
Kimi官方博客发布了两篇技术内容。一篇介绍Kimi K2.5,聚焦于视觉智能体(Visual Agentic Intelligence)及其生态产品,包括一体化AI工作空间Kimi、桌面智能体Kimi Work、代码智能体Kimi Code等。另一篇介绍Kimi Agent Swarm,提及大规模部署100个子智能体的概念,并同样列举了相关产品线与功能如AI幻灯片、网站构建、深度研究等。这些内容展示了Kimi在智能体技术方面的进展,目前属于产品与技术介绍。
DeepSeek V4 预览版发布
DeepSeek 官方文档显示,其 V4 模型的预览版已于 2026 年 4 月 24 日发布。该信息出现在 DeepSeek API 文档的新闻更新部分,紧随此前 V3.2 版本的发布。文档还提供了关于模型定价、速率限制及 API 功能(如思考模式、多轮对话等)的导航信息,但未在提供的片段中包含关于 V4 模型具体性能或功能的详细描述。
英伟达发布Vera CPU和Rubin GPU架构,面向智能体AI时代
英伟达在其开发者博客上介绍了专为智能体AI设计的两款新芯片架构:Vera CPU和Rubin GPU。Vera CPU采用Olympus核心,旨在提供卓越的单线程性能,以满足智能体在沙盒中执行代码、调用工具和检索上下文等关键任务对CPU日益增长的需求。Rubin GPU架构则被定位为驱动未来AI工厂的核心,以支持从模型训练到大规模智能生产的全天候运营。这些发布反映了英伟达将计算重心从单纯的人机交互转向支持更复杂的自主智能体工作负载的战略方向。以上信息均来自英伟达官方博客。
英伟达发布多项AI技术进展,AMD推出新系统挑战
英伟达开发者博客近期发布多篇技术文章,介绍了其在AI计算领域的最新进展。其中包括通过NVLink技术扩展AI工厂网络,优化TensorRT引擎构建的可观测性和可取消性,以及在GB300 NVL72系统上创下单次专家混合模型预训练的世界纪录。此外,英伟达还提供了调试OptiX光线追踪应用程序的指南,并介绍了通过Prime Intellect Lab定制Nemotron 3 Nano模型的快速方法。与此同时,有报道称AMD推出了Helios AI机架级系统,旨在挑战英伟达的市场地位,但该信息的官方来源尚待确认。
Mistral AI发布由Mistral Medium 3.5驱动的远程代理Vibe
Mistral AI在其产品Vibe中引入了远程代理功能,该功能由Mistral Medium 3.5模型驱动。Vibe被定位为用于长周期工作的AI代理,支持在终端、集成开发环境和后台运行编码代理。此外,Mistral AI还提供了其他产品如Studio(用于构建和测试AI应用)、Forge(用于模型训练)以及Compute基础设施。
Mistral AI 发布多项新产品与功能
法国人工智能公司 Mistral AI 宣布了其产品线的多项更新与扩展。这些更新包括在 Studio 平台中为提示词和技能引入版本控制功能,以提升AI代理和应用的构建、测试与运行效率。公司还推出了新一代OCR技术 Mistral OCR 4,该技术被描述为用于文档智能的最新状态(SOTA)。此外,Mistral AI 正式介绍了 Mistral Small 4 模型。所有产品更新均通过其官方新闻渠道发布,属于已确认的官方信息。
谷歌扩展Gemini API托管代理功能:支持后台任务与远程MCP等
谷歌在官方博客中宣布,其Gemini API的托管代理功能已实现重大扩展。此次更新为开发者提供了更强大的工具集,核心亮点包括支持执行后台任务的能力,以及集成了远程模型上下文协议(MCP)等新特性。官方信息表明,该功能包的发布旨在提升代理在复杂场景下的自主性与交互效率,目前已正式面向开发者开放。
Google Images庆祝视觉搜索创新25周年
据Google AI Blog报道,Google Images正在庆祝其视觉搜索技术推出25周年。该服务自1998年推出以来,持续推动图像搜索技术的创新与发展。报道中通过插图展示了不同用户进行图像搜索的场景,体现了该技术在日常生活中的广泛应用。作为官方声明,这标志着Google在视觉搜索领域长期投入和技术积累的一个里程碑。
谷歌搜索扩展应用连接功能
根据谷歌AI博客官方信息,谷歌搜索正在扩展其应用连接功能,允许用户将更多第三方应用与搜索服务相关联,从而在搜索结果中直接呈现相关应用的内容或功能。这一更新旨在提升搜索的整合性与实用性,方便用户快速获取跨平台信息与服务。