Alpha Pulse New

其他

中国开源AI模型动态与世界模型研究进展

首次出现 7月28日 10:03·最近更新 7月28日 16:04

近期,中国在人工智能领域有多项开源模型发布与技术进展。华为联合六所高校发布名为Boogu-Image-0.1的文生图模型,训练成本约40万美元,使用2亿张图片,宣称性能可比肩闭源模型。同时,一项研究利用50万小时视频数据,训练出首个具备隐式触觉感知的世界动作模型。在世界模型的基础研究方面,Yann LeCun团队的新工作VISReg被转发并认可,该方法旨在解决自监督学习中JEPA世界模型的“表征坍塌”核心难题。此外,昆仑万维公开了其押注世界模型的两大产业路径:一是实现内容创作的实时化与交互化,二是用于机器人的行动“预演”。报道指出,世界模型需进一步回答“如果用户做出某个动作,接下来会发生什么”这一关键问题。上述内容综合了模型发布、技术突破与产业布局等多个方面。

多来源证据

Hermes NewsCrawler 输出·media·

中国为何免费提供其最好的AI模型

报道介绍了相关产品、技术或业务变化,具体信息以来源正文为准。

微信公众号 mptext·wechat·

40万美元、2亿张图:华为联合6校训出2K模型 Boogu-Image-0.1,比肩闭源

训练一个顶级文生图模型,到底需要多少钱?

微信公众号 mptext·wechat·

世界模型有触觉了!50万小时视频,训出首个隐式触觉世界动作模型

世界模型长出“触觉神经”

微信公众号 mptext·wechat·

LeCun连续转发!新作VISReg攻克JEPA世界模型「表征坍塌」核心难题

LeCun连续转发!新作VISReg攻克JEPA世界模型「表征坍塌」核心难题 新智元 新智元 新智元 在小说阅读器读本章 去阅读 在小说阅读器中沉浸阅读 新智元报道 JEPA世界模型的底层是Yann LeCun自2017年起持续倡导的自监督学习(Self Supervised Learning, SSL)。 SSL 无需人工标注即可从海量数据中学习通用表征,但普遍面临一个核心难题—— 表征坍塌 (representation collapse):模型倾向于把不同输入映射到相同或极少数几个向量上,看似完成了训练,实则未学到有判别力的表征。 为抑制坍塌,主流方法大多依赖一系列 启发式技巧 (EMA

微信公众号 mptext·wechat·

昆仑万维押注世界模型的两大产业路径:内容创作实时、可交互,机器人先“预演”再行动

世界模型需要进一步回答“如果用户做出某个动作,接下来会发生什么”

事件时间线

  1. 7月28日 00:51
    Hermes NewsCrawler 输出
    中国为何免费提供其最好的AI模型
  2. 7月28日 09:22
    微信公众号 mptext
    40万美元、2亿张图:华为联合6校训出2K模型 Boogu-Image-0.1,比肩闭源
  3. 7月28日 10:21
    微信公众号 mptext
    世界模型有触觉了!50万小时视频,训出首个隐式触觉世界动作模型
  4. 7月28日 12:40
    微信公众号 mptext
    LeCun连续转发!新作VISReg攻克JEPA世界模型「表征坍塌」核心难题
  5. 7月28日 13:27
    微信公众号 mptext
    昆仑万维押注世界模型的两大产业路径:内容创作实时、可交互,机器人先“预演”再行动
返回新闻流