Latest
最新新闻流
按最近更新时间排列;同一事件的新证据会进入原事件,而不是重复占据新闻流。
Perplexity推出命令行界面工具,支持编程智能体联网
Perplexity推出命令行界面版本,可集成至任何开发环境。该工具旨在为编程智能体提供网络访问能力,但具体应用场景和效果尚待观察。
社交媒体AI列表提及宠物与建筑趣味
在一项社交媒体AI列表中,有观点提到宠物能让建筑变得有趣,但该信息来自非官方来源(Twitter/X AI List),未经核实,属于讨论或个人观点,而非已确认事实。
AI完成实验性基准测试项目并生成执行套件
根据Twitter/X AI List上非官方来源的帖子,用户提到一个AI系统(名为Sol)在被要求创建名为BenchBenchBenchBenchBench(BBBBB)的基准测试项目后,成功执行了相关实验,生成了用于评估基准测试指标的、由AI撰写的符合性测试套件。该帖子附带了相关链接,并指出用户最初并未预料到AI会认真对待这一看似玩笑的指令。
OpenAI报告揭示AI编程代理加速科研计算
OpenAI官方发布新报告,展示了科学家如何利用AI编程代理(AI coding agents)来现代化科学计算。该报告确认了AI代理在加速软件开发、推动基因组学等多个科学领域发现方面的应用事实。报告内容聚焦于具体应用案例,属于对现有技术应用的总结与展示,而非对未来可能性的讨论。
开发者通过社交媒体分享采用MIT许可证的游戏代码
一名开发者通过Twitter/X平台公开分享了一款游戏的源代码,并明确表示该代码采用MIT许可证,允许他人自由编辑或修改。该分享未获得官方媒体来源的验证。
谷歌AI博客发布Gemini API托管代理新功能:3.6 Flash、钩子与触发器
谷歌AI博客官方发布信息,宣布其Gemini API新增托管代理功能,主要包括Gemini 3.6 Flash模型、钩子(Hooks)和触发器(Triggers)等特性。此为已确认的官方产品更新信息,旨在提升代理的自动化与交互能力。
社交媒体呼吁讲述类似故事
一条来自Twitter/X AI列表的社交媒体帖子指出,类似的故事应该被更多地讲述。该帖子未提供具体背景或细节,仅表达了对传播此类故事的呼吁。这反映了用户对特定类型内容分享的倡导。
Inkling模型发布:全新训练、权重开放,现可微调
根据Twitter/X AI List上的非官方帖子,一款名为Inkling的首个模型宣布发布。该模型从零开始训练,其权重已开放,并且用户可以在Tinker平台上对其进行微调。此信息目前尚未得到官方确认,属于讨论或发布预告。
AI研究先驱回顾行业发展:从少数推动者到全球CEO首推
根据社交媒体帖子,一位AI研究者回忆了早期仅有包括@allen_ai、@ylecun、@jeremyphoward等在内的少数人推动AI话题发展的时期,并对比了如今AI话题已成为全球最具价值公司CEO的首条推文内容的现状,凸显了AI领域的显著发展与普及。
英伟达强调开放AI模型重要性
英伟达在社交媒体分享信件,强调开放AI模型的重要性。信中指出AI将改变每个行业,驱动每家公司,并由每个国家构建。开放模型有助于加强安全与网络安全、加速创新与传播,并实现技术自主。英伟达认为,世界既需要前沿的闭源模型,也需要前沿的开源模型。
用户质疑Claude是否已停止显示完整思维摘要痕迹
一名用户在社交媒体上提出,Anthropic公司的AI模型Claude可能已停止向用户显示其完整的、经过摘要的思维过程痕迹(thinking traces)。该用户认为,如果属实,这将是一个重大损失,原因有二:首先,这会削弱模型的可解释性,因为即使是摘要后的思维痕迹也能帮助用户诊断错误;其次,这些痕迹本身具有洞察价值。目前,此讨论基于用户观察,尚未得到官方证实。
Google AI博客分享利用Google Search举办完美晚宴的五种方法
Google AI博客发布了一篇官方文章,介绍了利用Google Search来规划和举办终极晚宴派对的五种实用方法。文章强调了如何通过搜索工具获取灵感、规划菜单、寻找食谱以及提升派对整体体验。内容以图文并茂的形式呈现,配有一张带有闪光效果的黑色放大镜图标图片,该图标置于晚宴餐桌布置的白色圆形背景中。
谷歌AI博客介绍搜索中AI模式的五种现实世界应用方式
谷歌在其官方AI博客中发布了题为“搜索中AI模式帮助您享受现实世界的5种方式”的文章。文章配图展示了一个白色圆圈内的黑色放大镜置于绿色草地上,周围环绕着网球和游戏等与趣味活动相关的物品。这暗示了AI搜索功能旨在将数字信息与实际生活体验相结合。原文标题和摘要被直接翻译,专有名词如“AI Mode in Search”保留为“搜索中AI模式”。
科技人物语录“保持饥渴,保持愚蠢”在社交媒体引发关注
一条来自社交媒体平台(Twitter/X)AI列表的非官方帖子,分享了科技领域广为流传的语录“Stay hungry, stay foolish.”(保持饥渴,保持愚蠢),并将分享者称为“传奇人物”。该内容本身为对一句经典格言的引用和转发,未提供具体事件或新事实信息。作为讨论的一部分,该语录常与创新精神和科技领袖(如史蒂夫·乔布斯)相关联,但在此帖中仅为引用,未展开具体论述。
讨论从零开始设计和开发AI智能体,哪个大模型在方案生成上更具优势
基于V2EX AI用户社区的讨论,有用户提出在从零开始进行AI智能体的方案设计与开发时,希望比较不同大模型的能力。具体情境是开发一个类似Codex的智能体,核心问题在于哪个大模型能提供更强大、更合理的初始方案。目前这属于用户发起的比较性讨论,旨在寻求实际开发经验分享,尚未形成基于性能基准的明确结论。
V2EX用户发布凭记忆画国家边界的小游戏
一位V2EX用户开发并分享了一个名为CountryDraw的网页小游戏。该游戏允许玩家根据国家名称,在空白画布上凭记忆绘制其边界轮廓,系统会对比真实边界给出0-100%的评分。游戏提供世界国家、美国各州及每日挑战等多种模式,并包含画国旗的独立玩法。该游戏无需注册登录,支持生成链接分享对战。
探讨AI安全访问生产数据库的方案
文章讨论了在大公司环境中,如何让AI工具(如Codex)在安全可控的前提下查询生产数据库。当前常见的数据库查询系统(如DMS)需要手动编写SQL,效率较低。作者提出设想:通过为AI工具(如Codex)配置数据库MCP(模型上下文协议)接口,并设置安全防护栏(如执行时间限制)和数据脱敏,实现AI基于代码自动生成并执行SQL查询。该方案旨在提升查询效率,但可行性及业界实践尚在讨论中。
Claude Opus 5 在 Perplexity 平台上线,评测显示性价比突出
基于提供的证据,Anthropic公司的最新模型 Claude Opus 5 已正式登陆 Perplexity 搜索引擎及 Perplexity Computer 服务。在名为 WANDR 的基准测试中,该模型与另外六款模型进行了对比。评测结果表明,Claude Opus 5 的性能超越了其中五款模型,仅略逊于 Fable 5,并且其使用成本比后者低57%。这表明 Claude Opus 5 在性能与成本之间取得了良好平衡。
个人开发者建立AI骗局档案库,呼吁用户提交受骗证据
一位多次遭遇AI渠道骗局的开发者建立了一个专门记录AI骗子信息的网站fakerouter.com。该网站围绕交易身份(如域名、微信号、QQ号、手机号、支付宝账号)为骗子建立档案,旨在防止骗子更换身份后记录清零。目前主要收录收款跑路、模型降级掺水、倍率虚标、出售无效API Key等欺诈行为。该网站并非中转站,查询和举报均无需注册,但举报需经审核后入库。开发者表示网站刚上线数据较少,呼吁受骗者提交域名、交易标识、聊天记录和付款凭证等证据,以拼凑骗子的完整轨迹。
AI公司Kimi发布PerceptionBench基准测试 评估多模态大模型视觉感知能力
月之暗面旗下AI产品Kimi在其官方博客发布名为PerceptionBench的新基准测试,旨在评估多模态大语言模型(MLLMs)的原子级视觉感知能力。这是官方确认的信息。该测试旨在衡量模型对图像基础元素的理解。Kimi同时介绍了其一系列AI工具产品线,包括全能AI工作空间Kimi、桌面AI助手Kimi Work、代码代理Kimi Code、浏览器扩展Kimi WebBridge以及可访问最新模型的Kimi平台,还提到了AI演示制作、网站构建、深度研究、表格处理和文档管理等具体功能。