AI 新闻中心

AI 新闻中心 过去一年分析了 1733 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Anthropic 发布 Claude Fable 5.1,向受信任合作伙伴提供 Mythos 5.1

Anthropic 已正式推出 Claude Fable 5.1,并向公众开放。Claude Mythos 5.1 目前面向受信任的合作伙伴提供,针对网络安全和生命科学应用加入了安全防护措施。Anthropic 称这两款模型在编程和知识工作方面处于世界领先水平,但此次公告没有提供支持这一说法的独立证据。

Anthropic称Fable 5.1在典型工作负载下成本降低25%,高度代理式任务最高降45%

Anthropic将发布AI模型Fable的新版本。该公司估计,Fable 5.1在典型工作负载下的成本将比Fable 5低25%,在高度代理式的工作中最高可降低45%。Anthropic还表示,新模型在编程和科学任务方面的表现有所提升。不过,现有信息没有提供独立基准测试或详细数据,尚无法验证这些性能改进。

CoVA-SFT:用于视觉抽象链的大规模数据集

CoVA-SFT 是一个结构化数据集,包含 51,900 个样本和超过 222,000 个多模态推理步骤,覆盖 5 类布局和 17 项复杂任务。该数据集旨在训练多模态语言模型结合文本、视觉中间表征与验证循环。配套基准 CoVA-Bench 包含 1,700 个留出测试样本。使用 CoVA-SFT 微调的模型平均性能比交错式思维链基线高出两倍以上,但仍落后于强大的纯文本思维链方法。

MMMMM:研究多语言多模态错误信息的统一分类体系

该研究分析社交媒体上的多模态错误信息,即通过结合文字和图像来误导受众的内容。研究人员从 Twitter/X 收集了涵盖七种语言的大规模真实错误信息数据集,并基于定性分析和既有理论研究构建了综合分类体系。随后,他们利用视觉语言模型(VLM)开发多阶段自动标注流程,并通过人工进行验证。研究发现,人工智能生成内容在科技和科学相关的错误信息中尤其常见;而疫苗错误信息则不成比例地使用新闻媒体图片,以增强可信

Marvis上线自定义模型功能,支持接入Kimi、GLM等主流模型

腾讯操作系统层级AI助手Marvis现已支持通过通用API标准接入第三方模型。用户可以配置腾讯云、阿里云、DeepSeek、MiniMax、Kimi、智谱和小米等厂商的模型,也可以接入本地部署的开源模型。对话过程中可随时切换模型,配置还可在Windows、Mac、iOS、安卓和iPad设备间同步。Marvis为每位用户提供每日1000万token的免费额度;接入第三方服务后,相关用量将计入用户自己

英伟达 DLSS 5 解析

英伟达正试图挽回 DLSS 5 留下的不佳第一印象。许多玩家看到《生化危机:安魂曲》主角格蕾丝·阿什克罗夫特经过 DLSS 5 处理后的脸部画面后,批评其为“AI 垃圾”。本周,英伟达重新介绍了这项备受争议的“神经渲染”技术,并强调它能够保留艺术意图、尊重已渲染的画面。