AI 新闻中心

AI 新闻中心 过去30天分析了 4640 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Claude Sonnet 5.5发布:据称编程能力超越旗舰,API价格减半

文章称,Anthropic于9月29日发布Claude Sonnet 5.5。这款中端模型据称在多项编程基准测试中超过Opus 5.5,通用任务表现也接近旗舰水平。API价格为每百万输入词元2美元、每百万输出词元10美元;Anthropic称,推理效率提升可使综合成本最高降低30%。文章还提到,模型新增了针对高风险编程请求的防护措施和防抄袭机制。以上信息及测试结果均为文章转述的Anthropic说

蝴蝶效应发布 Manus 2.0,称成本降低约三成并支持 AI Agent 协作

蝴蝶效应发布了 Manus 2.0 海外版重大更新。该产品主打任务执行,而非以对话为核心。公司称,新架构可将同类任务的执行时间和运行成本分别降低近 30%。新功能包括由邮件或日历事件触发的自动化工作流,以及视频和游戏制作工具。公司还推出 Cue 应用,支持多个 AI Agent 协同工作。Manus 2.0 能否在市场竞争中胜出,仍有待观察。

EmbodiedMemory-Bench 评测长期具身任务中的记忆能力

长期与环境交互的智能体需要保留并持续更新通过观察和行动获得的信息。EmbodiedMemory-Bench(EMem-Bench)旨在评估这类能力,包含四类任务、共 2,554 个交互回合,要求智能体从过往交互中建立记忆,并在后续任务中加以利用。研究团队还推出外部记忆系统 EMem,用于整理空间、事件和场景记忆;以及能够管理和使用这些记忆的 80 亿参数策略模型 EMem-8B。评测结果显示,现有

重新审视大语言模型强化学习中的训练—推理不匹配问题

该研究分析了大语言模型在可验证奖励强化学习中,推理引擎与训练引擎之间的不匹配。由于两个引擎可能为相同的 token 分配不同概率,研究人员提出校准重要性采样(CIS),根据 token 的置信度限制重要性比率。理论上,CIS 将精确重要性采样中无界的二阶矩替换为有界项,同时控制由此产生的偏差。在三个混合专家模型和五个数学推理基准上的评估中,CIS 在三个模型上均取得了所有比较基线中的最高平均成绩。

AdaTutoRank:通过自适应指导优化为 RAG 和深度研究重排文档集合

AdaTutoRank 是面向检索增强生成(RAG)和深度研究的集合式重排器。它不再仅根据单篇文档的相关性进行排序,而是优化完整、互补且低冗余的文档集合。其自适应指导优化方法从策略模型的冻结快照中生成不同具体程度的提示,并根据每次 rollout 的质量,将提示用于冷启动监督、强化学习和蒸馏。在覆盖 RAG、深度研究和集合评估的十项基准测试中,作者称 AdaTutoRank 在减少检索调用的同时取

YuE2统一符号化规划与音频音乐生成

YuE2先生成标明旋律与和声的可读乐谱,再将其转换为音乐表征,并据此生成完整歌曲。在研究报告的专家比较中,采用符号化规划的版本比未采用该方法的版本更常获选。作者称,YuE2在WildSongBench上超过了受测的公开基线系统;从八个候选结果中挑选最佳版本时,也优于Suno v4.5,而与Suno v5的比较结果则基本持平。研究还推出用于音乐表征学习的MERT2,以及用于主旋律谱转录的SheetS

哈佛心理学家:渲染“AI末日”无助于应对风险

哈佛大学心理学家史蒂文·平克认为,人工智能导致人类灭绝的风险被夸大了。他在致精神科医生、科技博主斯科特·亚历山大的公开信中,拒绝参加围绕AI生存风险的公开辩论,并批评“回形针最大化器”等末日设想。平克认为,更值得重视的现实风险包括生物恐怖主义、网络攻击和缺乏约束的AI智能体。他表示,渲染末日情景无助于解决这些问题,真正有效的做法是开展审慎的安全工程,并建立独立监督、责任机制和人类控制。亚历山大则估

英伟达CEO黄仁勋:AI模型蒸馏是竞争,不是盗窃

英伟达CEO黄仁勋表示,AI模型蒸馏属于市场竞争,而不是盗窃。该技术利用现有模型的输出结果训练新模型。美国财政部长斯科特·贝森特此前将蒸馏称为“盗窃”,并威胁制裁从美国开发模型中获取技术能力的海外企业。美国网络安全机构和Anthropic也指控阿里巴巴、深度求索等中国AI企业存在非法蒸馏行为。中方已驳斥相关指控。黄仁勋表示,如果企业不希望自己的产品被这样使用,可以限制服务访问权限。

腾讯据称秘密内测 AI 游戏搭子“鹅次元”

据中国媒体报道,腾讯正在内部测试 AI 游戏陪伴产品“鹅次元”。该产品提供多名具有不同人设的男女虚拟角色,支持语音对话、画面实时识别,以及适配多款主流网络游戏的陪玩功能。用户可以选择角色进行闲聊互动,或开启专门的游戏陪伴模式。目前全部功能限时免费,但界面已出现以星币兑换能量的机制,暗示未来可能引入付费模式。腾讯尚未正式确认该产品的发布计划、服务范围或技术细节。

FF拟以2亿美元估值拆分机器人业务独立上市,转向Physical AI

Faraday Future宣布,旗下FFAI已与纳斯达克上市公司AIxC签署非约束性协议,拟以2亿美元估值整合机器人资产并独立上市,上市后计划更名为FFR。公司将把战略重点转向Physical AI、Robotaxi共享网络和智能座舱技术。五年规划预计投入3亿美元研发,累计销售超过13万台机器人。公司提出的销量、营收和毛利率目标均属于预测,尚未得到交易完成或实际经营业绩的验证。

Anthropic招股书揭露420亿美元亏损及5180亿美元年度支出计划

一份最新公开的招股书披露了AI公司Anthropic的财务状况。文件显示,公司2025年录得420亿美元净亏损,但营收增长12倍,接近46亿美元。即使扣除主要与早期融资相关的负债减值影响,营业亏损仍超过80亿美元。计算和基础设施支出达到73.3亿美元,超过总运营支出的一半,约为2024年的三倍。根据文件,Anthropic计划在未来一年投入5180亿美元,用于云服务、算力和基础设施。公司近四分之一