AI 新闻中心

AI 新闻中心 过去一年分析了 1727 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

超越最终得分:长期人工智能研发代理的系统性评估

一项研究通过36项长期人工智能研发任务,评估了7个前沿模型。该框架不仅考察最终得分,还分析解决方案构思、执行、反馈控制,以及代理在任务内和任务间复用经验的能力。结果表明,当前代理更像工程优化器,而不是完全自主的研究人员。它们能够制定并实施实用方案,但不同运行结果之间的性能差异较大。表现最好的方案通常是对已有技术进行调整或组合,真正的方法论创新仍然少见。研究还发现,流程瓶颈、经验复用方式以及运行环境

Marionette预测世界状态、渲染几何并生成外观

Marionette是一种面向交互式游戏的世界模型。它不直接生成像素或潜在表示,而是预测一个包含多实体关节骨架、根部轨迹和旋转的276维显式三维世界状态。无参数渲染器根据该状态计算几何结构和遮挡,带控制条件的视频扩散模型则生成逼真的RGB画面。这种分离式设计提升了可控性和长时一致性。向预测状态加入地形碰撞器和距离上限后,角色陷入地面的情况减少了66%,角色彼此漂移过远的问题也得到抑制。研究人员表示

Intern-S2-Mobius:解耦知识与推理的基础模型

研究人员推出 Mobius-v0,这是一种将存储知识向量的全局共享记忆模块,与负责迭代执行组合推理的多个推理器分离的架构。研究团队称,从头训练的 7B 模型仅使用 7B Transformer 基线模型 62.6% 的训练数据,就达到了相近的下游任务成绩。基于 Qwen3.5-35B 持续预训练的 Intern-S2-Mobius,据称在保持相近性能的同时,实现了接近 4 倍的端到端推理速度。

SPARGen:通过原生多模态生成统一空间感知与推理

SPARGen 是一个多模态框架,将 3D 重建、密集对应和空间推理统一为指令条件生成任务。该方法把紧凑的结构化输出和语言输出序列化为标记序列,同时生成与图像对齐的密集几何场,使空间监督能够共同塑造原生多模态生成模型中的共享表示。在 3D 重建、对应关系和空间推理基准测试中,SPARGen 通过单一框架在多种空间任务上取得了具有竞争力的性能。

小红书开源模型获突破:华为昇腾完成发布即全量适配与性能优化

小红书发布了新开源模型 dots3-note 的预览版。据介绍,该模型总参数量为2800亿,激活参数量为160亿,支持文本、视觉和语音等多模态能力。华为表示,Atlas 800A3 与 Atlas 900A3 SuperPoD 平台已在模型发布当日完成全量适配,并通过开源推理引擎 vLLM Ascend 支持部署和运行。优化内容包括多模态处理、通信与计算融合、MoE 推理吞吐量,以及利用 MTP

OpenAI推出GPT-5.6 Sol UltraFast模式,最高每秒生成750个Token

OpenAI日前宣布面向企业客户推出GPT-5.6 Sol UltraFast模式预览版。该模式由Cerebras提供算力支持,据称速度最高可达标准模式的14倍,每秒最多生成750个Token。目前服务采用申请审核制,企业需要提交具体使用场景。OpenAI表示,该模式主要面向实时语音交互、客户支持、开发智能体、金融研究和安全研究等对延迟要求较高的工作负载。上述性能数据来自官方发布,仍需独立验证。

中国科研团队发布大豆垂直大模型“丰菽”2.0,助力辅助育种

安徽农业大学研究团队发布了面向大豆科研与育种的生成式 AI 模型“丰菽”2.0。该多模态系统整合大豆种质资源、基因组、蛋白质、转录本、基因表达、病害、表型和育种试验数据,以及相关科研文献。升级后的多模型协同分析功能,可让多个通用大模型分别回答同一专业问题,再结合领域知识、私有数据和结构化规则,分析不同回答的共识、差异及证据完整性。模型目前可辅助开展病害诊断、育种亲本筛选、虚拟组合设计、表型数据解析

IT早报 8月17日:DeepSeek上调API价格,多款AI模型上线并曝出滥用案例

今日IT早报包含多项人工智能相关消息。DeepSeek启用API分时定价方案,峰值时段价格上调。千问办公新增GLM-5.3和DeepSeek V4 Pro,用户可直接选择使用,但相关模型信息尚未经过独立验证。中国一名大学生利用AI人脸伪造视频绕过银行验证,盗刷5万余元,最终被判处有期徒刑一年十个月。中消协表示,近期AI客服相关投诉明显增多,问题包括作出不实承诺以及消费者难以转接人工客服。作家莫言认

DeepSeek API 峰谷定价方案今日生效

DeepSeek 已为 API 引入峰谷定价。自北京时间 2026 年 8 月 17 日 0 时起,高峰时段为 9:00—12:00 和 14:00—18:00,价格为闲时的两倍,其余时段按半价计费。DeepSeek-V4 Flash 每百万 tokens 的价格,闲时根据输入和输出类型为 0.05 至 4.5 元,高峰时段为 0.10 至 9 元。V4 Pro 的对应价格分别为 0.15 至 1

Claude 模型在历时 54 小时但未成功的黎曼猜想尝试中取得数学突破

据报道,一个 Claude 模型曾用 54 小时尝试解决黎曼猜想,虽然最终未能成功,但在过程中取得了数学进展。《华尔街日报》记者本·科恩称,该模型多次回应用户给予的鼓励。这一事件体现了先进 AI 模型数学能力的提升,但并不意味着这一著名数学难题已经得到经过验证的解决方案。

创作者将歌曲压缩至 21KB,并用 8 个二维码打印到纸上保存

创作者 Makestreme 使用 Meta 的神经音频编解码器 EnCodec,将一首约 2 分钟、大小约 2.9MB 的 MP3 歌曲压缩至约 21KB。在 3 kbps 模式下,音频波形被转换为离散 Token,再拆分到 8 个二维码中,打印在一张纸的正反两面。播放时仍需要对应的 EnCodec 神经解码器。3 kbps 模式下恢复出的歌曲仍具有一定可听性,但降至 1.5 kbps 后音质明

人形机器人冲刺备战世界运动会家政赛:须在30分钟内完成收纳叠衣

第二届世界人形机器人运动会即将在北京举行,各参赛队伍已进入最后训练阶段。家政赛要求机器人在30分钟内完成物品收纳、衣物折叠等任务,重点考验手眼协调、长时间连续工作和多任务自主规划能力。参赛团队利用摄像头采集的真实场景数据,以及远程操控和仿真数据训练大模型,持续优化机器人系统。部分团队还开发了终身学习机制,使机器人能够根据关节部件的磨损调整运动程序。本届赛事将有来自16个国家的2056台机器人参加,

莫言:AI只能重新拼凑前人作品,写不出《岳阳楼记》这样的传世名篇

中国作家、诺贝尔文学奖得主莫言在新短篇小说集《人呐》的分享活动上谈到 AI 写作。他表示,对于格律诗、骈体文等需要严格押韵和对仗的高技术性文体,人工智能可以完成得很好。但他认为,即使 AI 再先进,也无法创作出《岳阳楼记》《滕王阁序》这样的传世名篇,更无法写出李白、杜甫、屈原等伟大诗人的作品。莫言称,AI 的创作本质是对前人作品进行“拼凑”和“搅拌”,再组合成所谓的新作。如果作家和艺术家都停止创作