AI 新闻中心

AI 新闻中心 过去30天分析了 1114 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

NOAH:用于表征和预测患者完整病程的纵向多模态时间感知模型

NOAH是一种生成式Transformer模型,旨在表征长期多模态患者记录并预测未来健康状态。它能够处理医学影像、时间序列、数值信号、分类事件,以及结构化和非结构化临床记录。该模型基于MIMIC数据集系列构建,涵盖超过5.59亿条临床事件、43.1万次住院或就诊记录和29.9万名患者。其双向时间整合机制和变分潜在空间用于捕捉患者状态的连续演变及临床轨迹的不确定性。NOAH支持带时间控制的预测、零样

腾讯 WorkBuddy 调整混元 Hy4 preview 模型免费使用权益

腾讯 WorkBuddy 将调整大语言模型混元 Hy4 preview 的免费使用规则。新用户,以及此前从未体验过该模型的老用户,只要在 2026 年 10 月 10 日前首次开启对话,即可从首次使用日起获得 14 天每日免费额度。已经使用过 Hy4 preview 的用户,可继续在 23:00 至次日 8:00 的闲时免费使用,其他时间则正常消耗积分。Hy4 preview 目前不具备多模态能力

我刚才说了什么?全双工语音模型的自我聆听

全双工语音模型能够同时听和说,但由于文本生成、语音合成与音频播放是异步进行的,模型认为自己说过的内容可能与用户实际听到的内容不一致。研究人员提出“Self-Listening”方法,将模型实际播放出的语音作为输入流反馈给模型。这样,模型就能根据用户真正听到的最后内容,在被打断后更准确地继续回答。研究还推出了 AnchorSpeech 数据集,用于追踪结构化回答中的哪些项目已经被说出。实验表明,加入

中国首个千亿参数级气象模型“风和”获准投入业务使用

中国气象局宣布,生成式人工智能气象服务系统“风和”V1.0通过专家评审,获准投入业务使用。该模型可理解气象服务需求、生成气象内容,支持气象推理与决策,并调用气象工具。官方评估称,风和在多项气象服务任务上的表现优于通用模型。模型使用5000万tokens的高质量气象服务语料进行训练,并整合权威气象数据。风和将为中国气象服务业务提供基础支撑,支持个性化天气查询、服务建议和气象风险预警;其国际版提供中英

SynthGait-19K:用于步态参数估计的物理基础合成视频数据集

SynthGait-19K包含19,272段合成步行视频,来自437名受试者的6,427段动作捕捉序列。该数据集配有SMPL动作数据,以及六项具有临床意义的步态参数标注。Gait2Vid能够统一异构动作捕捉记录,并生成视角和场景外观可控的视频。研究对多种估计方法进行了基准测试,结果表明合成数据训练可以迁移到真实视频,但空间步态参数对视觉域偏移尤其敏感。

Suno 发布 v6 系列 AI 音乐模型,新增多项能力

Suno 已发布 v6 系列 AI 音乐模型,并与华纳音乐、BMG 等唱片公司达成合作。该系列包含旗舰模型 v6、面向实验性音乐的 v6-wild,以及唯一向免费用户开放的 v6-mini。v6 和 v6-wild 需要 Pro 或 Premier 订阅才能使用。Suno 表示,新模型的生成速度更快,用户输入提示词后几秒即可听到音乐。模型还支持通过自然语言编辑歌曲的特定部分、使用多个音频源制作混音

AI攻克数学难题,纽约大学教授质疑OpenAI利用其研究成果

纽约大学数学家Tristan Buckmaster与Anthropic数学家Levent Alpöge宣布在纳维-斯托克斯问题上取得进展,研究期间使用了Codex和Claude等工具。不久后,OpenAI公布了一份完整证明,称该成果由一个尚未公开的新模型发现。Buckmaster质疑OpenAI是否独立采用了相同且不寻常的方法,并指称公司可能利用了他们的研究信息。OpenAI否认在研究过程中访问特

万勋科技发布 NOVA 2.0,主打商业部署的柔性具身智能架构

万勋科技宣布推出第二代具身智能系统 NOVA 2.0。公司称,该系统是一套面向开放世界、全天候商业运行的架构。NOVA 2.0 基于“肌体智能”理念,结合原生触觉多模态处理、分层架构、实时轨迹生成与场景适应能力。模型参数量超过 10 亿,据称可在 20 毫秒内生成运动轨迹。系统支持多种机器人本体,包括关节型机构、柔性单臂与双臂、灵巧手及人形机器人。万勋科技表示,NOVA 2.0 已应用于建筑、电力

OpenWAM:面向世界-动作模型系统化预训练的开放式模块化探索

OpenWAM 是一个用于系统研究机器人世界-动作模型的开放研究框架。其基础设施将生成式骨干、视觉表征、信息流、推理流程和训练数据拆分为可组合模块,从而能够通过受控实验比较不同设计。研究表明,具备足够能力的生成式骨干、紧凑且信息丰富的潜在空间、专门的动作建模能力,以及同步的联合去噪,有助于把世界知识转化为可执行控制。OpenWAM-α 使用约 6,400 小时的人类和机器人第一视角数据进行预训练,

A*-Thought-V2:利用大语言模型几何动力学实现高效潜在推理

A*-Thought-V2是一种旨在降低大语言模型思维链推理计算和上下文成本的框架。它将推理过程建模为隐藏状态轨迹:与问题到答案方向一致的步骤保留为显式文本,偏离方向的步骤则压缩为连续潜在标记。在Qwen3.5-9B和Qwen3.6-27B上的六项域内及域外基准测试中,平均准确率最高提升2.6个百分点,响应长度最多缩短一半。每计算单元的准确率提高了2.29倍,预处理和训练时间也显著减少。研究还发现

GPT-6 Astra需求激增,OpenAI或暂停Pro新用户订阅

OpenAI表示,GPT-6 Astra的用户需求达到前所未有的水平,公司正调动全部可用资源保障服务供应。如果需求继续增长,OpenAI可能暂时停止新增Pro订阅,以优先保障现有用户,尤其是Pro和企业客户的使用体验。Astra于9月3日上线时曾遭遇算力容量瓶颈,导致部分付费用户无法访问。随后,OpenAI将其纳入常规使用配额,并称针对部分长尾场景进行优化后,配额消耗最多可降至原来的四分之一至三分