NOAH:用于表征和预测患者完整病程的纵向多模态时间感知模型
NOAH是一种生成式Transformer模型,旨在表征长期多模态患者记录并预测未来健康状态。它能够处理医学影像、时间序列、数值信号、分类事件,以及结构化和非结构化临床记录。该模型基于MIMIC数据集系列构建,涵盖超过5.59亿条临床事件、43.1万次住院或就诊记录和29.9万名患者。其双向时间整合机制和变分潜在空间用于捕捉患者状态的连续演变及临床轨迹的不确定性。NOAH支持带时间控制的预测、零样
AI 新闻中心 过去30天分析了 1114 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
NOAH是一种生成式Transformer模型,旨在表征长期多模态患者记录并预测未来健康状态。它能够处理医学影像、时间序列、数值信号、分类事件,以及结构化和非结构化临床记录。该模型基于MIMIC数据集系列构建,涵盖超过5.59亿条临床事件、43.1万次住院或就诊记录和29.9万名患者。其双向时间整合机制和变分潜在空间用于捕捉患者状态的连续演变及临床轨迹的不确定性。NOAH支持带时间控制的预测、零样
苹果首席执行官约翰·特努斯表示,iPhone 仍是最适合人工智能应用的设备。该公司还声称,在设备端运行的模型能够为消费者提供更好的隐私保护。
苹果正式发布了搭载人工智能功能的 Siri。此次发布包括一款专用聊天机器人应用、图像生成能力,以及针对苹果设备的一系列升级。
腾讯 WorkBuddy 将调整大语言模型混元 Hy4 preview 的免费使用规则。新用户,以及此前从未体验过该模型的老用户,只要在 2026 年 10 月 10 日前首次开启对话,即可从首次使用日起获得 14 天每日免费额度。已经使用过 Hy4 preview 的用户,可继续在 23:00 至次日 8:00 的闲时免费使用,其他时间则正常消耗积分。Hy4 preview 目前不具备多模态能力
全双工语音模型能够同时听和说,但由于文本生成、语音合成与音频播放是异步进行的,模型认为自己说过的内容可能与用户实际听到的内容不一致。研究人员提出“Self-Listening”方法,将模型实际播放出的语音作为输入流反馈给模型。这样,模型就能根据用户真正听到的最后内容,在被打断后更准确地继续回答。研究还推出了 AnchorSpeech 数据集,用于追踪结构化回答中的哪些项目已经被说出。实验表明,加入
中国气象局宣布,生成式人工智能气象服务系统“风和”V1.0通过专家评审,获准投入业务使用。该模型可理解气象服务需求、生成气象内容,支持气象推理与决策,并调用气象工具。官方评估称,风和在多项气象服务任务上的表现优于通用模型。模型使用5000万tokens的高质量气象服务语料进行训练,并整合权威气象数据。风和将为中国气象服务业务提供基础支撑,支持个性化天气查询、服务建议和气象风险预警;其国际版提供中英
SynthGait-19K包含19,272段合成步行视频,来自437名受试者的6,427段动作捕捉序列。该数据集配有SMPL动作数据,以及六项具有临床意义的步态参数标注。Gait2Vid能够统一异构动作捕捉记录,并生成视角和场景外观可控的视频。研究对多种估计方法进行了基准测试,结果表明合成数据训练可以迁移到真实视频,但空间步态参数对视觉域偏移尤其敏感。
法律科技初创公司 Harvey 在 Lightspeed 和 Diffusion 共同领投的新一轮融资中筹集了5.5亿美元,估值升至156亿美元。该公司今年3月融资2亿美元时的估值为110亿美元。Harvey 计划利用这笔资金推进自有人工智能模型的开发。
Suno 已发布 v6 系列 AI 音乐模型,并与华纳音乐、BMG 等唱片公司达成合作。该系列包含旗舰模型 v6、面向实验性音乐的 v6-wild,以及唯一向免费用户开放的 v6-mini。v6 和 v6-wild 需要 Pro 或 Premier 订阅才能使用。Suno 表示,新模型的生成速度更快,用户输入提示词后几秒即可听到音乐。模型还支持通过自然语言编辑歌曲的特定部分、使用多个音频源制作混音
纽约大学数学家Tristan Buckmaster与Anthropic数学家Levent Alpöge宣布在纳维-斯托克斯问题上取得进展,研究期间使用了Codex和Claude等工具。不久后,OpenAI公布了一份完整证明,称该成果由一个尚未公开的新模型发现。Buckmaster质疑OpenAI是否独立采用了相同且不寻常的方法,并指称公司可能利用了他们的研究信息。OpenAI否认在研究过程中访问特
万勋科技宣布推出第二代具身智能系统 NOVA 2.0。公司称,该系统是一套面向开放世界、全天候商业运行的架构。NOVA 2.0 基于“肌体智能”理念,结合原生触觉多模态处理、分层架构、实时轨迹生成与场景适应能力。模型参数量超过 10 亿,据称可在 20 毫秒内生成运动轨迹。系统支持多种机器人本体,包括关节型机构、柔性单臂与双臂、灵巧手及人形机器人。万勋科技表示,NOVA 2.0 已应用于建筑、电力
AI 音乐初创公司 Suno Inc. 正在推出与华纳音乐集团等主要音乐行业企业合作训练和开发的新人工智能模型。这些模型旨在就音乐使用向唱片公司提供报酬。
OpenWAM 是一个用于系统研究机器人世界-动作模型的开放研究框架。其基础设施将生成式骨干、视觉表征、信息流、推理流程和训练数据拆分为可组合模块,从而能够通过受控实验比较不同设计。研究表明,具备足够能力的生成式骨干、紧凑且信息丰富的潜在空间、专门的动作建模能力,以及同步的联合去噪,有助于把世界知识转化为可执行控制。OpenWAM-α 使用约 6,400 小时的人类和机器人第一视角数据进行预训练,
A*-Thought-V2是一种旨在降低大语言模型思维链推理计算和上下文成本的框架。它将推理过程建模为隐藏状态轨迹:与问题到答案方向一致的步骤保留为显式文本,偏离方向的步骤则压缩为连续潜在标记。在Qwen3.5-9B和Qwen3.6-27B上的六项域内及域外基准测试中,平均准确率最高提升2.6个百分点,响应长度最多缩短一半。每计算单元的准确率提高了2.29倍,预处理和训练时间也显著减少。研究还发现
OpenAI表示,GPT-6 Astra的用户需求达到前所未有的水平,公司正调动全部可用资源保障服务供应。如果需求继续增长,OpenAI可能暂时停止新增Pro订阅,以优先保障现有用户,尤其是Pro和企业客户的使用体验。Astra于9月3日上线时曾遭遇算力容量瓶颈,导致部分付费用户无法访问。随后,OpenAI将其纳入常规使用配额,并称针对部分长尾场景进行优化后,配额消耗最多可降至原来的四分之一至三分