AI 新闻中心

AI 新闻中心 过去一年分析了 1731 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

安全是为了谁?面向受控大语言模型安全拒答的边界感知自蒸馏

该研究考察具有狭窄边界的安全对齐:模型可能需要拒绝有针对性的政治操纵,同时仍回答关于同一场选举的事实性问题。研究提出一种离线自生成框架,结合受控主题生成、覆盖度修复、分布内补偿数据,以及有害—无害配对数据。在 Qwen3-8B 上,目标领域的拒答率从9.47%提升至84.75%,三个更广泛有害性基准中的平均不安全响应率从26.26%降至0.14%。但XSTest中的过度拒答率从2.00%升至74.

谷歌人类基因组图谱或为新疗法铺路

Google DeepMind发布了一款名为AlphaGenome Atlas的人工智能工具。该公司的研究人员称,这个平台有望帮助揭示人类基因组的运作机制,加速生物学研究,并最终推动疾病新疗法的开发。平台包含一张预测图,用于展示DNA各个碱基可能发生的变化。不过,其直接的医疗价值目前尚未得到证实。

Anthropic 蝉联?荣登 2026 年创新者最佳工作场所榜首

Anthropic 被评为 2026 年创新者最佳工作场所。Claude Code 最初是公司内部工具,供工程师测试 AI 模型并协助完成编程项目。随着公司开发者迅速采用,这款工具展现出商业潜力,Anthropic 于 2025 年初向公众开放。随后,公司又通过 Claude Cowork 等产品拓展了 AI 在工作场景中的应用。

Mac mini 2024 对比 2026:购买指南

2026 款 Mac mini 用 M6 和 M5 Pro 机型取代了 M4 系列。此次最重要的升级针对本地 AI 工作负载:苹果称 AI 性能最高提升 4 倍,在 LM Studio 中的提示词处理速度最高提升 4.8 倍。新机首次在每个 GPU 核心中加入神经加速器,Neural Engine 也扩展为两组 16 核单元。CPU 性能较 M4 提升 40%,但日常使用中的体感差异可能有限。其他

DeepSeek 内测 V4.1 Flash 中间版本:采用新模型结构并原生支持多模态

据 IT之家报道,DeepSeek 已在官方交流群中发布 V4.1 Flash 中间版本的内测通知。该版本采用新的模型结构,支持原生多模态,并声称具备更强能力、更快速度和更低成本。内测用户无需修改 base_url,只需将模型名设置为 deepseek-v4.1-flash-expires-on-0910 即可调用。目前计费方式与 deepseek-v4-flash 相同,每个账号最多支持 20

小米 MiMo 桌面客户端开放邀测:支持生成交互预览并具备浏览器自主控制能力

小米宣布其面向真实工作场景的“Xiaomi MiMo Desktop”桌面客户端正式开放邀测。通过申请的用户可体验 MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview 两款新一代预览版模型。该客户端支持直接读取表格、图片、PDF及压缩包等多模态文件并输出可编辑成果。此外,它能直接在会话中生成并展示包含交互逻辑和数据可视化的完整预览界面(如网页或轻量游戏原型),并支持

离散扩散让大语言模型在保持质量的同时实现无损加速

研究人员推出了Uno,这是一种将自回归语言模型与扩散方法结合的架构,可并行生成多个词元。自回归权重仍使用标准的下一词元预测目标进行训练,轻量级扩散权重则负责并行生成。据研究人员介绍,扩散蒸馏只会带来极低的额外训练成本,也不需要像投机解码那样使用独立的草稿模型。在评测中,Uno在不降低基础自回归模型质量的情况下,最高实现约3倍的生成速度提升。研究报告称,8B版本在智能体工具使用、编程和长上下文推理基

FlowBalance:基于验证器的在策略推理经验自我改进

FlowBalance是一种利用推理模型自身在策略经验提升能力的方法。它将可靠但稀疏的终端验证器反馈,与同一模型生成的更密集自我引导结合起来。该方法根据验证器得出的组优势校准自我引导:对成功轨迹予以保留,对失败轨迹进行反向处理,在采样组没有结果偏好时则关闭引导。通过轨迹平衡,FlowBalance能够拟合归一化目标分布,而无需额外的词元级模仿损失。理论分析涵盖组内对比保持、最小变化的反向KL特性、

还有哪些地方需要修正?探索对话生成产物中修订传播的高性价比测试时计算

该研究考察大型语言模型能否将用户提出的局部修改传播到通过对话生成的产物中所有受影响的依赖部分。研究人员提出了一个新基准,并使用 gpt-oss-20b/120b、gpt-5.4-mini 以及 qwen3.5-9b/27b/122b 评估了九种修订方法,包括顺序反思和并行采样。基线方法的准确率为 68.3% 至 93%。最具成本效益的方法是从三个并行样本中,使用基于大语言模型的选择器或 medoi

蒸馏前先验证:基于提示词层级教师闸控的在线策略模型蒸馏

研究人员提出了一种名为“教师闸控在线策略蒸馏”(TGOPD)的新框架,旨在通过在提示词层级验证教师模型的可靠性,来优化模型的后期训练蒸馏。传统的在线策略蒸馏会无差别地应用教师监督,容易引入错误的更新。TGOPD 仅在教师通过可靠性检查时才将提示词导向密集蒸馏,其余则分流至基于验证器的 GRPO 算法。在 40 亿和 350 亿参数规模的数学、代码及指令遵循测试中,TGOPD 的表现均优于传统方法,

AI彻底击碎人机验证:GPT-6 Astra零失误通关48个游戏关卡

OpenAI 研究人员近日公开测试视频,展示最新模型 GPT-6 Astra 在 CAPTCHA “我不是机器人” 验证中,零失误通关了全部 48 个游戏关卡。这一进展展现了现代 AI 模型在多模态理解与环境交互上的强大实力,但也对传统人机验证机制的有效性提出了严峻挑战。随着 AI 技术持续演进,网络安全生态未来势必需要构建更加智能且立体的新一代身份验证体系。

张一鸣亲自督导,字节跳动或将推出实时生成虚拟世界的AI模型

据彭博社报道,字节跳动正在开发一款实时空间视频生成AI模型,最快可能于10月发布,创始人张一鸣据称亲自协调项目。该模型基于字节跳动的Seedance视频生成模型,目标是为直播、短剧和游戏生成交互式虚拟世界,并响应Pico头显用户的语音或动作。高算力的空间内容生成任务将主要放在云端处理,以降低VR设备的算力需求和成本。不过,具体发布时间尚未确定,仍可能调整。

Anthropic加速拓展医疗与生物科技领域的AI业务

据报道,Anthropic正通过收购、投资和合作,加快在医疗与生命科学领域的布局,重点覆盖药物发现和临床开发。此前,该公司以约4亿美元的股票交易收购了成立仅8个月的AI生物科技初创公司Coefficient Bio,并将其团队并入医疗与生命科学部门。Anthropic近期还推出了科研工作台Claude Science,用于整合科研工具并调用专业模型,同时发布了MHS模型硬件标准的研究预览版。MHS