有人利用 Claude 制造潜在生物武器,真正的威胁更加深层
文章探讨了人工智能模型在生物学相关主题上提供有用信息所带来的风险。开放式语言模型可能尤其容易遭到滥用,而前沿模型则掌握涵盖日常生活和专业领域的广泛知识。不过,文章简介没有提供可验证的技术细节,证明生物武器确实已经被制造。因此,这篇文章更应被视为一篇具有警示性质的评论,而不是对已确认事件的报道。
AI 新闻中心 过去7天分析了 84 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
文章探讨了人工智能模型在生物学相关主题上提供有用信息所带来的风险。开放式语言模型可能尤其容易遭到滥用,而前沿模型则掌握涵盖日常生活和专业领域的广泛知识。不过,文章简介没有提供可验证的技术细节,证明生物武器确实已经被制造。因此,这篇文章更应被视为一篇具有警示性质的评论,而不是对已确认事件的报道。
中国电信于9月17日发布Xing4.0-29B-A4B。该模型总参数量为290亿,但每次仅激活40亿参数,原生支持256K上下文,官方称可扩展至512K。模型从训练到推理部署均采用国产技术,包括昇腾训练芯片、国产框架和自研架构。在SuperCLUE智能体能力评测中,Xing4.0-29B-A4B以93.52分排名第三,与两款头部Qwen模型的差距均不足1分。经过4-bit量化后,显存占用降至约15
华为计算战略与业务发展部部长朱照生表示,昇腾已跨越生态发展的关键拐点,具备在 Agentic 时代构建新 AI 生态的能力和机会。华为称,开源的昇腾 CANN 社区月均活跃用户已超过 5200 人,自今年 6 月起成为国内活跃度最高的同类开源社区。基于昇腾完成预训练的大语言模型和多模态模型已超过 40 个,平台还已接入 PyTorch 等主流开源框架。昇腾 950 智算集群云服务计划于 9 月 3
Anthropic 已在 Claude Code 中支持 AGENTS.md 规范,使开发者能够向 AI 智能体提供项目专属指令。OpenAI 于去年将这一格式贡献给 Agentic AI Foundation。Anthropic 的采用可能有助于减少开发者在不同 AI 编程智能体工具之间使用时遇到的兼容性问题。
美国《联邦公报》网站曾短暂使用一款中国开源 AI 搜索工具。FBI 此前将该模型称为“恶意”。这一事件引发了外界对美国政府机构如何进行安全审查,以及如何选择 AI 服务的关注。
研究人员推出 Fuse,这是一个用于评估大语言模型助手社会推理能力的多智能体模拟框架。在 Fuse 中,一个具有隐藏动机的智能体会与其他智能体互动,其中包括代表用户的智能体;用户智能体随后向被评估的助手咨询,以推断目标智能体的动机。这种设计能够构造出可验证的标准答案。研究团队通过包含 2.4 万条人工标注的研究验证了模拟的可信度。对 12 个大语言模型的评估显示,用户介入会增加社会推理难度,模型会
英伟达的 Nader Khalil 和 Sydney Sykes 将在 TechCrunch Disrupt 2026 的 Builders Stage 上,讨论开放式与封闭式 AI 系统之间的选择,以及这一决策对下一代初创公司的影响。
MiniMax 已面向全球开发者正式开源 MiniMax Code CLI v0.4.12,并采用 MIT 许可证。该 CLI 是 MiniMax Code 客户端的核心组件。根据官方信息,在基于 FrontierHarness Eval 的评测中,工具取得了 76.7% 的任务通过率,成功任务的耗时中位数为 4 分 33 秒,两项指标均高于报告列出的公开基线。MiniMax 表示,开源将帮助开发
智谱旗下编程产品 ZCode 就代码库数据上传问题向受影响用户致歉。问题源于代码库索引功能,该功能支持历史版本检查点恢复、版本回退以及生成 Repo Wiki。生成 Wiki 页面时,可能触发将代码库数据上传至云端处理。智谱表示,相关数据在 Wiki 生成后会立即销毁,不会保存。由于该功能在上线初期默认开启,部分用户受到影响。官方称已完成自查并修复问题,近期将开源 ZCode 代码库,邀请第三方评
一项研究评估MiniMax-H3能否通过联合处理文本、图像、视频和音频,提升对物理世界的推理能力。研究团队构建了包含517个样本的评测框架,覆盖四种场景:结合多帧画面的隐式提示、音频-图像输入、前缀视频以及音频-视频输入。由于每种模态只能提供部分证据,模型需要整合互补线索,以推断事件状态和未来动态。MiniMax-H3的总体成功率为41.97%。其中,基于视频的决策推理表现最好,成功率为56.00
阿里达摩院联合浙江大学医学院附属第一医院等机构推出通用医疗影像模型 DAMO RADAR,相关研究已发表于《科学》杂志。该模型面向腹部增强 CT,可评估涵盖 18 个器官的 146 种疾病。在近 4 万次真实世界检查中,模型达到 0.913 的 AUC。在与 26 名放射科医生进行的人机对比试验中,模型平均准确率超过其中 23 人。研究称,在 AI 辅助下,医生的疾病识别敏感性提高 10%,诊断时
开源电子书管理工具 Calibre 已更新至 9.15 版,新增可选互动写作游戏“创建你自己的冒险”(Create your own Adventure)。游戏由 AI 管理虚构世界,用户通过输入内容推动故事发展。该功能默认不会加载,用户需前往“首选项—工具栏和菜单”,将其添加到主工具栏后才能启动。新版还支持同时选中多条高亮内容并统一修改样式;鼠标悬停在含笔记的高亮内容上时,会显示笔记提示。侧边栏
该研究分析了模型在 On-Policy 蒸馏(OPD)过程中为何会生成过长的回答,甚至耗尽生成预算。研究人员发现,基础学生模型与经过后训练的教师模型对终止 Token 的偏好不一致,是造成这一现象的重要原因。在 Qwen3、Llama 和 Gemma 上的实验表明,即使两个模型声明的停止集合相同,它们仍可能将停止概率分配给不同的 EOS Token。因此,仅对齐解码停止集合并不足够。将功能等价的
人工智能实验室PrismML推出Bonsai 2 27B。这是一款基于Qwen3.8 27B、采用三值量化的开放权重模型。PrismML表示,该模型在综合基准测试中达到基础模型98.2%的得分,同时内存占用不到基础模型的九分之一。模型大小为5.9GB,每个权重的有效比特数为1.76,支持26.2万Token的上下文窗口。官方公布的吞吐量为NVIDIA GeForce RTX 5090上每秒143个
阿里发布 Qwen3.8-Omni-Flash 原生多模态模型,可同时处理文本、图像、音频和视频,支持 100 万 Token 上下文。阿里称,该模型在 30 项评测中的平均成绩较 Qwen3.5-Omni-Plus 提升超过 26%。官方公布的改进覆盖音视频 Agent、编程、长程任务、长音视频理解和会议分析等场景。API 音频输入价格下降超过 98%,音视频输入价格下降超过 93%。阿里还开源