AI 新闻中心

AI 新闻中心 过去30天分析了 2440 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

WorkBuddy 升级 PPT 制作能力:一句话生成演示文稿,原文件可继续编辑

腾讯于9月14日宣布升级 WorkBuddy 的 PPT 生成能力。用户可在对话框中直接提出制作需求,或进入“幻灯片”流程,也可通过“/tencent-pptx”调用。仅提供主题和页数时,系统会补问汇报对象、场景和目标,并构建“问题—论证—结论—落地”的内容主线。输入调研报告、PDF 或 Word 文件后,系统可压缩长文本、提取结论、生成图表和演讲备注。提交公司或学校模板时,可保留配色、字体层级以

蓝虫具身推出模块化人形机器人 Mantis Standard“小白”,9800 元起

西安交通大学科技成果转化企业蓝虫具身推出模块化人形机器人 Mantis Standard“小白”,售价 9800 元起。该机器人底盘、手臂、腰部和头部均采用标准模块,通过快装接口完成机械与电气连接。产品拥有全身 22 个自由度,单臂负载 7 公斤,臂展 663 毫米,遥操作延迟低于 10 毫秒。三自由度全向移动底盘最高速度为每秒 3 米,整机续航约 3 小时,高度为 1.4 米。公司称其可接入主流

Suno 发布 v6 音乐模型,与华纳音乐和 BMG 合作开发

Suno 发布了新一代 AI 音乐模型 v6,并表示 Warner Music Group、BMG 和 Believe 等音乐公司参与了开发。此次发布以模型套件形式提供,包括侧重精准和成品质量的 v6、更加实验性的 v6-wild,以及更快更轻、面向所有用户开放的 v6-mini。创作者可以通过自然语言修改歌曲中的特定片段,而无需重建整首歌,也可以组合多首歌曲的 vocals 和乐器、分离采样,或

宇树科技发布人形机器人 G1+,全面升级运动、感知与交互能力

宇树科技发布人形机器人 G1+,这是 G1 的一次大幅升级。新品增加 2 个颈部自由度,提升肩部、腰部和手臂电机的峰值扭矩,并改善散热表现;感知系统则结合双目相机、广角相机和 3D 激光雷达。交互方面,头部配备触摸传感器,支持通过 6 麦克风阵列进行声源定位、降噪和回声消除,并通过扬声器实现远距离语音交互。机身新增外部供电接口,标准电池标称续航约 2 小时。标准版拥有 25 个自由度,重量约 35

豆包手机助手通过首批端云协同机密计算能力评测

北京春田知韵科技旗下豆包手机助手通过了中国信息通信研究院泰尔终端实验室开展的端云协同机密计算能力评测。评测涵盖可信执行环境、加密、密钥管理、透明日志、访问控制和信息隔离等项目。该产品获得最高的 L5 级能力等级,成为国内首批通过这一评测的产品之一。据介绍,用户操作信息在传输过程中全程加密,仅在通过可信校验的云端机密环境内解密处理。消费者版本支持语音唤醒,并配备具有指纹鉴权功能的专属 AI 键,首发

ElevenLabs发布Music v2.5音频模型,同步开放App与API访问

ElevenLabs发布了音乐生成模型Music v2.5,并通过移动应用和API向全球用户及开发者开放。公司称,在包含47,885组样本的盲测中,多数受测者更偏好新版本,其在R&B、灵魂乐、嘻哈、摇滚和管弦乐等风格中表现突出。免费版每天可下载5次无损音频,Pro版每月提供400次下载。用户拥有生成曲目的完整所有权,但不得模仿特定现有艺术家,也不得下载基于他人受版权保护作品生成的曲目。Eleven

小米卢伟冰:主动智能将成为智能家电的未来

小米集团合伙人、总裁卢伟冰表示,主动智能将是米家未来十年的发展方向。他认为,家电虽然已经具备联网、App控制、语音操作和基础AI交互能力,但本质上仍像遥控器,主要根据用户指令执行单一任务。小米称,今年上半年研发投入超过180亿元,MiMo大模型累计调用量突破一万亿词元,并已建立自有芯片算力平台,全球IoT连接设备数超过11亿台。小米预告9月推出多款相关产品,包括配备RGB Mini-LED背光和毫

京造推出 AI 自适应床垫,众筹价 9999 元

京东京造与 JoyInside 推出 AI 智能床垫并开启众筹。补贴后,1.5×2 米版本售价 9699 元,1.8×2 米版本售价 9999 元。床垫采用 20 个传感器和 10 个 AI 自适应调节单元,可动态调节背部、腰部、臀部和腿部的支撑。功能包括检测可能的阻塞性睡眠呼吸暂停并自动轻柔抬升、AI 闹钟、语音交互,以及 32 项健康指标监测。产品还支持左右两侧独立调节、通过石墨烯发热材料进行

StepAudio 3 Gen 技术报告

该技术报告介绍了 StepAudio 3 Gen,一种通用音频生成模型,支持零样本文本转语音、声音设计、歌声生成、音效、音乐,以及多种音频类型的混合生成。与近期常见的连续扩散模型不同,该模型直接在残差向量量化(RVQ)令牌上进行离散自回归建模。其共享表示同时编码语义和声学信息。模型沿时间轴预测第一个码本,再由轻量级因果 Transformer 生成其余15个码本。研究重点包括考虑干扰的渐进式预训练

特斯拉 Robotaxi 将搭载 FSD V15,最快下月开始 24 小时运营

特斯拉计划从 10 月起逐步将商用 Robotaxi 车队升级至 FSD V15,并推动全天候运营。特斯拉 AI 副总裁阿肖克·埃卢斯瓦米表示,部分车辆已经在测试早期版本。报道称,FSD V15 将采用重新设计的架构和拥有百亿参数的神经网络。目前,Robotaxi 在美国多个市场仍受运营时段和地理围栏限制。相关时间表及技术能力均来自特斯拉方面的表述,尚未得到独立验证。

我国发布全球首个人工智能脑机接口标准

国家药品监督管理局批准发布一项适用于人工智能处理脑电数据的医疗器械脑机接口标准。该标准将于明年9月1日起实施,系统规定数据采集、处理、标注、存储和访问等环节的技术要求与测试方法,旨在统一脑机接口医疗器械数据集的质量控制标准,规范研发流程,并支持相关产品的开发和生产。

DeepSeek-V4.1-Flash上线千问AI,API与Token Plan同步开放

DeepSeek-V4.1-Flash已在阿里巴巴千问AI平台上线,同时开放标准API和Token Plan。平台称,该模型采用总参数量5520亿的MoE架构,输入激活约80亿参数,输出激活约160亿参数,支持文本与图像理解,最长上下文为100万token,最大输出约39.3万token。其功能包括函数调用、结构化输出、上下文缓存、批量任务、联网搜索和智能体工作流。闲时价格为每百万输入token

Feyospace-v1:“网络安全七人组”如何训练前沿网络安全模型

Feyospace提出了一种以数据为中心的开放权重网络安全模型后训练方法。五个系统分别用于分析隐藏的推理特征、降低教师模型采样成本、绕过教师模型执行限制、恢复模型合并造成的能力损失,以及将专家干预转化为可训练的推理数据。其数据引擎构建了可重置的编程、漏洞、CTF、内核历史、完整漏洞利用、固件和设备环境。经过执行验证与证据审计后,研究团队使用164,269条轨迹进行长上下文监督微调。团队称,三个检查