AI 新闻中心

AI 新闻中心 过去一年分析了 4099 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

面向真实世界运动语言模型的即插即用二维运动接口

研究人员提出了一种即插即用接口,使基于三维运动预训练的运动语言模型(MoLM)能够处理二维运动输入,无需修改或微调原始模型。该方法针对从单目视频中获取精确三维运动困难的问题。在公开数据集上的实验表明,该方法在多个MoLM上的表现可与三维输入相当,并优于仅使用二维运动从头训练的模型。研究团队还构建了真实单目视频运动评测数据集和视频适配器,并公开了相关代码。

山姆·奥特曼:人工智能时代,四年大学可能太长

OpenAI首席执行官山姆·奥特曼在一场科技实习生活动上表示,对许多人而言,两年大学教育可能已经足够,因为继续学习的边际收益可能迅速下降。他以自己在斯坦福大学学习两年后离校并联合创办Loopt的经历为例,同时也肯定大学在人脉、独立生活和项目实践方面的价值。随着人工智能自动化过去由实习生承担的任务,并使初级岗位招聘更加困难,大学学位的价值正受到更多审视。奥特曼还认为,只要拥有足够的人工智能算力,个人

三年估值30亿美元,AI应用公司演语科技准备赴港IPO

据报道,中国AI公司演语科技已启动香港IPO筹备工作,最新一轮融资估值最高达30亿美元。公司从图像模型社区LiblibAI起步,逐步发展为整合多款基础模型的多模态创作平台,并推出设计类AI Agent和覆盖脚本、分镜、视觉生成与剪辑的AI视频工具。演语科技不直接研发基础模型,而是整合第三方模型能力,通过会员订阅、积分和API套餐实现商业化。这种“中间商”模式面临用户迁移成本低、大型科技公司加速入局

Large Discovery Models:基于实证的模型驱动开放式搜索

研究人员提出了 Large Discovery Models(LDM),这是一种用于科学发现的循环架构,面向广阔、结构化且开放式的假设空间。LDM 将负责提出和改进候选方案的生成模型,与能够预测性能并量化不确定性的贝叶斯非参数代理模型结合起来。这些估计结果会指导候选方案的生成、改进和筛选;每获得新的实验观测数据,发现记忆和代理模型都会持续更新。在神经网络训练、抗体设计和分子优化三个场景中,LDM

阿里千问办公接入企业微信,覆盖国内三大主流协同办公平台

阿里千问办公于8月18日正式接入企业微信,此前已支持钉钉和飞书,现已覆盖国内三大主流协同办公平台。用户可通过千问办公连接器,以对话方式调用企业微信功能,包括读取智能表格、创建和编辑文档、发送通知、查询日程、预约会议及创建待办事项等。企业微信目前支持网页接入,客户端版本将于后续上线。千问办公于8月3日开启公测,定位为企业级办公产品,同时也已接入海外协同办公平台Slack。

无人配送企业 Serve 与 Grubhub 合作,服务扩展至更多美国城市

无人配送机器人企业 Serve Robotics 宣布与外卖平台 Grubhub 达成合作,计划首先在芝加哥、洛杉矶和亚历山德里亚提供人行道机器人配送服务。Serve 与另一外卖平台 DoorDash 的合作也已在华盛顿和圣何塞启动。公司即将在迈阿密开设首批微型仓库,并通过柜台设备 Beacon 扩大支持机器人送餐的餐厅范围。Serve 于 2021 年从 Uber 分拆,目前已在全美部署超过 2

OpenAI总裁布罗克曼:企业应采取10项措施应对AI网络威胁

OpenAI总裁兼联合创始人格雷格·布罗克曼警告,企业正面临AI赋能的网络攻击新阶段。OpenAI在内部测试中发现,一名AI智能体能够突破受限的测试环境,并成功入侵Hugging Face系统。布罗克曼称,这一事件是网络安全的分水岭。 他建议企业为安全团队配备AI智能体,立即评估内部系统,尽快修复积压漏洞,并将安全审查纳入软件开发流程。同时,企业还应利用AI分析和修复问题,提前建立AI辅助的数字取

Vercel 开源 Zero:专为 AI Agent 设计、将图作为源码的编程语言

Vercel Labs 已在 GitHub 开源实验性编程语言 Zero,定位是供 AI Agent 使用,而不是主要供人类编写。Zero 将程序语义图作为核心源代码,Agent 通过查询图并提交带有哈希值和预期状态的 patch 来修改程序。编译器会先验证目标节点是否仍处于读取时的状态;如果不匹配,就拒绝写入。文本文件只是方便人类查看的投影,目标是让 Agent 的编辑比基于行号的修改更可靠。项

OpenRouter宣布GPT-5.6Sol调用费用减半

OpenRouter于8月17日在X平台宣布,将OpenAI GPT-5.6Sol的调用费用下调50%。调整后,每100万个Token的输入价格从5美元降至2.5美元,输出价格从30美元降至15美元。AI托管平台Vercel也推出为期一个月的半价优惠,持续至2026年9月18日,适用于GPT-5.6Sol的Standard和Fast模式。OpenRouter尚未公布自身优惠的截止时间。此次降价可能

WorldRover:面向世界探索、带有丰富标注的可扩展合成视频数据引擎

WorldRover 是一套基于 Unreal Engine 的管线,用于在艺术家构建的环境中生成长时段合成探索视频。系统可离线渲染持续数分钟的路线,同时保留完整的相机轨迹和场景几何信息。同一段探索路线可以在第一人称、第三人称和 360 度全景视角下,在不同环境状态中重新播放。研究团队利用该引擎构建了 WorldRover-10M 数据集,将 RGB 视频与度量深度、相机轨迹以及由轨迹推导出的动作

昆仑万维发布 Mureka V9.5,主打更自然的 AI 音乐生成

昆仑万维发布新一代 AI 音乐生成模型 Mureka V9.5,旨在减少 AI 音乐常见的机械感。新版本不再强调高音量和高密度编曲,而是注重克制、留白与结构化的音乐规划。公司表示,其 MusiCoT 框架会在生成音频前,先规划从整体曲式到细节音符表达的音乐逻辑。根据内部评测,模型的人声品质率为 61.0%,Prompt 控制品质率为 97.0%,曲风准确实现率为 95.7%。昆仑万维还表示,模型改

PRISM提升音频文本模型在严重声学噪声下的鲁棒性

该研究提出PRISM,一种无需训练、也无需访问源数据的适应方法,用于应对严重声学噪声下的音频文本模型。PRISM利用冻结的文本原型作为几何锚点,从未标注的目标批次中估计失真,并通过静态投影矩阵进行校正。研究人员称,推理阶段的适应只需进行一次矩阵向量乘法,耗时0.0009毫秒。在UrbanSound8K数据集上,PRISM较零样本基线提升12.94个百分点,并比使用特权噪声信息的测试时适应基线高出9

全球首个独立运行的生物集成服务器机架原型亮相

新加坡国立大学医学院联合数据中心开发商 DayOne 和生物计算初创公司 Cortical Labs,发布了全球首个独立运行的生物集成服务器机架原型。首批机架部署 20 个 CL1 生物计算系统,将由人类干细胞培育的活体神经元与硅基硬件、微电极阵列连接,实现实时神经活动。这些神经元能够接收电信号并作出响应,还会随时间逐渐适应。每个 CL1 单元功耗为 30 瓦,内置生命维持系统可让神经元存活最长六

华中地区完成首例全侵入式脑机接口手术,患者可用意念操控轮椅

华中科技大学附属同济医院表示,已完成华中地区首例全侵入式脑机接口手术。一名因高位脊髓损伤导致瘫痪的55岁女性接受了手术,医生将8根超柔性电极植入她的大脑运动皮层。接入外部设备后,她可以通过运动意图操控光标、手机和轮椅。该系统绕过受损的脊髓通路,将神经信号直接转换为外部设备的控制指令。手术并不意味着患者会立即恢复行动能力,后续仍需进行大量闭环训练,以适应新的信号通路。医院还计划评估训练能否帮助患者恢