马特·卢卡斯和休·博纳维尔等演员呼吁制定AI声音克隆法
演员马特·卢卡斯、休·博纳维尔及其他表演者呼吁英国政府赋予每个人拥有自身声音的法律权利。该提议旨在限制未经授权使用人工智能复制人类声音。
AI 新闻中心 过去一年分析了 8054 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
演员马特·卢卡斯、休·博纳维尔及其他表演者呼吁英国政府赋予每个人拥有自身声音的法律权利。该提议旨在限制未经授权使用人工智能复制人类声音。
PILOT 是一种监督者—工作者框架,支持 AI 智能体在执行过程中持续改进。独立的监督者可以在工作者运行期间重新引导或终止任务,同时将执行过程中发现的流程和失败模式提炼为可复用的技能与记忆。在两个冻结的基础模型和三个基准测试中,PILOT 在六种配置中的五种排名第一。在 Terminal-Bench 2.0 上,其表现最多领先对比框架 9.8 个百分点。在自我改进测试中,使用 GLM-5.1 和
Anthropic以研究预览形式发布模型硬件标准(Model Hardware Standard,MHS)。该标准旨在成为AI智能体与可编程设备之间的统一控制和通信层,使智能体能够在较少人工干预的情况下协同操作显微镜、液体处理设备、机械臂和量子计算系统等异构设备。多家媒体将此举解读为Anthropic首次公开进入具身智能或物理AI领域。Anthropic表示,早期闭门测试显示,MHS能够加速生物医
马来西亚芯片行业负责人将该国今年电气和电子产品出口预测上调至超过9000亿林吉特(2230亿美元)。在全球人工智能热潮推动下,相关需求超过此前预期。
TTPO是一种无需真实标签、在推理阶段训练大语言模型的方法。它利用多数投票生成伪标签,对与投票结果一致的输出进行蒸馏,并惩罚不一致输出中的高置信度错误,以降低错误伪标签误导整个更新过程的风险。在五项竞赛级基准测试中,TTPO达到了使用标签监督的在策略自蒸馏方法的水平。在Qwen3-1.7B上,测试时训练性能从38.0%提升至45.2%;在不进行扩展思考的情况下,研究还报告了25.2%至36.4%的
国家发展改革委表示,机器人产业应立足各地资源禀赋和产业优势,避免盲目跟风、重复投资,推动行业健康有序发展。下一步将建设具身智能实训场和人工智能应用中试基地,让机器人在真实场景中迭代技术并完成应用验证。相关工作包括提升高质量真机数据供给,支持视觉—语言—动作模型、世界模型等技术路线探索,并建立具身智能技术标准体系,降低模型跨机器人本体适配成本。中试基地还将推动机器人在制造、医疗、消费、服务和公共安全
Midjourney已开放V8.2图像编辑模型的公开测试。用户可以通过文本指令修改现有图像,同时融合最多4张参考图,并使用局部重绘和画布扩展功能。该模型还支持个性化设置、情绪板和风格参考。用户可通过Midjourney官网、alpha测试网站或Discord调用。官方表示,测试初期界面可能频繁调整,模型在复杂场景下仍可能出现非预期结果,并邀请用户提交反馈和任务ID。
PAWBench提出将概率对齐作为评估世界模型的标准。模型不仅要生成一条合理的轨迹,还应在相同的初始观测和行动条件下,正确复现各种可能结果的分布。该基准及PAWEval评测协议在50个场景和11个现有系统上分析了重复视频生成结果。没有任何受测模型能够持续匹配参考概率,同时覆盖全部有效的物理行为。研究还考察了语言提示、初始噪声和模型训练是否能够改变模型的预测分布。
蚂蚁集团旗下百灵推出金融增强模型 Ling-3.0-flash-Fin,总参数量为 1240 亿、激活参数为 51 亿。该模型延续 Ling-3.0-flash 的架构和长上下文能力,并通过金融语料持续预训练、领域后训练和工具使用优化,提升对年报、财务工作簿、研究材料及复杂金融任务的处理能力。蚂蚁集团称,模型已在多项金融与智能体基准上进行测试,相较多款通用模型展现出竞争力;其 AA Intelli
Lightspeed India合伙人Hemant Mohapatra讨论印度人工智能初创企业生态中的投资机会。他在Bloomberg Tech: Asia节目中接受Shery Ahn采访,分析印度AI企业的发展前景。
Yotta Data Services董事长兼联合创始人达尔尚·希拉南达尼介绍了公司的增长前景、在需求不断上升之际转型为人工智能云服务公司的计划,以及首次公开募股(IPO)安排。他在彭博社《Bloomberg Tech: Asia》节目中接受了谢莉·安的采访。
数据中心运营商Yotta Data Services Pvt董事长表示,公司正讨论“很快”进入资本市场,以满足不断增长的人工智能服务需求。Yotta计划通过首次公开募股筹集资金,但尚未公布具体时间表、发行规模或估值信息。
Zero-WAM是一种因果视频—动作模型,使机器人能够依据人类视频示范执行训练中未见过的操作任务。研究人员构建了HumanGen数据集,通过自动化流程生成涵盖8600项任务的74200组人类—机器人上下文学习配对。在RoboTwin 2.0模拟环境中,Zero-WAM在7项未见任务上取得47.0%的平均成功率,比最强的视频—动作基线高29.5个百分点。真实世界测试涵盖多物体场景、长时序操作以及精细
该研究提出 UrbanGround,这是一个用于评估多模态大语言模型代理在复杂城市环境中表现的测试平台。研究团队利用覆盖香港全域的三维地理空间数据,构建了一个具有物理约束的香港城市复制环境,使代理能够以第一人称视角探索城市,并通过交互式地图进行导航。研究考察局部视觉感知能否支持空间问题回答、远距离导航,以及对路线和行人运动变化的适应。当前的多模态大语言模型代理在视觉识别和短距离空间推理方面表现出一
Cerebras在Hot Chips 2026期间公布了CS-6系统规划,计划首次引入晶圆级3D堆叠,将DRAM通过超高带宽垂直互连直接置于逻辑和SRAM晶圆之上。公司表示,该设计可让更多模型权重和状态靠近计算硬件,同时保留晶圆级架构的数据局部性和低延迟优势。Cerebras预计,这将提升单个系统可承载的模型规模,并减少运行超大模型所需的系统数量。公司还称,垂直堆叠有望将整机系统占地面积缩小5至1