AI 新闻中心

AI 新闻中心 过去30天分析了 1954 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

美国对 AI 的反感情绪上升,硅谷内部公开分歧浮现

据《连线》报道,美国年轻人对 AI 的抵触情绪正在上升。超过一半的 30 岁以下受访者表示,对 AI 的担忧多于兴奋;超过 70% 的人认为 AI 将减少就业。公众的担忧还涉及人际关系、学生批判性思维、创作者作品被用于训练模型时的补偿,以及数据中心对当地社区的影响。Meta CEO 马克·扎克伯格对高度个性化 AI 助手的未来持乐观态度,但投资者和政策人士警告,科技行业可能低估了公众反弹。Anth

硅谷热议机器人未来,现场主角却来自中国

旧金山机器人大会 Actuate 吸引了约 1500 名投资者、创业者和工程师,但现场展示的机器人数量远少于预期。报道指出,随着人工智能从软件延伸到现实世界,机器人行业仍面临硬件供应不足、训练数据短缺和供应链限制等关键挑战。“Physical AI”成为大会高频话题,指能够感知并作用于现实环境的人工智能系统。与语言模型可利用互联网海量文本不同,机器人需要学习真实世界中的动作、空间和物体交互,但目前

AI 的下一次重大飞跃将进入现实世界

工程师和投资者正越来越多地投入世界模型,也称为大型行动模型。这类系统旨在让机器人理解周围环境并规划行动,希望像 ChatGPT 改变写作和编程一样推动机器人技术发展。文章介绍了这一新兴的研究和投资趋势,但没有提供已经实现重大技术突破的证据。

Uber 因使用自动化系统停用司机账户,或被荷兰罚款8.25亿欧元

荷兰数据保护机构计划因 Uber 使用自动化系统停用司机账户,对其处以8.25亿欧元罚款。监管机构表示,这家网约车公司没有充分告知受影响司机相关决定。若罚款最终确定,将成为欧盟《通用数据保护条例》(GDPR)实施以来金额第二高的处罚。

微信测试“按住转文字”功能引发热议,iOS和安卓用户先体验,鸿蒙版仍需等待

微信近期小范围测试一项新的聊天输入功能:用户按住输入框说话,语音会实时转换为文字,松手后自动发送。发送前,用户可以编辑文字,也可以上滑取消。该功能将原本独立的麦克风按钮整合进输入框,目前仅面向部分 iOS 和安卓用户灰度开放。部分用户认为它提升了输入效率,尤其适合不便打字的场景;但也有用户担心误触,并不满于目前无法手动关闭。根据反馈,该功能的识别准确率暂时不如先录音再转换文字。腾讯客服表示,鸿蒙客

迈向量化 ASR 模型的基准优化

一项研究提出了一种方法,用于衡量自动语音识别模型是否针对公开基准进行了优化,却没有相应提升通用转录能力。研究关注音频本身无法唯一确定参考文本,或音频与基准参考文本相矛盾的情况。通过参考文本不一致、遮蔽数字恢复和正字法切换三类行为探测,研究发现,表现最好的开源模型即使面对矛盾、被遮蔽或含糊的音频,也会逐字输出基准参考文本片段。机制分析表明,模型会依赖狭窄的声学线索,选择有利于基准成绩的策略,而不是忠

EXIMO:视觉语言模型引导的VLA策略探索

EXIMO是一种用于高效微调视觉—语言—动作模型(VLA)的方法,面向机器人操作任务。该方法分为三个阶段:视觉语言模型负责规划并拆解复杂的长期任务;系统利用这些规划结果收集组织化数据,并通过模仿学习微调VLA策略;最后使用残差离策略强化学习进一步优化。EXIMO旨在减少对昂贵远程操作数据的依赖,并缓解强化学习在长期任务中的样本效率问题。作者在实验中报告称,该方法在样本效率和最终性能方面均显著优于现

知名 YouTube 创作者因接受 AI 资金遭到反弹

过去几天,包括 Matti Haapoja 和 Sam“​​Kold”Kolder 在内的多位知名影视内容创作者发布视频,展示 AI 平台 Higgsfield 的能力。视频重点介绍了该平台近期新增的 Seedance 2.5 功能,并将这些技术宣传为视频制作的未来。随后,相关创作者因疑似接受平台付费推广而受到批评,外界也对赞助关系是否充分披露以及这类推荐的可信度提出质疑。

生成式人工智能真的会复制艺术家作品吗?研究人员称仍有争议

麻省理工学院研究人员探讨了“归因衰减”这一概念,以及它对希望保护作品的艺术家可能产生的影响。生成式人工智能长期被指控直接复制艺术作品,相关版权诉讼正在多地法院审理。MIT的一项新研究提出了不同且更细致的观点,可能使法院评估此类案件时面临更复杂的法律问题。