哈佛与麻省理工用 83 亿个 AI 智能体模拟人类行为
由哈佛大学和麻省理工学院牵头、OpenAI 与 Google DeepMind 等机构参与的团队推出了 MatrAIx 系统,用于通过最多 83 亿个 AI 智能体模拟人类行为。该系统从 1,290 个维度对不同背景和生活方式的人群进行建模。智能体可以填写问卷、与客服聊天、浏览网页和操作应用。包含 400 次测试的对照研究显示,智能体在 91.5% 的情况下表现出正确特质,或在无关时正确抑制该特质
AI 新闻中心 过去7天分析了 920 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
由哈佛大学和麻省理工学院牵头、OpenAI 与 Google DeepMind 等机构参与的团队推出了 MatrAIx 系统,用于通过最多 83 亿个 AI 智能体模拟人类行为。该系统从 1,290 个维度对不同背景和生活方式的人群进行建模。智能体可以填写问卷、与客服聊天、浏览网页和操作应用。包含 400 次测试的对照研究显示,智能体在 91.5% 的情况下表现出正确特质,或在无关时正确抑制该特质
据Politico援引的消息人士称,美国众议院立法顾问办公室正被大量使用人工智能工具起草的法案淹没。国会律师如今花在修改和校正这些提案上的时间,已经超过从头自行起草所需的时间。这一情况表明,生成式人工智能虽然能够加快法律文本的生成,却也会增加专业人员进行审查、修订和确保文本准确性的工作量。
共生知行发布了一段双足人形机器人驾驶卡丁车的演示。公司称,机器人可用右脚控制油门,并在驶出弯道前结合视觉时机判断、精准油门控制和快速转向。该公司由浙江大学与西湖大学联合培养的博士生创立,专注于具身智能的端到端动作生成。其“直接感知—控制模型”取消了中间运动表征,将视觉、语言、身体状态、动作历史和执行反馈直接映射为可执行的关节与手部目标。此次卡丁车驾驶属于技术概念验证,尚不能证明人形机器人已经具备可
低质量、大规模生产的 AI 生成内容正在充斥搜索引擎、社交平台、音乐服务和电商网站。Spotify、领英、谷歌、YouTube、TikTok 和 Substack 等公司,正通过删除内容、部署检测工具、添加标签和提供用户控制功能来应对。Spotify 表示,去年删除了 7500 万条因批量上传、重复或其他原因被视为“垃圾内容”的曲目。谷歌研究人员则在 YouTube 上发现并移除了 5 万个与协同
美国洛杉矶科技公司StoryFile推出个人AI分身服务,用户提供几张照片、一分钟录音,并填写详细的人生问卷,就能生成一个据称可在本人去世后继续与家人交流的数字分身。记者威廉亲自测试后发现,分身虽然外貌和声音与本人相似,但对话经常僵硬、逻辑混乱,情绪回应也不稳定,还会凭空编造不存在的记忆和经历。家人认为它冰冷、机械,缺乏真人的温度。专家警告,这类系统可能妨碍正常的哀伤过程,并通过虚假信息给处于悲痛
AnyTalk是一种为任意角色生成3D语音动画的方法,无需动画数据或繁琐的绑定与重新建模。该系统利用角色渲染图像,将预训练的视频扩散模型适配到目标角色,再通过估计blendshape参数,将生成的说话头像动作转换为3D动画。该方法可针对不同面部网格和blendshape配置生成唇形同步动画,并减少人工工作和数据需求。研究团队还将AnyTalk蒸馏为支持实时运行的AnyTalk_RT版本,代码已公开
赛昉科技(StarFive)正式推出面向高性能计算的服务器级 RISC-V CPU 内核 IP“昉·天枢-100”(Dubhe-100)。希奥端计算(LECARC)已选用该 IP,作为智能边缘服务器 CPU 的基础。赛昉称,该内核面向 AI 智能体等新兴应用不断增长的算力需求,也是中国较早达到可交付状态的服务器级 RISC-V CPU IP 之一。其性能对标 Arm Cortex-A78,宣称整数
DeepSeek、Qwen和Moonshot等中国AI模型比美国领先平台成本更低、适应性更强。研究还表明,这些模型的性能如今已接近美国同类产品。文章分析了这一进展是如何实现的,以及它可能对美国AI企业产生的影响。
一项针对开放权重语言模型的研究,探讨潜在信息如何转化为模型能够报告的形式。研究人员使用雅可比透镜,在共享相同上下文的基准任务上进行测试,未发现预测中的独立“闸门”机制。相反,注意力机制会在模型中等深度的区域聚集信息,使变量能够在查询位置被读取。这种效果取决于任务需求,并在两种不同架构中出现在相近的相对深度。研究定位了变量变得可读的位置,但没有揭示信息传输的完整路径。研究还指出,探针测得的可见性并不
一项研究分析了在自动检查流程中由一个语言模型充当验证器、另一个或同一个模型负责修复时,先前的上下文是否会改变检查结果。在字节完全一致的任务中,预先加入一次审计与修复过程后,所有15种模型与措辞组合的误报率都下降了2.8至11.5个百分点。对于其中一个模型,审计曾报告错误的过程会进一步减少误报。信号检测分析表明,变化来自判定阈值移动,而不是辨别能力下降。人工检查50个误报后发现,82%确实是错误警报
路透社报道,Google人工智能部门过去几个月经历了剧烈的内部动荡。联合创始人谢尔盖·布林据称介入Gemini模型训练,推动加快开发并尝试递归式自我改进。下一代Gemini旗舰模型据报因在编程等关键领域落后竞争对手而推迟两个月发布。8月5日,Google DeepMind宣布由科雷·卡武库丘奥格鲁接替德米斯·哈萨比斯担任负责人;哈萨比斯转任主席,运营职责减少。在布林支持下,卡武库丘奥格鲁预计将获得
HarnessEval-W 是一套面向世界模型的智能体评估流程。它不再只输出单一分数,而是将每个评估问题拆解为可测量的子问题,并为各个子问题配置具有专属上下文和诊断工具的专业子智能体。上级智能体会验证收集到的证据并生成最终结论,从而形成透明的证据树。该方法在 18 个代表性世界模型的 330 个评估案例上进行了测试,判断结果与人类偏好高度一致,同时能够细致诊断物理规律、因果关系和世界状态演变方面的
AR 品牌雷鸟创新(RayNeo)将于 8 月 21 日 14:30 正式发布 iO 系列首款 AI 眼镜。官方将其定位为“人类增强 AI 眼镜”,重点围绕知识、表达和记忆等场景提供辅助。产品采用接近传统眼镜的设计,配备纤细钛金属镜腿,并使用显示区域近乎隐形的自研光波导显示技术,主打长期佩戴体验。具体配置、功能和售价尚未公布,目前已开启预约。
Meta 申请了一项智能眼镜专利,设想利用人脸识别技术识别视频中的人物,判断他们正在做什么以及与佩戴者的关系,并自动生成带人物标签的精彩片段。专利提出的应用场景包括在晚宴或聚会上录制视频后,让 AI 查找活动中的精彩内容。类似技术也可能用于企业或安防摄像系统。不过,目前这仍只是专利构想,并非已经确认的产品功能。由于涉及人脸识别、录制透明度和个人隐私,该设计可能进一步引发争议;Meta 眼镜近期已在
企业微信5.0.10于8月18日正式上线,进一步升级AI能力。根据官方信息,新版本全面开放CLI和MCP,WorkBuddy、Codex以及企业自建Agent等均可通过“智能机器人”直接接入企业微信。此次开放不设企业规模限制,一次性提供消息、文档、表格、邮件、会议等十大办公能力。Agent不仅可以从企业微信获取信息,还能通过开放接口执行办公任务。该更新进一步打通AI Agent与企业日常工作流程,