Claude Code v2.1.224正式支持跨会话消息传递
Anthropic近日发布Claude Code v2.1.224,新增不同编程会话之间的消息传递功能。开发者可以让多个AI实例交换信息、预警潜在的代码冲突,并将一个会话中解决的问题同步给其他会话。官方列出的应用场景包括协调复杂工作树、移交调查结果、获取长时间运行任务的最新状态,以及在不同设备之间保持回复连续性。该功能主要面向大型项目和并行任务,旨在减少开发者手动同步状态与上下文的工作量。目前用户
AI 新闻中心 过去一年分析了 7915 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
Anthropic近日发布Claude Code v2.1.224,新增不同编程会话之间的消息传递功能。开发者可以让多个AI实例交换信息、预警潜在的代码冲突,并将一个会话中解决的问题同步给其他会话。官方列出的应用场景包括协调复杂工作树、移交调查结果、获取长时间运行任务的最新状态,以及在不同设备之间保持回复连续性。该功能主要面向大型项目和并行任务,旨在减少开发者手动同步状态与上下文的工作量。目前用户
研究人员提出 SMRC-SD,通过更有选择性的特权蒸馏改进多轮智能体。该方法不再在每个回合无条件使用成功参考轨迹提供的指导,而是先检查智能体当前的执行状态是否得到参考轨迹支持。只有状态匹配时才进行蒸馏,并根据智能体实际到达的状态构建教师上下文。使用 Qwen3-1.7B 时,ALFWorld 的任务成功率从 0.746 提升至 0.865,WebShop 从 0.574 提升至 0.693。消融实
研究人员提出了 UA-NWM,这是一种用于无人机根据目标图像前往指定位置的高效潜在世界模型。现有方法通常仅依赖一个或少数几个未来状态预测来评估候选轨迹,在具有较大未来状态不确定性的大规模户外环境中存在局限。UA-NWM 将可能的未来表示为不确定性子空间,并把预测与目标之间的差异分解为可由不确定性解释和无法解释的部分。系统仅使用无法解释的残差进行轨迹评分,因此无需生成多个未来样本,也能实现更稳健的路
YOLO-PEFT 是一个面向 YOLO 及其他实时检测器的结构感知型参数高效微调框架。它根据算子有效性、检测器语义、图接口和部署约束等明确条件规划适配器位置,并在训练前拒绝不合适的配置。在 VOC07+12 评测中,规划器选择的 RS-LoRA 在 YOLO11s 和 YOLO12s 上分别达到 0.7138 和 0.7307 的 mAP50-95,高于全量微调的 0.6428 和 0.6662
SimWAM是一种面向自动驾驶的世界动作模型,仅在训练阶段使用视频生成。该方法联合训练预训练视频专家模型和轻量级动作专家模型,并通过注意力掩码使轨迹预测不依赖未来视频帧。训练完成后可以移除视频分支,从而得到低延迟的独立规划器。研究人员还使用强化学习优化驾驶奖励,使其超越单纯的轨迹模仿。据论文介绍,SimWAM在NAVSIM上达到91.5 PDMS,超过现有基于世界动作模型的规划器,并可零样本迁移至
小米已启动2027届全球校园招聘,面向毕业时间为2026年9月1日至2027年8月31日的海内外应届毕业生。公司表示,AI相关岗位需求较上一届增长50%。此次招聘开放17个以上职类,产研类岗位占需求的70%,涵盖软件研发、算法、硬件研发、芯片和产品等方向。小米在招聘海报中提到Xiaomi MiMo、Xiaomi miclaw、Xiaomi-Robotics-1以及人形机器人CyberOne等AI相
阿里巴巴通义千问开放平台正式上线,支持开发者将服务接入手机、PC和AI眼镜。用户无需切换应用,即可通过对话完成查件寄件、租房搜索、家政预约和理财分析等操作。平台已接入顺丰速运、自如、天鹅到家、彩云天气等服务。开发者可通过标准化协议接入已有Agent,并使用授权、调试、AI支付、订单管理等基础能力,以及多模态交互组件。AI眼镜还支持通过自然语言创建自定义Skill,例如为视障人士提供障碍物提醒。
Artificial Analysis 的文生视频模型排名显示,前十名中有九个来自中国人工智能实验室。这些模型正逐步获得全球用户采用,可能使中国在构建所谓“世界模型”方面取得优势。不过,围绕中国人工智能雄心的讨论仍主要集中在 Moonshot 的 Kimi K3 等新型大语言模型上。
Figure AI、Sunday Robotics、Weave Robotics 和 1X 等机器人创业公司,正将叠衣服视为家用机器人进入真实家庭的潜在突破口。衣物属于可变形物体,机器人需要识别其状态,并完成抓取、展开和折叠,因此对感知与精细操控能力要求较高。但这项任务的失败成本相对较低,机器人即使出错通常也只会掉落衣物。家庭环境比工厂和仓库更复杂,不过让人把衣物放到机器人面前,可以限制作业范围。
AudioRubrics 是一个用于提升音频推理能力的强化学习框架。它从每个原始波形中生成基于音频证据的评估规则,并根据模型自身的输出持续重新生成和调整规则权重。与只监督最终答案或依赖固定人工标准的方法相比,这种设计能够针对模型当前的弱点提供自适应的训练信号。该方法旨在处理从感知到多步推理等不同类型的问题。研究人员在三个音频推理基准上进行评估,报告称其显著优于多种开源和基于训练的基线方法。分析还显
一项研究考察了人格条件化的大型语言模型智能体在经历11种重大生活事件后,性格特征如何变化。研究以“大五人格”作为心理测量基准,将智能体的变化轨迹与人类人格纵向研究证据进行比较,并通过新基准BFI-Adapt评估了14个模型。结果显示,智能体会产生可测量、稳定且受事件影响的特征变化,但变化幅度通常小于人类研究中的效应量。性别和文化区域提示的调节作用较小,而不同人格设定之间的差异比人类样本低三到四倍。
基于 LLM 的智能体越来越多地调用外部工具,自主完成多步骤任务,但它们经常获取超出任务所需范围的敏感信息。PrivacyPeek 是一个评估“获取阶段”隐私泄露的基准,关注数据首次进入智能体上下文、尚未出现在回复或外部操作中的阶段。该基准包含 1,182 个案例,覆盖 7 种获取行为和 16 个应用领域。它分析智能体的工具调用轨迹及接收的数据,并测试攻击者能否轻易诱导智能体泄露其已获取但未公开的
长安启源宣布,启源 Q07 激光版、启源 A06 激光版和全新 Q05 激光版用户将全部免费 OTA 升级至天枢领航 Pro。升级将于 2026 年 10 月 15 日至 12 月 30 日分批推送。该驾驶辅助系统配备激光雷达,官方称其可在夜间、隧道等弱光环境下更早识别障碍物。长安还将招募用户体验端到端城市领航 NOA 功能,并与工程师交流。天枢领航分为 Pro、Max 和 Ultra 三个版本。
宇树科技已启动首次公开募股申购,有望成为中国第一家上市的人形机器人企业。公司发行价确定为每股150.80元,上市后市值约609.93亿元。大疆曾于2018年以约1012.86万元取得宇树约17%的股份,一度成为其最大外部股东,但在2019年减资后退出。若大疆一直持有这笔股份,其当前市值可能达到数十亿元。宇树计划将募资重点投入智能机器人模型、机器人本体、新产品及制造基地建设。公司2025年营收为16
科技公司似乎没有在自身工作环境中践行人工智能将为人们带来更多闲暇时间的说法。高管宣称人工智能能够减轻工作负担,但一些员工表示自己每周工作时间长达90小时。