原文跳转提示
此资讯内容来源于外部网站,将在 60 秒后自动跳转到原文页面
https://arxiv.org/abs/2608.06756
立即前往原文

Capek 0.5:面向具身智能的执行中心型视觉语言模型

Capek 0.5是一款面向机器人的视觉语言模型,以完整的执行流程为核心组织具身智能体的能力,涵盖空间推理、时间理解、动作指导和状态验证。研究人员首先使用带有可验证奖励的强化学习,分别训练各项能力的专家模型,随后通过权重空间合并和策略空间蒸馏,将其整合为单一模型。Capek 0.5提供2B和35B-A3B两种规模,并通过包括新基准Capek-StateBench在内的综合测试、能力保留实验,以及模拟具身环境中的闭环评估进行验证。结果显示,该模型在大多数匹配基准项目上优于初始化模型,并能在一个检查点中保留四项专业能力。
行业资讯 应用 AI模型 研究 2026-08-10 17:01:03 722 阅读 阅读约 1 分钟 来源:Hugging Face
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。