价值几何:通过任务向量组合对齐语言模型的伦理偏好
一项研究提出了一个包含12,000个二选一困境的数据集,涵盖诚实、公正与自主性之间的两两价值冲突,并提供印地语、阿拉伯语、西班牙语和中文译本。在未指定政策时,GPT-5-mini在测试的五种语言中都稳定地偏好诚实而非自主性。小型Llama-3.2模型则明显偏向第一个选项;但普通微调和直接偏好优化能够有效消除这一偏差,使准确率提升至98%以上。研究人员还将任务向量与通用指令遵循向量进行正交化,以分离
AI 新闻中心 过去一年分析了 1725 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
一项研究提出了一个包含12,000个二选一困境的数据集,涵盖诚实、公正与自主性之间的两两价值冲突,并提供印地语、阿拉伯语、西班牙语和中文译本。在未指定政策时,GPT-5-mini在测试的五种语言中都稳定地偏好诚实而非自主性。小型Llama-3.2模型则明显偏向第一个选项;但普通微调和直接偏好优化能够有效消除这一偏差,使准确率提升至98%以上。研究人员还将任务向量与通用指令遵循向量进行正交化,以分离
上汽通用五菱已开始为缤果 Pro 330km 和 403km 尊享款车型分批推送 OTA 升级。升级完成后,车主将在 2 个工作日内获得 3 年车机无限流量权益。本次更新新增语音控车功能,以及灵犀 AI 中枢大模型,并将 DeepSeek 融合到车机系统中。系统可识别 10 种中国方言,包括粤语、四川话、陕西话、河南话、山东话和上海话等。
亚马逊云科技已将月之暗面开发的 Kimi K3 模型接入 AI 平台 Amazon Bedrock。据现有信息,Kimi K3 是一款开放权重模型,原生支持视觉能力,拥有 100 万 Token 的上下文窗口,并宣称参数规模达到 2.8 万亿。该模型主要面向长时间编程任务和大规模文档分析。Bedrock 将为其提供与闭源模型相同的安全边界,包括统一的访问控制、加密和审计机制。Kimi K3 还是
上汽荣威已在中国开启家越07预售,共推出三款车型,预售价13.78万元起。该车搭载豆包座舱助手,支持FaceID账号识别与记忆、豆包App联动、方言和外语,并可通过语音联动车辆功能。驾驶辅助系统由Momenta R7世界模型与专用AI芯片XHEART X7组成。据官方介绍,该系统支持单侧余量20厘米的狭窄垂直泊车,覆盖300多种车位场景,并提供离车泊入、一键贴边以及城市和高速NOA功能。车辆采用增
开发者消息称,Anthropic 可能正以“claude-wafer-eap”为内部代号测试 Claude Opus 5.5。未经官方确认的价格信息显示,输入每百万 Token 可能收费 4 美元,输出每百万 Token 收费 20 美元,缓存读取费用也将明显下降。部分开发者还声称,新模型在 3D 生成、代码重构和长程任务规划方面有所提升;Claude Fable 5.2 也被指正在测试中。不过,
据两名知情员工透露,阿里巴巴已任命资深AI研究员刘大一恒担任Qwen(通义千问)大语言模型团队负责人。今年以来,Qwen团队经历多轮组织重组,此次任命进一步明确了这一核心AI产品线的管理架构。任命时点恰逢阿里巴巴年度云栖大会开幕前夕,刘大一恒在大会官网演讲嘉宾名单中位列显要位置,仅次于集团主席蔡崇信和首席执行官吴泳铭。
OceanBase 表示,其 Data Agent 方案 Scout 在国际数据智能体基准 DAB 中以 90.62% 的准确率排名第一,成为首个准确率超过 90% 的参评方案。该系统基于国产数据库 OceanBase 和大模型 GLM-5.2 构建,超过了多项基于 GPT、Claude 等模型的 Data Agent 方案。DAB 不仅考察自然语言转 SQL,还评估系统理解复杂数据、选择数据、规
FRAUDSkill是一种无需修改大型音频语言模型内部权重的适配框架。该方法转而优化外部技能程序、路由专属策略和决策规则,以执行三阶段流程:识别服务场景、检测欺诈,并在必要时分类欺诈类型。研究还结合验证引导的多路径推理,以提高输出对既定流程的遵循程度。在TeleAntiFraud基准测试中,FRAUDSkill取得73.50%的Macro-F1,相比共享冻结模型基线提升31.96个百分点,同时将无
据报道,一名研究人员使用 GPT-6 Astra 破解了一段在第一次世界大战期间、于1918年发送的德国无线电讯息。该讯息被列入德国科学门户网站 ScienceBlogs.de 整理的50个著名未解密码之中。报道只介绍了模型的一次具体应用,没有提供相关技术方法的细节,也未说明破解结果是否经过独立验证。
策略内蒸馏通过学习更强教师模型与策略内学生模型之间的逐 token 差异,提升推理模型的能力。但这种差异不仅反映教师与学生之间的能力差距,也包含教师自身产生的偏差;在使用特权信息时,这一问题会进一步加剧。研究提出校准策略内蒸馏(Cal-OPD),通过正向和负向特权干预估计教师自身的偏差区域,并只保留超出该区域的差异作为优化信号。在数学推理基准测试中,Cal-OPD仅保留原始差异的约52%至65%,
Paint-Anything 提出了一种基于 24 位十六进制颜色值的统一接口,使用户能够在图像生成和编辑时指定对象的目标颜色。该方法结合真实图像中的对象级颜色监督,以及像素与指定颜色完全一致的纯色锚点,以减少阴影造成的标注误差。研究团队还构建了 Paint-500K 数据集和 Any Color Benchmark,用于评估对象级颜色还原度。在 FLUX.2-4B 上,与基础模型相比,该方法在生
根据OpenRouter最新数据,全球AI大模型周调用量达129万亿Token,其中中国大模型周调用量达67.46万亿Token,环比增长10.28%,连续21周超越美国。DeepSeek V4.1-Flash以15.8万亿Token的调用量跃居第一,智谱GLM5.3Flash和腾讯混元Hy4preview分列第二和第三。尽管DeepSeek新模型降低了KV缓存并下调了Token单价,但由于其输出
CodeMidas 是一个自动化管线,旨在通过直接从现有源代码中生成任务,来扩展编码智能体(Agent)的强化学习(RL)环境。与依赖 Issue 或 Commit 等开发遗留产物的传统方法不同,CodeMidas 利用智能体分析代码库、制定行为规范,并验证基于执行的测试。该管线在 23 种编程语言中生成了 5,545 个训练任务。通过 GRPO 算法在此数据集上训练 MiMo-V2.5 模型后,
研究人员推出 MintAct,这是一系列参数规模为 20 亿、40 亿和 80 亿的视觉语言模型。该模型统一支持用户界面定位、移动端、桌面端和网页环境中的多步骤导航,以及视觉工具使用。研究团队构建了可扩展的环境与强化学习基础设施,用于跨领域轨迹数据收集和在线训练。实验结果显示,MintAct 在这些能力上的表现可与各领域专用模型相当,并在 OSWorld-Verified 上取得 48.9 分。研
OmniVBench是用于评估多种参考控制视频生成模型的基准,涵盖内容、动作、风格、结构、叙事和多参考等7类任务、18项细分任务。其包含12,172个针对具体案例的检查项,用于评估参考因素是否被准确保留、解耦、绑定到正确目标,并按照指令实现。配套的Omni-R2V数据集包含34万个经过处理的训练样本,主要来自专业视频素材。对开源和闭源模型的评估显示,不同任务类别和评估维度之间仍存在明显性能差距。