从检索到类型化决策:基于生物医学句子编码器的校准型 System One 模型
类型化决策模型可通过一次前向推理回答受模式约束的文本问题,并返回可按阈值判定的概率。本研究考察面向检索训练的生物医学句子编码器能否作为此类模型的良好起点。研究推出 SBERT2S1,可将 Sentence-Transformers 编码器转换为决策模型;生物医学评测套件 BIODECIDE;以及由 NLM 索引数据生成、包含 24.3 万条训练决策的 MEDLINE-S1。在六组模型配对中,检索训
AI 新闻中心 过去24小时分析了 161 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
类型化决策模型可通过一次前向推理回答受模式约束的文本问题,并返回可按阈值判定的概率。本研究考察面向检索训练的生物医学句子编码器能否作为此类模型的良好起点。研究推出 SBERT2S1,可将 Sentence-Transformers 编码器转换为决策模型;生物医学评测套件 BIODECIDE;以及由 NLM 索引数据生成、包含 24.3 万条训练决策的 MEDLINE-S1。在六组模型配对中,检索训
掩码扩散语言模型为自回归模型提供了一种并行处理方案,但训练中存在一个独特难题:去噪过程中的少数决策可能显著影响最终回答。Pivot-SD是一种离线自蒸馏方法,依据信息增益挑选这些影响较大的决策(称为“枢轴”)。它使用交叉熵训练成功轨迹中的枢轴,并对失败轨迹中的枢轴进行有针对性的非似然训练。仅使用200个问题、每题生成四次,Pivot-SD就在数学和代码基准测试中提升了LLaDA-8B-Instru
该研究提出 NAVA-WAM,可直接利用没有动作标注的视频预训练机器人动作策略。第一阶段,模型从视觉变化中学习;随后,研究人员使用带动作标签的示范数据进行后训练,以实现机器人控制。实验显示,NAVA-WAM 在训练分布内外均优于以往方法,所需动作标签更少,并能有效迁移到真实机器人。该方法旨在降低对大量标注机器人数据的依赖。
圆刚推出面向工业应用的 AIClear Mic(A113)麦克风,工作温度范围为 −25℃ 至 +60℃,存储温度范围为 −40℃ 至 +85℃。其 AI 降噪功能面向边缘应用,可抑制环境噪声;圆刚称,该功能可使语音识别准确率提升 60% 以上,也有助于提高声纹认证准确性。A113 支持免驱动即插即用,采用 USB-C 连接,并配备两个 3.5 毫米音频插孔。
这家德国电信集团预计,到2027年,人工智能将在美国以外地区带来约11亿欧元的毛节省。
施耐德电气计划以约226亿美元全现金收购美国软件公司PTC。每股205美元的报价较前一交易日收盘价溢价超过40%,交易预计于2027年第三季度完成。施耐德希望借此扩大工业软件及人工智能赋能解决方案的产品组合。PTC为产品设计、制造和服务提供软件,并受益于人工智能工具需求的增长。摩根士丹利和法国兴业银行已为这笔交易安排过渡性融资。
华为与高通达成一项长期、广泛的专利许可协议,包含双方在5G、计算、人工智能和网络领域的专利交叉许可。高通还将收购华为在这些及其他技术领域的部分美国专利。这是双方首份涵盖5G技术的专利许可协议。华为表示,交易完成后,公司专利许可协议累计总额预计将超过69亿美元。
台达将与 NVIDIA 合作,利用 Hyperion 平台和 Halos 安全系统推进自动驾驶系统开发。台达将提供汽车能源管理、电动汽车动力系统及车载高性能计算方面的专业能力。公告未公布具体产品或时间表。
OpenAI首席执行官萨姆·奥特曼表示,他非常不认同赋予人工智能宗教意义或灵魂,并称这是一个真实的安全问题。此番言论正值Anthropic与宗教领袖展开交流之际。
高通已同意获得华为 LogicFolding 芯片制造技术相关专利的许可。这项协议有利于华为拓展海外人工智能市场。
HelixWorld是一种世界模型,可在用户实时交互过程中共同生成视觉场景和与摄像机视角对齐的空间立体声。该系统使用高保真视听数据集进行预训练,数据包含真实立体声声学、带尺度信息的摄像机姿态、六自由度摄像机轨迹以及用户操作。研究人员将双向教师模型蒸馏为低延迟流式学生模型,并报告称其可在单块GPU上以每秒24帧生成无漂移的视听推演结果。研究还提出HelixBench,用于评估合成声场是否能准确跟踪视
一项研究分析了大型预训练模型在持续训练过程中出现的灾难性遗忘问题。研究提出 Local Support Learning(LSL),将标准权重适配器与门控函数结合起来。门控函数只在输入激活来自适配器自身训练分布时启用更新,从而减少对既有能力的干扰。该方法使用基于高斯混合模型的门控机制,在无法访问历史数据的情况下区分不同学习阶段的数据。作者称,在参数规模最高达70亿的语言模型上,LSL能够在多个训练
SimuVerity 评估人工智能智能体能否生成满足工程要求的 Simulink 模型,而不仅是能够编译或与参考模型相似。该基准涵盖十个工程领域的 101 项文本到可执行模型任务,先检查成果交付、原生可执行性和工程合格性,再从准确性、输出质量、机制与因果完整性、运行域鲁棒性及动态响应等维度评分。在对六个智能体系统的评估中,最佳系统的总分仅为 42.86。结果表明,结构相似度并不能有效代表工程性能,
美国佛罗里达州李县一名 30 岁女子因涉嫌在与 Anthropic 旗下 Claude 的对话中威胁袭击县警长办公室而被捕。警方称,该消息触发 Anthropic 的安全机制,经人工审核后转交当地执法部门。女子告诉调查人员,她把 AI 当作“日记本”使用。她目前面临书面暴力威胁指控,但尚未被定罪。此案引发对聊天机器人隐私边界的讨论。Anthropic 表示,在某些情况下,例如认为存在迫在眉睫的严重
MotorMind 将视觉语言模型提出的中间层动作与确定性机器人控制及执行反馈相连接。在不进行任务专属策略训练、不使用编程智能体或额外视觉定位工具的情况下,系统在 LIBERO-PRO 上的成功率为 66.7%,在扰动条件下为 53.8%。在真实 xArm6 机器人上,平均成功率达到 95%。结果表明,通用视觉语言模型配合适当的动作表示和执行框架,可以完成零样本机器人操作任务。