ChatGPT 背后贡献者 Almeida 推出 AI 模型 Jev,输出免费
TypeSafe AI 发布了 Jev,这是一款不生成文本或代码、而是返回结构化决策的“System One Model”。Jev 支持从最多 255 个预设选项中进行选择、输出数值评分,并提供经过校准的是或否概率。公司称,该模型采用“校准决策强化学习”(RLCD),旨在使模型置信度更贴近实际正确率。在结构化任务中,TypeSafe 宣称 Jev 比前沿大型语言模型快 20 至 200 倍,成本低
AI 新闻中心 过去一年分析了 4113 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
TypeSafe AI 发布了 Jev,这是一款不生成文本或代码、而是返回结构化决策的“System One Model”。Jev 支持从最多 255 个预设选项中进行选择、输出数值评分,并提供经过校准的是或否概率。公司称,该模型采用“校准决策强化学习”(RLCD),旨在使模型置信度更贴近实际正确率。在结构化任务中,TypeSafe 宣称 Jev 比前沿大型语言模型快 20 至 200 倍,成本低
Anthropic 和其他研究人员表示,约会诈骗应用利用 Claude 及其他大语言模型生成回复,诱骗了数千人。安全研究员 Matthew“Zigula”Gore-Kormanik 在调查欺诈性约会应用 Dora 时,看到弹窗提示 Jennifer 正在来电。
《金融时报》分析了自主系统在战场上的快速整合。随着人工智能辅助的目标生成流程速度更快、规模更大,错误风险也随之上升。此外,人工智能模型正以连其开发者都无法完全预测的方式发展。
低功耗 FPGA 厂商莱迪思宣布推出 FPGA 开发 AI 辅助工具 Prompt,以及安全 FPGA 新系列 Mach-N2。Prompt 基于莱迪思验证过的文档和知识库,支持开发者通过自然语言贯穿完整设计流程。该工具深度集成 Radiant 设计软件,并可通过开放式 MCP 协议与现有 AI 工具协作。Mach-N2 面向现代基础设施,集成闪存,支持符合 CNSA 2.0 标准的后量子密码学和
阿里云展示了升级版 AI 视频生成模型 Wan3.0。据公司介绍,该模型可直接生成最长 30 秒的单条视频,并同时使用最多五条视频作为参考素材。相关功能旨在提升长镜头的连贯性,以及对视觉风格和叙事元素的控制能力。阿里云表示,开发者和企业用户可以通过 Model Studio 和 Qwen Cloud 使用其 API。不过,此次发布没有提供独立基准测试,也未公布足以评估时间一致性、输出质量或实际制作
新加坡技能与劳动力发展局推出多项人工智能课程,旨在提升劳动者的数字技能。通过 Singtel AI Pass,MiniMax Agent、海螺 AI 和 MiniMax Audio 三款产品已被纳入官方培训计划。符合条件的学员可免费获得这些高级 AI 工具为期六个月的订阅权益。该计划为当地职场人士和开发者提供了接触生成式 AI 产品的机会,也显示中国 AI 服务正逐步融入国际教育和职业培训体系。
豆包与火山引擎于9月17日发布“豆包座舱助手”,将大模型能力应用于汽车座舱。该产品结合豆包大模型与火山引擎云基础设施,主打更自然的语音交互、上下文理解和多场景协同。上汽集团已成为其首个主要汽车合作伙伴,首款搭载车型荣威家越07已开启预售,上汽奥迪相关车型预计于年内亮相。双方还计划将更多新功能陆续应用于其他车型。这是生成式AI在车载场景中的一次商业化落地,但产品的实际性能、稳定性和市场接受度仍需经过
当人工智能开始判断哪些面部特征才算美丽,会带来什么后果?爱丽丝·拉斯曼探讨新型人工智能美容工具引发的社会与伦理影响。来源:彭博社。
该研究提出 XConf,一种结合当前推理过程与过往评估经验来估计语言模型置信度的方法。系统会记录过去的任务、模型反思、自报置信度、结果,以及评分完成后总结的经验教训。面对新任务时,XConf 会检索任务相似且自报置信度接近的历史案例,并依据其历史成功率重新评估置信度。该方法无需访问 logits,也无需更新模型权重,每次只需生成一次答案。在涵盖推理、编程、多模态问答和交互式智能体的九项基准测试中,
字节跳动旗下火山引擎正式发布车载 AI 系统“豆包座舱助手”。车主可通过豆包 App 远程控车、查询车况,并将对话中生成的行程发送至车机。该助手可识别数百种车辆信号,联动车控、导航、辅助驾驶和娱乐等功能,还能将复杂任务拆分为多个步骤执行。火山引擎同时推出车载“豆包屏”,支持多音区语音识别和长期记忆,可记录用户偏好。火山引擎目前已与上汽集团合作,上汽荣威家越 07 将成为首款搭载该助手的车型,并将于
洛杉矶港执行主任吉恩·塞罗卡介绍了人工智能如何改变航运和物流。他还谈及贸易关税,以及地缘政治风险下供应链的调整。塞罗卡在彭博节目《Insight with Haslinda Amin》中接受了哈斯琳达·阿明的采访。
总部位于冰岛的 Treble 已为其语音模拟平台筹集 1800 万美元。该技术被语音人工智能模型开发商,以及人工智能可穿戴设备和机器人企业使用。
谷歌、英伟达和Emerald AI成立了AI Energy Management Alliance。该联盟旨在帮助数据中心根据电网状况动态调整用电量,从而减轻电力系统压力,并推动人工智能计算所需数据中心基础设施的扩展。
ActionPiece 是一种面向自回归视觉语言动作模型的动作标记化方法。研究人员提出 Physical Rank Consistency(PRC),用于衡量动作重建后是否保留不同动作之间的相对物理距离。该方法将关系监督与重建损失、量化正则化结合起来。在相同的 Qwen3-VL-4B 策略训练设置下,ActionPiece 在 LIBERO 上达到 94.8%,在包含未见场景的 LIBERO-Pl
HypoEvolve利用世代遗传算法协调专业化的大语言模型智能体。智能体依据机制性论证、外部证据和可测试性来提出、批评并评估假设。在覆盖34种癌症的药物再利用研究中,该系统在两项外部指标上均超过六种基线方法。其DepMap选择性得分达到0.171,高于最强基线方法的0.115。在未参与评估的癌症类型上,性能提升同样能够泛化。这项研究提出了一种框架,用于检验人工智能智能体之间的协作如何影响科学假设的