为什么每家企业都需要人工智能模型退出策略
模型灵活性可以帮助企业在人工智能不断发展的过程中保护工作流程和组织知识,同时保持对技术与运营的控制。
AI 新闻中心 过去一年分析了 1727 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
模型灵活性可以帮助企业在人工智能不断发展的过程中保护工作流程和组织知识,同时保持对技术与运营的控制。
OpenAI总裁格雷格·布罗克曼在GPT-6 Astra发布活动上宣布,“AGI时代”已经开始。通常所说的通用人工智能,是指能够在几乎所有认知任务上达到或超越人类能力的AI系统。尽管GPT-6 Astra展现出很强的能力,专家表示,其基准测试结果不足以证明通用人工智能已经到来。根据目前公布的证据,OpenAI的这一说法仍未得到充分证实。
Dynin-Robotics是一种全模态扩散模型,将语言、视觉观测、目标和动作表示为离散令牌。该模型使用来自48个Open X-Embodiment数据集的约133万条轨迹进行持续预训练,支持动作预测、动作条件下的下一观测预测、终端目标状态预测,以及从轨迹重建指令。共享轨迹建模提升了模型对下游机器人任务的适应能力,也改善了指令变化时的表现。模型在LIBERO和零样本LIBERO-Plus上取得具有
Lady Gaga的未婚夫、Outer Bio联合创始人兼董事会成员迈克尔·波兰斯基,正在开发用于研究人类皮肤的平台。Outer Bio成立于2020年,利用Yuna平台让捐赠的人类全层皮肤在体外维持活性,最长可达四周。研究人员会反复分析样本,研究伤口愈合、色素形成、慢性炎症、衰老和皮肤屏障等问题。公司使用这些数据训练预测型AI模型,以判断不同化合物对人类皮肤可能产生生物活性或毒性作用。波兰斯基表
据《商业内幕》报道,Google 将通过 Antigravity 向所有工程师提供 Anthropic Claude Opus 5 的访问权限。不过,Google 表示,Gemini 仍是其内部开发使用的主要和基础模型。此前,许多 Google 员工一直无法使用 Claude。
研究人员提出了专家空间探索强化学习(ESRL),通过主动探索专家路由选择来改进混合专家(MoE)模型的强化学习。ESRL 将高置信度专家保留为锚点,把随机路由限制在合理的候选集合内,并根据路由器熵调整扰动强度。此外,该方法会记录 rollout 阶段使用的专家路径,并在策略优化时重放,以减少路由不匹配。在多种 MoE 架构以及数学、科学和编程任务上的实验显示,ESRL 无需额外采样或计算成本,就取
LynnReal-Omni是一套多模态视频生成框架,通过共享的扩散Transformer统一处理文本、图像、外观参考、结构控制、可编辑3D场景和游戏状态等输入。其320亿参数模型支持文本生成视频、图像条件生成、参考引导生成、视频编辑、低质视频修复以及长视频生成。研究团队还推出了面向实时渲染的270亿参数模型LynnReal-Omni-Flash。配套的数据处理流程和MSAVP评测方案用于衡量指令遵
中国 AI 公司阶跃发布 StepAudio 3 系列,包含 StepAudio3Realtime、ASR、TTS、Gen 和 Music 五款模型。公司称,多款模型在 Artificial Analysis 榜单中位列全球第一。该系列覆盖实时语音交互、语音识别与合成、完整音频内容生成和音乐创作。StepAudio3Realtime 支持原生全双工对话、用户打断、推理与语音生成并行,以及不阻塞当前
该研究提出最小干预强化学习(MInTRL),用于扩展采用可验证奖励的强化学习系统的探索范围。在生成过程中,评判策略会检查当前策略的输出,用简短修正替换错误的后缀,然后将控制权交还给原策略。序列级优势回归目标避免了重要性采样的需要。在数学和代码基准测试中,MInTRL 的表现优于标准的在策略和离策略基线方法。结果表明,稀疏、局部的干预能够提升探索覆盖范围,同时保持训练轨迹总体上的在策略特征。
一项持续数月的工程计划介绍了 Sophea,这是一个面向生产环境的希腊语和英语双语自动语音识别系统。团队围绕词错误率、语言识别能力以及在非语音音频上的幻觉现象,设置了九项生产标准进行评估。在 23 次训练迭代中,没有任何训练数据配置同时通过全部九项标准。由三个模型组成的 ROVER 集成系统通过了全部标准,并将重叠语音场景下的词错误率相对降低 29%。另一个模型在八个公开英语测试集上的平均词错误率
AlayaVista是一种可由摄像机控制的流式视频世界模型,旨在保持广泛的场景上下文,同时生成高保真的透视视图。系统从单张透视图像出发,利用预训练的全景扩展模型构建360度场景先验,并将其作为受摄像机条件控制的全景潜在状态持续演化。潜在视口渲染器将该状态转换为指定视角的视频潜在表示,透视细化模块则负责恢复细节、抑制伪影并进行超分辨率。为实现高效流式生成,研究团队将全景生成改造为分块自回归生成,并将
一名 Reddit 网友表示,他使用阿里巴巴开源的 Qwen3.8-27B 模型,在一张超频 RTX 3090 上耗时约 5 小时,开发出一款可玩的第一人称僵尸射击游戏。测试采用 Q4KM 量化版本和两套 Harness 方案,并通过 MSI Afterburner 对显卡进行超频,据称性能提升约 12%。Q4KM 通常指 GGUF 格式中的 4 位混合量化档位。这一项目展示了模型在本地编程场景中
上海人工智能实验室开源了多模态基础模型 Intern-S2。实验室称,该模型的通用能力位居开源模型前列,并在生物、材料科学和化学等长程科学任务上达到可与顶尖闭源模型相比的水平。其核心架构是 Memory Decoder,支持插拔式专业记忆模块。针对特定领域,用户可以更换相应记忆模块,而无需重新训练整个模型,同时保留原有的通用能力。Intern-S2 还强化了长程推理和智能体工具执行能力,这些能力对
DeepSeek 已在官方仓库主分支中加入 DeepSeek Harness 完整的桌面端目录。该应用预计支持 Apple Silicon 和 Intel Mac,以及 Windows x64,暂不支持 Linux。安装包预计将通过 download.deepseek.com 提供,但目前尚未发布可下载版本。与许多社区开发的客户端不同,官方版本使用自定义的 dsh-app:// 协议,而不是本地端
据《The Information》报道,英伟达、Palantir 和 Booz Allen Hamilton 等企业客户因担忧专有数据的处理方式,正在限制使用 Anthropic 和 OpenAI 的前沿模型。英伟达据称仅将 Anthropic 模型用于开源软件开发等敏感度较低的任务,并把最机密的业务交给自家的 Nemotron 模型。Anthropic 允许为检测滥用而保留客户数据 30 天的