Stability AI 获 UMG、WMG、EA 等投资者参与,完成 7600 万美元 B 轮融资
Stability AI 已从环球音乐集团、华纳音乐集团、艺电、索尼音乐及其他投资者处筹集 7600 万美元 B 轮融资。这家人工智能初创公司已与 UMG、WMG 和 EA 达成协议,将利用其知识产权开发 AI 模型。公司支持者还包括詹姆斯·卡梅隆和肖恩·帕克。
AI 新闻中心 过去一年分析了 1731 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
Stability AI 已从环球音乐集团、华纳音乐集团、艺电、索尼音乐及其他投资者处筹集 7600 万美元 B 轮融资。这家人工智能初创公司已与 UMG、WMG 和 EA 达成协议,将利用其知识产权开发 AI 模型。公司支持者还包括詹姆斯·卡梅隆和肖恩·帕克。
NVIDIA 的 DLSS 4.5 光线重建采用第二代 Transformer AI 模型。NVIDIA 表示,新模型的计算能力提升 35%,可处理参数量增加 20%,但性能与旧模型基本持平。实测使用 GeForce RTX 5070 Ti,在多款游戏中对比了新的 F 预设与 DLSS 4。结果显示,水洼、玻璃反射、照明、粒子效果和物体表面细节均有所改善。《生化危机:安魂曲》的差异最明显,《识质存
OpenAI首席财务官萨拉·弗里尔解释了芯片、算力、模型和产品方面的进步如何相互叠加,从而以更大的规模和更低的成本提供更有用的人工智能。现有描述没有提供具体的技术指标或新产品详情。
据 ModelScope 信息,阿里巴巴计划于 8 月 26 日 23:00(北京时间)开源 Qwen3.8-Flash-Next。页面显示,此次将发布 Qwen3.8-Flash-Next 和 Qwen3.8-Flash-Next-FP8 两个版本。官方称,Qwen3.8-Flash-Next 是基于下一代 Qwen4 架构构建的多模态混合专家模型。阿里巴巴表示,提前公开这些架构改进,是为了帮助
谷歌扩展其Gemini Enterprise人工智能平台,新增面向律师和律所的专业工具。新服务包括法律业务专用AI代理,并与汤森路透、LexisNexis和Harvey集成。此次发布将谷歌的企业级AI平台拓展至法律工作流程,但公告未披露具体的性能提升或用户数量。
Accelerated Understanding 发布了一款面向企业物理应用的人工智能模型。该模型采用神经算子,公司称其在测试中曾通过单个提示处理 5 万亿个数据元素。公司由两名研究人员创立,他们此前曾被认为可能领导由杰夫·贝索斯支持的 Prometheus 项目。目前,相关性能声明尚未获得独立验证,也没有证据表明该模型已实现大规模商业应用。
研究提出了一种名为量化感知修复(QAH)的方法,用于在部署前恢复经过结构化压缩并量化为 4 位的大语言模型性能。与传统的量化感知训练不同,QAH 直接从未压缩的原始模型向 4 位学生模型进行知识蒸馏。在 GPT-OSS 120B 缩减至 60B、再转换为 MXFP4 的流程中,开放权重模型 Hypernova-60B 在 9 项基准测试中的 7 项达到或超过了 bfloat16 源模型,同时将权重
AutoResearch 是一个由两阶段组成的自主研究系统,旨在提高研究流程的可靠性。在想法生成阶段,系统整合最新研究信号与积累的领域知识,通过多模型生成和交叉评审形成可验证的研究计划。在想法执行阶段,协作智能体将计划拆分为实验,反复实施和诊断,并在接受研究结论前进行独立的循证评审。系统在跨模态检索、系统优化和机器学习等场景中取得了可量化的进展,并能检测和纠正不可靠的实验结果。在 RSICD 基准
LongWoF-Bench 研究能否通过 EvoMap 将经过验证的执行经验整理为可复用的结构化“Gene”,以帮助模型完成复杂工作流。该基准包含 778 项可由机器验证的任务,涵盖代码生成、智能体环境合成、数学推理和规则遵循。在拥有 Claude Opus 验证执行轨迹的 252 项任务中,演化后的 Gene 在全部 7 个评测模型上均超过 Skill,优势为 8.7 至 15.5 个百分点。相
据报道,SpaceX 已完成以 600 亿美元收购 AI 编程初创公司 Cursor。The Information 称,在交易宣布当天,埃隆·马斯克通过视频参加了 Cursor 的全员大会。五名知情人士表示,马斯克承认 SpaceX 的 AI 部门落后于竞争对手,并称自己“不习惯失败”。他据称还表示,Grok 尚未成为所在市场的领导者,要求 Cursor 员工协助 SpaceX 追赶竞争对手。马
EXPL-FR提出了一种无需访问内部架构即可解释深度人脸识别模型的方法。研究人员使用轻量级适配器,将视觉语言模型的图像编码器对齐到冻结的人脸识别模型嵌入空间。由于图像和文本编码器共享同一空间,22个类别中的978个属性提示词可以转换为人脸识别空间中的锚点。研究通过人脸验证协议和消融实验检验这种迁移是否有效。并非所有概念都能被识别,因为人脸识别模型会丢弃身份验证不需要的因素。一个无需标签的指标筛选出
据《The Information》报道,Meta 计划在未来数周推出面向消费者的 AI 智能体平台“Hatch”。一份内部文件显示,Hatch 是基于 Meta AI 虚拟助理 OpenClaw 打造的智能体。报道称,该平台是 Meta CEO 马克·扎克伯格 AI 战略的一部分,旨在将公司的 AI 投资商业化,并降低对广告收入的依赖。Meta 据称曾考虑采用分级定价模式,高级订阅费用最高可能达
WorldToken是一种机器人策略架构,在每个决策步骤中将多视角图像、本体感知和任务条件融合为一个世界令牌。因果时间Transformer处理由此形成的令牌序列,扩散动作头则生成动作片段。在RoboCasa的23项任务上,一个拥有8530万参数、除冻结的预训练CLIP文本编码器外均从头训练的模型,使用每项任务2900条生成示范,取得了59.45%的平均闭环成功率。针对数据集规模、模型规模和训练随
一项研究分析了在十亿级数据规模下,用户表示学习应如何扩展分词配置。基于支付宝数据集的实验表明,单纯增加原始用户行为数据会带来递减的性能收益,而分词仍能持续提升效果。研究发现,最低必要分词容量与输入数据规模的对数之间大致呈线性关系。研究团队据此提出ALGN,一种自适应可变长度分词方法,可改善容量分配,并在多种数据来源、分词方法和下游任务中优于现有基线方法。
据马斯克透露,星链正在将Grok语音系统部署到客户支持和销售业务中。报道称,SpaceX AI团队提供的数据显示,该系统每天处理超过1.5万通客户咨询和销售电话,每周自主完成超过3000笔订单。不过,报道没有提供独立验证或技术细节来证明这些数据。若相关说法属实,这将表明语音AI已在商业服务流程中实现较大规模应用。