摩尔线程宣布:MTT S5000 适配字节跳动开源生物分子结构预测模型 Protenix-v2
摩尔线程宣布,旗下 MTT S5000 智算卡已支持开源生物分子结构预测模型 Protenix-v2 的全链路推理。该模型由字节跳动 Seed 团队研发,于 2026 年 4 月发布,据称在多项核心基准测试中表现与 DeepMind 的 AlphaFold 3 持平或更优,可预测蛋白质、DNA、RNA及小分子配体复合物。摩尔线程表示,此次适配完成了面向 AI for Science 场景的端到端工
AI 新闻中心 过去7天分析了 260 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
摩尔线程宣布,旗下 MTT S5000 智算卡已支持开源生物分子结构预测模型 Protenix-v2 的全链路推理。该模型由字节跳动 Seed 团队研发,于 2026 年 4 月发布,据称在多项核心基准测试中表现与 DeepMind 的 AlphaFold 3 持平或更优,可预测蛋白质、DNA、RNA及小分子配体复合物。摩尔线程表示,此次适配完成了面向 AI for Science 场景的端到端工
《后西游记》被介绍为中国首部完全由生成式AI制作并登陆卫星电视的长篇剧集。该剧计划共60集,每集约40分钟,全程没有使用摄影机,视频生成由Seedance完成。芒果TV称,播出首周正片播放量超过1.5亿次。项目从构想到播出历时6个月,实际制作周期为3个月。约100人的团队重新组织了编剧导演、美术设计,以及提示词和参考素材生成等工作。导演估算,一场动作戏的成本约为数十万元人民币;如果采用真人实拍,类
蚂蚁集团 AI 团队 inclusionAI 在 Hugging Face 上发布了多款 Ling、Ring、Ming 系列模型的训练内容摘要。文件采用与欧盟《人工智能法案》第53条第1款d项相关的模板。每份摘要仅适用于明确列出的模型和版本;仓库不提供模型权重或训练数据集。此次公开不代表官方认证,也不会自动覆盖 inclusionAI 的所有模型。
GeoPair 是一种利用层间冗余的免训练 Transformer 压缩方法。它在考虑各层不同激活几何结构的同时,优化跨层权重配对和共享字典分解。结合结构化稀疏性后,该方法旨在高效分解权重并保持模型功能。作者称,在多种架构、规模和模态上,该方法优于独立分解以及其他成对权重分解方法。
小米公布了面向 MiMo-V3 的核心架构 HySparse2,专为长时间、多轮 Agent 任务设计。该架构结合两级 KV 共享与复用、Token 级稀疏选择,以及固定的局部上下文窗口。在 80B-A3B MoE 模型上,小米称,相比 Hybrid SWA,HySparse2 可将 Prefill 计算量降至五分之一,并将 KV Cache 从 12GB 降至 2.7GB;相比第一代 HySpa
谷歌 DeepMind 负责人科拉伊·卡武克奥卢表示,Gemini 4 已进入后训练初期,有望远早于年底推出。谷歌目前正在开发防护机制并进行安全测试,工程师已在内部使用该模型运行 AI 编程工具 Antigravity。此前宣布但未发布的 Gemini 3.5 Pro 已不再是当前重点,谷歌正集中精力推出 Gemini 4。公司尚未公布具体发布日期。
据《The Information》援引两名知情人士报道,DeepSeek 已确定进行 75 亿美元的第二轮融资,年化营收突破 10 亿美元。数月前,其年化营收还不到 5 亿美元。营收增长被归因于 API 调价以及市场对其模型的持续需求。报道称,DeepSeek 以 5000 亿元人民币估值为目标,并在筹备赴上海上市。公司将 70% 以上的算力用于模型训练,同时正在测试一款据称可在游戏显卡上稳定运
在2026年骁龙峰会上,高通与PrismML在面向智能眼镜的骁龙AR1 Gen 1平台上本地运行了拥有20亿参数的1-bit量化Bonsai视觉模型。据两家公司介绍,该模型的内存占用约为传统4-bit模型的四分之一,在相同内存容量下可容纳约四倍参数,文本Token生成速度则提升至两倍。该方案旨在支持离线识别物体、翻译文字以及回答有关周围环境的问题。内存和功耗需求降低,也有望延长续航并减少发热。
特斯拉已开始向北美搭载 HW3 硬件的 Model S 和 Model X 推送 FSD v14.2 Lite。该更新是面向 HW4 的 FSD v14 技术栈的精简版,针对 HW3 较有限的算力和摄像头硬件进行了调整。目前推送仍处于小范围分批阶段,收到更新的车辆数量很少。HW3 车型将获得从停车位起步、抵达目的地后自动泊车和倒车等功能。HW4 版本中的自动碰撞规避等功能未包含在 Lite 版中。
Meta 在 Connect 发布多款设备,并宣布将个人智能体 Muse 接入智能眼镜。用户可通过语音唤起 Muse,获取运动指导、记录饮食或寻求购物帮助。新品包括起售价 349 美元、没有摄像头的 Ray-Ban 音频眼镜,以及起售价 449 美元的新款 Ray-Ban Meta。Meta 还展示了计划于 2027 年推出的轻量 VR 眼镜,以及尚未公布价格的 Muse Charm。Muse 目
腾讯混元推出“腾讯 Hy 翻译”App,同时提供小程序、插件和 PC 端版本。该应用基于 Hy-MT2 翻译模型,支持 33 种语言互译,涵盖 5 种中国少数民族语言及方言,并提供语音、拍照和离线翻译。用户可将模型预先下载到手机,在无网络连接时使用。Hy-MT2 已于今年 5 月开源,并支持在移动设备本地部署。该应用目前已在 12 个国家和地区上线。
表示自编码器(Representation Autoencoder)使扩散模型能够在预训练视觉编码器的特征空间中运行。然而,许多现成编码器并未针对忠实重建进行优化,因此会丢弃细微的视觉细节。为重建任务微调编码器可以恢复这些细节,但也会降低表示的有效维度并改变其几何结构。研究发现,在这种情况下,流匹配中的标准速度预测要求模型拟合信号低维流形之外的正交噪声方向,导致优化效率低下。改为预测干净数据x₀,
据报道,月之暗面正在筹备 Kimi K3.1,预计可能于 2026 年 10 月发布。相关模型标识据称出现在内部 JSON 和 API 响应中。配置资料显示,该模型可能提供三档推理强度、最高 100 万 Token 的上下文,以及智能体、多智能体协作、搜索和批处理模式。目前这些信息尚未获得官方确认。2026 年 7 月发布的 Kimi K3,是月之暗面目前公开推出的旗舰模型。
PackLab 是一个用于开发和评估多模态大语言模型的框架,面向机器人容器装箱中的闭环长期序列决策。该套件包括基于物理的仿真平台,可规模化生成多样化训练轨迹;PackLab-VLM,可根据物体和容器状态的变化同时选择物体并预测放置位置;以及 PackLab-Bench,提供多个难度等级的标准化评测场景。实验显示,在不同物体集合和容器配置下,PackLab-VLM 平均优于传统装箱启发式方法、传统强
HappyWorld-Bench是一套用于评估世界模型的综合基准。它不仅衡量生成世界的视觉质量,还测试模型在探索、交互和修改过程中的一致性与响应能力。该框架围绕六项能力,覆盖视频、空间和具身世界模型三个评测方向。研究评估了14个视频模型、9个空间系统和8个具身模型候选,并结合自动化行为指标、人工A/B比较和Elo评分。结果显示,三类模型都存在明显的可靠性缺口:视频模型在长时间生成和重新访问时一致性