摩尔线程发布《MTT S5000 Prefill-as-a-Service技术白皮书》
摩尔线程发布了一份基于MTT S5000 AI智算卡的“Prefill-as-a-Service”技术白皮书,面向AI Agent、代码生成和超长文档分析等长上下文推理场景。该方案将主要受计算能力限制的Prefill阶段,与更依赖显存带宽的Decode阶段分离,并分别部署在专用硬件资源池中。公司称,这种配置有望改善首字延迟、处理吞吐和基础设施成本效率。此次发布主要提出了一种推理系统架构,消息中未提
AI 新闻中心 过去一年分析了 6602 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
摩尔线程发布了一份基于MTT S5000 AI智算卡的“Prefill-as-a-Service”技术白皮书,面向AI Agent、代码生成和超长文档分析等长上下文推理场景。该方案将主要受计算能力限制的Prefill阶段,与更依赖显存带宽的Decode阶段分离,并分别部署在专用硬件资源池中。公司称,这种配置有望改善首字延迟、处理吞吐和基础设施成本效率。此次发布主要提出了一种推理系统架构,消息中未提
美国企业正逐渐放弃 Anthropic 最强大的模型 Fable 5,转而选择更便宜的替代产品。支付集团 Ramp 的支出数据显示,Fable 5 发布两个月后,企业对其支出仅占 Anthropic 工具总支出的约 11%,此后采用率趋于停滞。分析师认为,主要原因是定价过高,而旧款模型已经能够满足大多数需求。中国及其他地区的低价开放权重模型也为客户提供了更多选择。OpenAI 则凭借价格更低的新模
《纽约时报》报道了谷歌、微软和OpenAI试图影响美国学校及教育政策的做法,并关注教师对未经充分验证的人工智能工具日益增强的反对。2025年夏天,微软代表在曼哈顿市中心的一场会议上,向约200名教师介绍了公司的教育服务。
软银集团计划发行总额1万亿日元(约63亿美元)的零售债券,规模将创日本发行方同类债券之最。这也将是该集团今年第三次发行零售债券。部分募集资金将用于履行软银对OpenAI的财务承诺。
SuperCLUE发布了最新的手机端侧大模型评测结果。vivo蓝心BlueLM 3.5 Nano 3B以89.86分排名第一,据该评测,其表现接近多个主流云端模型。Qwen3.5 9B和Qwen3.5 4B分别以87.82分和85.16分位列第二、第三。端侧模型能够在手机本地处理文本和图像,无需持续联网,因而有助于提升隐私保护和离线使用能力。不过,手机硬件限制了模型规模,也限制了其处理复杂任务的性
谷歌表示,其开源模型家族Gemma的累计下载量已超过10亿次,开发者还基于该系列创建了超过10万个定制变体。Gemma目前被用于太空图像分析、医疗报告结构化和生物医学研究。谷歌DeepMind、谷歌研究院与耶鲁大学合作开发的Cell2Sentence-Scale 27B,可将单细胞基因表达数据转换为语言模型能够分析的类文本序列。该模型对4000多种药物进行了虚拟筛选,提出将CK2激酶抑制剂silm
据《金融时报》报道,美国企业正在减少对Anthropic高价旗舰模型Fable5的使用,转而选择更便宜的替代方案。追踪7万家公司支出的Ramp数据显示,Fable5发布两个月后,仅占Anthropic工具总支出的约11%,近期采用率也趋于平稳。规模更小、价格更低的Opus5,其企业支出已超过Fable5。分析师认为,主要原因是Fable5价格高昂,而多数企业使用旧模型已能满足需求。据报道,Anth
泰康保险集团发布了自研的照护与医疗专用大模型1.0版。该模型首先应用于社区养老,可自动生成老年人健康画像、按需求进行分组,并制定个性化照护方案。公司表示,该系统旨在将传统的被动呼叫服务转变为主动风险预警。未来,泰康计划将其扩展至居家养老领域的全天候健康监测。目前尚未公布该模型性能、安全测试结果或实际部署规模的独立评估。
华为宣布鸿蒙智家迎来秋季升级,新增多款鸿蒙智选智能家居产品、6 类快捷指令,以及智慧生活 App 的灯具 24 小时未关提醒功能。该系统采用“1+3+N”架构,包括家庭计算与连接中枢、触控、语音和传感器交互方式,以及覆盖网络、影音娱乐、安防、照明、能耗和家电等领域的子系统。
联想集团与海尔集团在北京签署战略合作协议,双方将围绕数据中心与算力基础设施、供应链协同、智能制造、工业互联网和智慧家庭等领域展开合作。联想计划推动 AI PC 及其他智能终端与海尔智慧家庭生态融合,打造结合设备、算力和服务的整体体验。双方还将探索家用机器人的联合研发,并整合算力、平台与产业场景。协议暂未公布具体产品、落地时间表或投资金额。
Guidelight AI Standards根据公开信息,评估了Anthropic、Google、OpenAI、Meta和xAI的AI失控遏制措施。OpenAI以5分满分中的3分排名最高,Anthropic和Meta得分最低。评估考察了监控、异常行为处置、第三方审计以及关闭失控模型的机制。不过,Guidelight表示,没有一家企业公开了完整的未来失控事件应急计划。随着AI智能体自主能力增强,美
AI模型聚合平台OpenRouter于8月20日发布匿名模型Ox Alpha。该模型主要面向代码编写、长时间运行的智能体任务和生产环境应用。据称,它拥有约104.8万token的上下文窗口、最高13.1万token的输出长度,并支持文本、图像和视频输入。预览期间,开发者可免费调用。开源编程智能体OpenCode也在同日接入该模型,并宣布每日最高可提供100万亿token的调用容量。在独立研究员针对
匿名模型Ox Alpha(中文社区称“牛来”)上线OpenRouter后迅速登顶模型榜单,并刷新单日使用纪录。包括Hermes Agent和Claude Code在内的前五大应用,对该模型的累计调用量已超过4万亿Token。OpenRouter将其定义为面向编码、持续性Agent任务和生产工作流的推理模型,但开发厂商仍未公开。技术分析发现,其Tokenizer等技术特征与智谱GLM系列较为接近;多
人形机器人天工 Omni 于8月22日在第二届世界人形机器人运动会小型组400米决赛中,以45.66秒夺冠。针对其跑步时像是在捂脸的特殊姿势,研发团队表示,这并非模仿某位女性或其他人类跑者。团队最初设计的是普通短跑模式,但机器人在仿真环境中通过数据持续迭代,可能自行判断“捂脸跑”比正常摆臂更舒适。天工 Omni 身高1.35米,重39公斤,未来面向狭窄空间、应急救援和家庭服务等场景。团队还开放了关
SK 海力士正利用英特尔 EMIB 等先进封装技术开发下一代 HBM,并计划未来转向 3D 集成。在 Hot Chips 2026 大会上,该公司介绍了 HBM4 路线图:容量最高 48GB,带宽超过 2TB/s,能效较 HBM3E 提升 40% 以上。带宽增长带来的功耗上升、散热、芯片翘曲和 TSV 占用面积扩大,仍是主要挑战。SK 海力士正在研究混合键合、更细间距互连,以及用于降低局部热点热阻