豆包2.1 Pro 0915上线火山方舟,飞书8.0推出团队智能体
字节跳动已将豆包大模型Doubao-Seed-2.1-pro升级至0915版本,并在火山引擎火山方舟平台全面开放API。官方称,新版本强化了证据溯源、权威信源检索、信息时效判断和数据核验,面向多工具调用和长程智能体任务提升稳定性。同时,模型增强了对大型代码仓库的跨文件编程能力,并优化了图像、视频推理的Token效率。飞书8.0推出团队智能体“豆包工作伙伴”,可加入群聊,并在授权范围内调用文档、会议
AI 新闻中心 过去30天分析了 2439 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
字节跳动已将豆包大模型Doubao-Seed-2.1-pro升级至0915版本,并在火山引擎火山方舟平台全面开放API。官方称,新版本强化了证据溯源、权威信源检索、信息时效判断和数据核验,面向多工具调用和长程智能体任务提升稳定性。同时,模型增强了对大型代码仓库的跨文件编程能力,并优化了图像、视频推理的Token效率。飞书8.0推出团队智能体“豆包工作伙伴”,可加入群聊,并在授权范围内调用文档、会议
香港行政长官李家超公布了2026年至2030年发展规划,将人工智能列为未来战略产业。香港计划通过沙岭数据园区等项目扩充算力基础设施,检视支持人工智能和数据应用的法律框架,并帮助中小企业采用AI。在“全民AI”普惠计划下,香港预计在2028年第一季度前推出超过200项培训课程和活动,涵盖AI素养与负责任应用。此外,香港将规划具有战略意义的跨境自动驾驶示范项目,推动相关技术规模化和商业化发展。目前公布
中国电商平台得物在11周年全员信中表示,将在AI时代升级组织分工,让团队对更完整的业务结果负责。公司称,AI正在降低标准化工作的执行门槛,使同一团队能够独立掌握更多业务环节,从而缓解过度细分的传统分工。不过,得物认为,真正拉开差距的仍是理解用户、判断趋势和推动具体事项落地的能力。公司计划把资源投入到尚未被充分满足的细分需求,并通过真实用户反馈验证方向。今年“520”期间,得物送礼订单同比增长超过4
TypeSafe AI推出了Jev,这是一款利用“面向校准决策的强化学习”生成类型化概率决策的模型,软件可以直接处理其输出。Jev并非聊天机器人,而是生成带有概率估计的结构化决策。这家初创公司目前已获得4000万美元融资。
火山引擎宣布将豆包 2.1 Pro 更新至 0915 版本,并通过火山方舟 API 全量上线。此次更新面向企业生产场景,官方称重点提升了 Agent 的证据溯源、权威信源检索、时效判断和数据核验能力,同时增强多模态 Coding、图像与视频理解,以及复杂代码仓库分析能力。模型可据称读取设计稿、工程图纸和操作录屏,将视觉信息转换为前端代码或游戏逻辑。豆包工作、TRAE 和 Doubao-Seed-E
中国移动发布了 Open-RAIL,这是一个用于连接视觉-语言-动作(VLA)、全身控制(WAM)模型与实体机器人的开源工程平台。平台通过轻量级硬件抽象层,统一机器人控制、状态读取和动作执行,使模型推理、真机运行、数据采集和模型迭代形成闭环。据介绍,Open-RAIL 目前已适配 4 款异构机器人和 10 个主流 VLA/WAM 模型。新机器人接入时间可由数周缩短至数小时,新模型通常只需 50 至
华为宣布启动“小艺 Work”内测,定位为面向日常办公、代码开发和创意创作的 AI 工作助理,支持鸿蒙及 Windows 系统。该服务可自主拆解任务、调用工具并推进执行,支持手机、平板等移动端远程下发任务、查看进度并接管多台电脑。在底层算法上,该服务融合了 DeepSeek、华为云盘古、MiniMax、智谱 AI 及月之暗面(Moonshot)等多家大模型。会员数据保留规则根据付费情况有所不同,其
在 2026 vivo 开发者大会上,vivo 宣布应用商店开放个人开发者通道。开发者只需完成个人实名认证即可申请。AI 应用、蓝河应用和 IoT 应用将按计划逐步开放。vivo 表示,AI 已大幅降低应用开发门槛,开放个人开发者通道有望让更多创新产品被用户发现。
在 2026 vivo 开发者大会上,vivo 发布了 OriginOS 7。全新的 vivo 输入法能够理解当前聊天上下文,并根据对话内容提供候选结果。例如,朋友要求发送身份证时,输入法会直接推荐“身份证”,用户无需退出聊天或手动输入,即可搜索并发送。在群聊中,输入法还可以理解用户不熟悉的话题,弹出相关搜索词,帮助用户更快了解内容。
苹果详细介绍了 iPhone 18 Pro 和 iPhone 18 Pro Max 上的 Apple Reference Image 功能。可选的 Reference 模式会在拍摄时通过 Secure Enclave,为焦段、数字变焦等关键元数据签名,并嵌入加密时间戳。该系统旨在证明图像来自真实传感器,并提高后续篡改的难度。苹果还将通过包含 Private Cloud Compute 的验证链确认
在 2026 vivo 开发者大会上,vivo 宣布全面升级蓝心大模型,并发布四款核心模型:负责语音理解的 Blue LM-RealTime、负责端侧感知与个人记忆的 Blue LM-Nano,以及面向云侧复杂任务执行的 Blue LM-Flash 和 Blue LM-Pro。vivo 表示,语音模型能够应对嘈杂环境、轻声说话、不同口音、连续表达以及中英文混说。端侧模型可融合处理屏幕内容、图像、视
天眼查最新数据显示,中国现有工业大模型相关企业已超过6.2万家。自2026年初以来,约有2.23万家相关企业完成注册。广东、江苏、浙江、上海和北京的企业数量位居前列。分析认为,这些地区在电子制造、装备制造、软件服务和人工智能研发方面具备长期积累的产业基础,因此形成了较高的企业集聚度。需要注意的是,企业注册数量只能反映市场主体增长,不能直接证明相关企业的技术成熟度、商业化进展或工业大模型的实际应用规
PhysStream是一种用于物理基础图像到视频生成的自回归模型。它利用从此前生成帧中在线提取的位置图和物体跟踪图,并通过表示速度增量的稀疏信号控制具有物理意义的运动。该模型采用两阶段训练,可在生成包含多个桌面刚体物体的场景过程中进行交互式控制。在合成基准测试中,与最强基线方法相比,PhysStream将运动分布距离降低33%,将轨迹误差降低12%。在真实场景比较中,人类评审在超过85%的情况下更
研究人员推出 ModAR,这是一种在预测机器人动作之前,自回归生成多种未来模态的世界动作模型,包括点轨迹、DINO 特征和深度图。每次预测都可以基于此前生成的模态,因此相比仅预测未来 RGB 图像,能够更高效地捕捉几何、语义和运动信息。在所有测试数据规模下,ModAR 都优于现有世界动作模型方案,观测到的平均成功率达到 75%,高于以视频模型初始化的 Flex-π 的 72%。同时,ModAR 无
在 2026 vivo 开发者大会上,vivo 发布了 OriginOS 7。该版本新增“截屏直达”功能,利用 AI 自动识别截屏中的券码和票券信息。用户订票后截图,AI 会识别取餐码并将其存入卡包,临近限期时还会通过原子通知和智能建议进行主动提醒。