AI 新闻中心

AI 新闻中心 过去7天分析了 596 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

腾讯发布 Hy Image3.5 预览版,支持文生图与多轮对话创作

腾讯发布图像生成模型 Hy Image3.5 预览版。该模型支持文生图、图生图、最多上传 5 张参考图、多轮对话创作、多种画面比例以及最高 2K 分辨率。腾讯称,Hy Image3.5 在数百名专业设计师参与的内部盲测中,表现较 Hy Image3.0 提升 30%,与 Seedream 5.0 Pro 持平,并略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。不过

将视觉语言模型的智能迁移到机器人控制

该研究探讨视觉语言模型(VLM)能否将数字世界中的能力迁移到实体机器人控制。RoboDawn为智能体式VLM提供了一组精简的离散指令,用于平移、旋转和夹爪操作。模型以闭环方式运行:观察机器人的视觉状态,推理并执行下一步动作,再根据执行结果调整后续决策。通过少量上下文示例,模型可以同时学习接口使用方法和任务解决策略。在RoboTwin 2.0 C2R上,成功率从零样本条件下的53.2%提升至单示例条

纯Go语言Agent框架covonaut v1.1.4发布:引入滚动并行调度与多模态读取

面向生产环境的纯Go语言Agent框架covonaut发布v1.1.4版本。该版本引入滚动工具执行池调度,解决慢工具阻塞并行任务的问题;支持多模态内容通道,可自动分流并处理文本、图片、PDF、Notebook及视频;增强了安全隔离,将删除操作对接系统回收站以防误删,并拦截危险命令。升级过程无需改动接口代码。

Snapchat 为 Lens+ 新增将聊天消息转换为歌曲等生成式 AI 功能

Snap 更新了 Snapchat 的 Lens+ 订阅服务,新增多项生成式 AI 功能。用户可以长按聊天消息,选择流行、摇滚等音乐风格,生成原创短歌曲,并在发送前试听。更新还包括可重新处理好友 Snap 内容的 AI Remix、提供泡沫和喷漆等纹理的 AI 增强字体、用于生成图像的 Imagine Lens,以及可将照片转换为 5 秒视频的 AI Clips。由于这些功能需要消耗大量服务器算力

从一到多,再从多到一:面向软件工程智能体的类别感知迭代式专家训练

该研究提出了一种改进人工智能智能体的方法,用于处理仓库级软件工程任务。由于将不同任务类别混合进行强化学习,可能导致部分类别进步、其他类别退步,研究人员首先训练各类别专家模型。Refresh-Repair-Expand迭代流程结合长期智能体强化学习、利用已验证的成功轨迹进行监督微调,以及自适应任务重选。随后,基于标签路由的多教师在线策略蒸馏将这些专家整合为一个可部署模型,只保留相对于参考策略的改进方

日本拟最早于2027年在国际空间站举办AI机器人竞赛

据《日经亚洲》报道,日本计划最早于2027年在国际空间站举办人工智能机器人竞赛。活动由今年7月成立、总部位于东京的太空AI机器人协会主办。参赛团队将先在地面空间站模拟设施中测试AI模型,晋级队伍可能在国际空间站的日本“希望号”实验舱参加决赛。参赛者需要开发用于控制球形机器人无人机Int-Ball2的“物理AI”模型。Int-Ball2专为低重力环境设计,可在空间站内拍摄照片和视频,协助宇航员完成相

荣耀亲选 AI 投影仪 Ultra 发布:1700 CVIA 流明、原生 1080P,国补后 1999 元

荣耀亲选 AI 投影仪 Ultra 已在中国京东开启预约,将于 9 月 28 日开售。产品原价 2599 元,政府补贴后到手价为 1999 元。该投影仪配备 1700 CVIA 流明亮度和原生 1080P 分辨率,支持 HDR10、HDR Vivid 及 4K 解码。AI 功能包括自动画面校准、自动对焦、梯形校正、自动避障、自动入幕和语音交互,AI 画质算法可逐帧优化图像。硬件方面,它搭载 2GB

小鹏开始推送搭载第二代 VLA 的 XOS 6.3.0

小鹏已开始推送 XOS 6.3.0,更新内容包括用于驾驶辅助和自动驾驶的第二代 VLA 系统。小鹏称,新版本将系统从 3D 空间识别提升至 4D 时空理解,并增强时序记忆、轨迹预测、决策和响应能力。第二代 VLA Lite 也同步推送,图灵 Max 车型正式升级至第二代 VLA。小鹏表示,X-Foresight 世界模型可预测周边交通参与者未来最多 6 秒的可能行为;Infini-VLA 长时序架

OpenAI被曝开发全天候协作的自主Agent

据知情人士透露,OpenAI正在研发一种能够代替用户操作浏览器及其他应用的AI。其计划中的功能或将对标GrokBot,后者可作为全天候在线的AI协作伙伴,处理日常事务、管理软件,并在后台运行工作流程。OpenAI还据称在内部讨论开发个人AI助手,以应对Meta的Muse。相关项目目前仍处于开发和讨论阶段,尚未得到官方确认。

AI长剧首次登上卫星电视,芒果TV押注“内容养AI”

芒果TV推出神话题材作品《后西游记》,并称其为首部登上卫星电视的AI长剧。该项目展示了芒果在AIGC领域的布局,包括自有内容厂牌、创作平台和大模型。芒果表示,公司并非单纯用AI生成内容,而是希望以长期积累的影视内容推动AI能力发展。其平台整合自研与外部模型,用于剧本分析、分镜生成、摄像机控制和制作团队协作。公司宣称生成式AI可显著降低制作成本、缩短制作周期,但相关数据主要来自企业自身披露。芒果当前

AI 编程平台 Bitrig 支持 iPhone Duo,推出交互式 3D 模拟器

AI 编程平台 Bitrig 已支持为苹果 iPhone Duo 构建和测试应用。该平台最初面向“氛围编程”,用户可通过文字或语音提示生成原生 SwiftUI 应用;目前已扩展至 Mac 应用、完整 Xcode 工具链、内置模拟器和真机测试。新推出的交互式 3D 模拟器支持折叠、倾斜和旋转设备,帮助开发者验证不同使用场景。开发者可使用 SwiftUI 的 onHingeChange,根据铰链状态调

IT早报:ZCode与MiMo-V2.6开源,Grok 4.7主打编程与知识工作

9月22日科技早报聚焦多项AI动态。智谱表示,针对ZCode安全问题的社区反馈,官方已完成整改并向所有用户道歉,同时宣布ZCode开源。小米发布MiMo-V2.6,提供Pro和Flash两个版本并公开模型权重;据小米称,Pro版目前在AA综合智能指数的开源权重模型中排名最高。SpaceXAI推出Grok 4.7,针对编程和知识工作进行优化,支持最多100万词元输入。月之暗面上线Kimi Code