AI 新闻中心

AI 新闻中心 过去30天分析了 1957 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

爱奇艺 CEO 龚宇重申“All in AI”战略,推进向非中心化社交媒体转型

爱奇艺创始人兼 CEO 龚宇在近日举行的创作者大会上表示,平台将继续坚定推进 AI 战略,重点发展 AI 赋能实拍内容和 AIGC 影视长片制作。同时,爱奇艺将加快向以创作者和用户社区为核心的非中心化社交媒体模式转型。龚宇认为,AI 能显著降低内容制作成本和周期,并可能大幅增加创作者和作品数量。按照这一设想,播放器将更多作为基础组件存在,创作者可以自主上传作品,并通过会员、广告等方式直接变现。爱奇

Inject、Align、Recover:通过分阶段后训练在无检索条件下内化文档知识

该研究探讨大型语言模型如何内化固定文档集合中的知识,并在推理时不检索原始文档的情况下回答问题。研究提出了三阶段后训练框架IAR(Inject、Align and Recover)。Inject阶段将文档转换为结构化的续写、改写和指令条件重构目标;Align阶段使用仅监督答案的问答数据调整模型;Recover阶段则将领域适配模型与基础指令模型合并,以恢复通用能力。在Common Corpus和CCI

原生支持4K图像输出,商汤开源8B多模态模型SenseNova U1.5 Lite

商汤科技开源了轻量级多模态模型SenseNova U1.5 Lite,模型规模为80亿参数。该模型原生支持3K至4K上下文长度,可同时处理主体、数量、空间关系、文字、布局和风格等多重约束。商汤表示,模型提升了图像生成与编辑能力,包括构图、色彩、材质、光影、真实感、局部细节,以及对未编辑区域的保持效果。它还支持Bounding Box、Visual Marker以及单图和多图参考,以实现更精细的视觉

全新深蓝 G318 上市:搭载华为乾崑 ADS 5 Pro 与鸿蒙座舱,限时价 19.68 万元起

全新深蓝 G318 在 2026 成都车展上市,限时优惠价 19.68 万元起。新车搭载华为乾崑 ADS 5 Pro 智能驾驶系统,配备包括 1 颗舱内激光雷达在内的 27 个高感知传感器,支持城区通勤、高速行驶和智能泊车。座舱采用鸿蒙座舱 Harmony Space 5,提供车载大模型能力、自然语言交互和 10 种方言混说支持;导航 Agent 可根据模糊语音指令规划路线。新车配备 35.07k

长安马自达 EZ-60 激光版开启预售,支持高速与城区双域领航

长安马自达在中国开启 EZ-60 激光版预售。新车配备 1 颗激光雷达、3 颗毫米波雷达、12 颗超声波雷达和 11 颗高清摄像头。据官方介绍,车辆支持 200 多种安全辅助场景,并可在高速和城区提供辅助领航,涵盖变道、路口与环岛通行、匝道进出、避障和安全停车等功能。同时支持记忆泊车、循迹倒车和遥控挪车等辅助泊车功能。新车正式售价尚未公布。目前在售的 EZ-60 马年特别版售价 13.99 万元起

中国警方破获利用AI批量炮制小米负面文章的网络水军案

山西晋中网安部门抓获三名嫌疑人,指其通过50余家MCN机构运营7800余个实名认证账号。警方称,该团伙利用AI改写工具,批量编造涉及小米等企业的谣言和负面文章,以非法获取平台流量返利。警方已梳理关联账号9000余个、网络信息7万余条及资金流水5万余条。涉案账号在平台产生收益160余万元,三人涉嫌非法获利50余万元。三人因涉嫌非法获取公民个人信息,已被依法提起公诉。

Grok Build 正式登陆网页与移动端,向所有用户开放

xAI宣布,Grok Build结束早期测试,现已向所有套餐用户开放,并支持网页、iOS和Android。用户可通过自然语言生成应用、小游戏、网站和数据仪表盘。新版本支持创建grok.me公开链接、设置访问权限、在X上展示互动预览、二次改造已发布应用、将项目导出至GitHub,并接入xAI及第三方API。应用还可以连接业务数据,构建可筛选的动态仪表盘。该工具在实际生产开发中的价值,仍取决于具体场景

前摩托罗拉设备总裁 Sergio Buniac 将领导高通移动、计算与个人 AI 业务

高通宣布,2018 年起担任联想旗下摩托罗拉设备总裁的 Sergio Buniac 将于 9 月 2 日加入高通。他将出任执行副总裁兼移动、计算和个人 AI 业务集团总经理,负责智能手机、个人电脑、智能可穿戴设备和扩展现实等新一代 AI 设备相关业务,并直接向高通首席执行官 Cristiano Amon 汇报。这项任命强化了高通在 AI 设备领域的管理布局,但并未带来新产品或技术突破的发布。

Claude Platform 正式开放 Computer Use、Skills API 与 Files API

Anthropic宣布,Computer Use、Skills API和Files API已在Claude Platform正式全面可用。此次更新还推出Browser Use工具,可解析网页结构并直接操作特定输入框和按钮,相比仅依赖截图的方式更适合网页自动化。Computer Use现在支持在一次模型调用中执行多个连续动作。Anthropic表示,在签署商业伙伴协议(BAA)后,该功能可用于符合H

阿里云千问AI平台扩充模型矩阵,接入GLM-5.3与DeepSeek-V4-Pro

阿里云千问AI平台近日将智谱GLM-5.3和DeepSeek-V4-Pro正式版接入模型服务矩阵,并同步开放两款模型的API。GLM-5.3主要强化编程、长程任务执行和网络安全能力;DeepSeek-V4-Pro则重点提升智能体交互、软件开发及多步骤复杂任务处理能力。平台目前已聚合文本生成、代码开发、语音处理、图像生成和视频生成等领域的模型,涵盖通义千问、GLM、DeepSeek和Kimi等产品。

Repo0:设计驱动的从零到完整代码生成

Repo0 是一个根据自然语言需求生成完整软件项目的框架。它通过由需求层 DAG、组件层 DAG 及二者对齐关系组成的 Dual-DAG,显式维护项目架构,并利用模块化指标迭代调整代码仓库结构,直到架构收敛。随后,收敛后的架构会指导测试驱动的代码生成。在 6 个真实代码仓库上使用 GPT-5 mini 和 DeepSeek V3.2 进行评估时,作者报告称 Repo0 在所有测试设置中都取得了最高

4DAnyone:从普通单目视频中将任意人物重建为4D

4DAnyone是一种从未经标定的单目视频中重建4D人物的框架。系统首先生成适合重建且具有多视角一致性的视色视频,然后将其提升为4D Gaussian Splatting表示。该方法通过两项技术解决注意力上下文受限的问题:Reference Context Packing将不断增长的参考视角压缩为固定长度的上下文,Target Context Routing则在去噪过程中促进不同目标视角组之间的信