AI 新闻中心

AI 新闻中心 过去30天分析了 2440 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

联发科发布天玑 9600 Pro:采用 2nm 工艺,配备 4.55GHz 双超大核

联发科发布了新一代旗舰 5G 智能手机芯片天玑 9600 Pro,并将其定位为集成 AI 能力的旗舰平台。据联发科介绍,该芯片与台积电联合开发,采用行业首批 2nm 制程,搭载超过 330 亿个晶体管。其配备最高 4.55GHz 的双超大核、新的神经网络渲染 GPU 架构和升级版 NPU。相比天玑 9500,联发科宣称天玑 9600 Pro 在 CPU、GPU 性能、功耗和端侧语言模型处理方面均有

Lady Gaga未婚夫用人类皮肤数据训练AI

Lady Gaga的未婚夫、Outer Bio联合创始人兼董事会成员迈克尔·波兰斯基,正在开发用于研究人类皮肤的平台。Outer Bio成立于2020年,利用Yuna平台让捐赠的人类全层皮肤在体外维持活性,最长可达四周。研究人员会反复分析样本,研究伤口愈合、色素形成、慢性炎症、衰老和皮肤屏障等问题。公司使用这些数据训练预测型AI模型,以判断不同化合物对人类皮肤可能产生生物活性或毒性作用。波兰斯基表

深度解析:机器人的端侧与数据中心推理

SemiAnalysis分析了在机器人上运行人工智能推理的技术和经济要求。报告涵盖机器人模型、部署情况、供应链、芯片与DRAM效率,以及Jetson Thor与B300的总拥有成本比较。报告还讨论了“网络墙”问题,即延迟、带宽和连接能力等限制如何影响端侧处理与数据中心推理之间的取舍。

LynnReal-Omni:面向智能体视觉工作流的原生多模态视频生成

LynnReal-Omni是一套多模态视频生成框架,通过共享的扩散Transformer统一处理文本、图像、外观参考、结构控制、可编辑3D场景和游戏状态等输入。其320亿参数模型支持文本生成视频、图像条件生成、参考引导生成、视频编辑、低质视频修复以及长视频生成。研究团队还推出了面向实时渲染的270亿参数模型LynnReal-Omni-Flash。配套的数据处理流程和MSAVP评测方案用于衡量指令遵

新型脑机接口首次同步解码语言与肢体动作

加州大学旧金山分校研究人员开发出一种脑机接口,可同时解码瘫痪患者预期的语言和上肢动作,研究成果发表于《Nature Neuroscience》。团队将薄型电极阵列植入3名因肌萎缩性侧索硬化症或脑干中风而瘫痪患者的感觉运动皮层。其中2人的脑活动被转换为控制全身虚拟化身的指令,虚拟化身能够同步呈现说话、面部表情和手臂动作。研究人员发现,同步表达产生的脑信号不同于单独语音或手势产生的信号,因此使用同步任

阶跃发布 StepAudio 3 系列语音大模型,称在多项全球基准中排名第一

中国 AI 公司阶跃发布 StepAudio 3 系列,包含 StepAudio3Realtime、ASR、TTS、Gen 和 Music 五款模型。公司称,多款模型在 Artificial Analysis 榜单中位列全球第一。该系列覆盖实时语音交互、语音识别与合成、完整音频内容生成和音乐创作。StepAudio3Realtime 支持原生全双工对话、用户打断、推理与语音生成并行,以及不阻塞当前

比尔·盖茨:各国政府尚未准备好应对人工智能带来的社会变革

比尔·盖茨警告称,全球没有任何一个国家的政府已经充分准备好应对人工智能可能带来的社会变革。他指出,AI可能冲击就业,被用于发动攻击,也可能导致人们对AI陪伴程序产生依赖。尽管存在这些风险,盖茨仍认为AI在医疗、教育、农业以及药物和疫苗研发领域具有巨大潜力,有望帮助缩小贫富差距。盖茨基金会计划在未来两年投入至少10亿美元,扩大人工智能的普惠应用,并支持相关数据基础设施建设,包括帮助大语言模型适配更多

微信回应小微AI隐私争议:不会读取用户已删除的朋友圈

微信否认网络流传的“小微直接读取聊天记录、窥探用户隐私”等说法。小微是微信团队开发的原生AI助手,目前仍处于小范围内测阶段,支持文字和语音交互,可查询天气、快递、外卖,并在微信内完成内容总结。微信表示,小微能够接触的信息不会超出用户本人可查看的范围,也不会读取已删除的朋友圈。在聊天场景中,只有用户主动发起询问时,小微才会临时调用指定聊天记录进行分析;处理完成后,原始记录将被丢弃,不会留存。此次回应

构建面向生产环境的希腊语—英语语音识别系统

一项持续数月的工程计划介绍了 Sophea,这是一个面向生产环境的希腊语和英语双语自动语音识别系统。团队围绕词错误率、语言识别能力以及在非语音音频上的幻觉现象,设置了九项生产标准进行评估。在 23 次训练迭代中,没有任何训练数据配置同时通过全部九项标准。由三个模型组成的 ROVER 集成系统通过了全部标准,并将重叠语音场景下的词错误率相对降低 29%。另一个模型在八个公开英语测试集上的平均词错误率

微信员工辟谣:AI助手小微不会直接读取聊天记录或偷看所有隐私

微信员工就正在小范围内测的AI助手“小微”回应了隐私疑虑。小微支持通过文字或语音查询天气、查快递、点外卖,也可在朋友圈、公众号、聊天和视频号等场景中总结内容。微信方面表示,小微能接触的信息不会超出用户本人有权查看的范围。在聊天场景中,只有用户主动发起“问小微”并指定聊天内容时,微信客户端才会在本地临时读取并分析相关记录,原始聊天记录不会被保存。对于“小微会直接读取聊天记录”“偷看所有隐私”等说法,

联发科高管:Token经济时代来临,AI智能体将推动Token消耗增长

在联发科2026年旗舰产品发布会上,联发科技董事兼首席运营官陈冠州表示,生成式AI和所谓的Token经济将影响下一代芯片的发展。随着AI从云端扩展到智能手机等终端设备,端侧AI预计将成为重要发展方向。陈冠州预测,到2030年全球Token消耗量可能增长超过24倍,达到每月约120,000万亿个Token。相关数据属于公司预测,尚未经过独立验证。

AlayaVista:从全景状态到透视视频的流式世界建模

AlayaVista是一种可由摄像机控制的流式视频世界模型,旨在保持广泛的场景上下文,同时生成高保真的透视视图。系统从单张透视图像出发,利用预训练的全景扩展模型构建360度场景先验,并将其作为受摄像机条件控制的全景潜在状态持续演化。潜在视口渲染器将该状态转换为指定视角的视频潜在表示,透视细化模块则负责恢复细节、抑制伪影并进行超分辨率。为实现高效流式生成,研究团队将全景生成改造为分块自回归生成,并将