AI 新闻中心

AI 新闻中心 过去30天分析了 2436 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

FLAT将图像和文本重采样为用于检索与生成的灵活一维多模态Token

FLAT是一种多模态表征学习框架,将图像和文本映射到共享的连续一维序列空间中。不同于依赖冻结视觉嵌入的传统流程,FLAT联合训练多模态编码器,以及文本到图像和图像到文本解码器。通过使用长度可变的前缀Token,模型能够灵活调整表征长度。FLAT支持跨模态检索与生成,在文本到图像生成任务中取得83.1的GenEval得分,在图像描述任务中取得40.5的BLEU-4和138.6的CIDEr,并在MS-

OmniHarness:通过符号策略学习实现可泛化的视觉生成

OmniHarness是一种利用多模态大语言模型和视觉智能体提升视觉生成泛化能力的框架。它将经过验证的执行过程抽象为符号策略,保留可复用的流程和适用条件,同时移除特定实例的输入。执行过程中的中间验证可用于策略改进和失败恢复。在下游目标确定前,系统还会自主生成并执行接近自身能力上限的练习任务。在六项基准测试、三种多模态模型骨干和三种视觉智能体框架上的实验中,OmniHarness在ComfyBenc

iOS 27:在相机应用中使用视觉智能

苹果在 iOS 27 的相机应用中加入了新的 Siri 模式。该功能利用视觉智能识别植物、动物、食物等物体,并提供相关信息,例如热量估算。它还可以拍摄活动传单并将日期添加到日历、翻译文字、分摊账单,以及回答有关画面内容的问题。用户还可直接搜索 Google 图片或提出自定义问题。iOS 27 已于 9 月 14 日面向支持的 iPhone 发布。

利用人工智能交友应用实施的性感骗局出现了

安全研究员Matthew“Zigula”Gore-Kormanik在分析一款名为Dora的欺诈交友应用时,弹窗显示Jennifer正在打来电话。根据她的个人资料,她是一名41岁的射手座女性,有红发、蓝眼睛和穿孔,喜欢音乐、恐怖电影、夜生活和体育。Gore-Kormanik接听了电话。这一事件表明,人工智能交友应用可能被滥用,以使情感骗局显得更加可信。

华为预测到2035年全球年度Token消耗量将增长10万倍

华为发布《智能世界2035:从愿景到行动》报告,预测到2035年全球年度Token消耗量可能增长10万倍,其中智能体流量占比将超过90%。报告认为,行业需要更大规模的算力集群、更高效的Token处理架构、新型存储与记忆系统,以及面向智能体的操作系统;芯片、散热、自动驾驶和AI安全技术也需同步发展。华为与清华大学相关研究机构还发布了《全球数智化指数(GDII)2026》,预测未来五年人工智能将累计创