AI 新闻中心

AI 新闻中心 过去24小时分析了 203 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

谷歌启动加密环境下的双盲人工智能评估试点

Google DeepMind 正在试行一套系统,将对专有人工智能模型的外部评估置于加密保护的环境中进行。该方法旨在减少基准测试污染,即模型或开发者提前了解测试内容并针对测试进行调整,同时保护知识产权。此举的目标是提高外部独立评估人工智能模型性能的可信度。

Adobe 开始测试 Photoshop“AI 辅助编辑器”:通过提示词编辑图像

Adobe 发布了 Photoshop“AI 辅助编辑器”测试版。该可选模式提供简化界面,用户可以通过自然语言提示词编辑图像。功能包括“提示词编辑”、移除背景、生成式扩展、生成式填充和图像放大。“AI 标记”允许用户在图像上大致选择或绘制区域,再用文字描述需要进行的修改。生成结果会创建为新图层,用户可以继续在辅助编辑器中调整,也可以返回传统 Photoshop 专业编辑模式。Adobe 还加入了基

雷鸟 iO AI 智能眼镜确认搭载恒玄科技 6nm BES2800 芯片

雷鸟宣布,智能眼镜 iO 将搭载恒玄科技 BES2800 芯片。该芯片采用 6nm 工艺,集成多核 CPU、大容量存储、双模蓝牙和低功耗 Wi-Fi 6。iO 支持实时提示和全天智记等功能,整机重量为 34 克,在中国的上市价格为 2349 元,政府补贴后为 1996.70 元。眼镜采用钛合金镜框、智能交互旋钮和波导显示方案,并支持最高 1000 度近视适配。

企业 AI 的真正风险不是自主智能体,而是智能体之间的复杂性

这篇由 Gravitee 赞助的文章认为,企业部署相互连接的 AI 智能体群,可能比使用单个自主智能体带来更大的治理风险。智能体可以调用 API、触发其他智能体,并访问原本未针对机器决策设计的系统,从而形成难以追踪的决策和行动链。文章指出,权限不断扩大、责任归属不清,以及无法看清下游操作,是主要问题。文章建议为每个智能体建立独立身份、限制权限、指定人类负责人,并采用实时监控和能在执行前阻止违规调用

能力问题:大语言模型的技能是否与语言无关?

一项研究考察大语言模型在不同语言中是否具备相同能力,并将语言影响与知识水平及通用基准测试表现区分开来。在多语言自我对弈实验中,同一模型的两个实例分别使用不同语言,在六种文本游戏中对战。模型、规则、状态空间和可用行动均保持不变。研究人员在八种语言上评估了三个开放权重模型,发现模型的对战能力、无效行动数量和策略倾向会因语言不同而显著变化。空间推理、基于卡牌的决策以及最优行动选择中都出现了特定语言的失误