恶意指令加密后,Grok可能泄露用户数据
据报道,一种名为“加密上下文注入”的新攻击方法可以绕过大型语言模型的安全防护。报告称,当恶意指令经过加密后,Grok可能泄露用户数据。该技术再次表明,大语言模型的安全控制机制仍可能存在漏洞。
AI 新闻中心 过去一年分析了 1507 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
据报道,一种名为“加密上下文注入”的新攻击方法可以绕过大型语言模型的安全防护。报告称,当恶意指令经过加密后,Grok可能泄露用户数据。该技术再次表明,大语言模型的安全控制机制仍可能存在漏洞。
OpenAI多年来一直在开发能够像人类一样操作电脑和浏览器的AI智能体。公司员工称,这项功能正接近向客户逐步开放。相关训练使用了屏幕数据、真人示范,并可能结合强化学习。较新的系统不仅能分析屏幕截图,还能读取网页结构、无障碍信息和链接,从而执行数据录入、合规工作和日程安排等任务,也能让Codex自行测试并修改生成的代码。不过,这项技术在任意网页、应用程序和操作系统上的速度与可靠性仍有限,处理邮件和社
8月,Toru Hinkle在Target门店整理货架时注意到两名顾客,并询问他们是否需要帮助。两人要求核实一件商品的价格。尽管Hinkle告知他们商品售价为20美元,顾客仍反复询问价格。文章探讨了Meta智能眼镜如何给职场互动带来问题,并引发隐私方面的担忧。提供的文章节选在句子中途结束,因此没有呈现完整事件或结论。
皮尤研究中心的一项新调查考察了美国人如何看待人工智能对社会、就业和创造力的影响。尽管人们通常认为年轻一代更能适应人工智能,但许多人,尤其是Z世代,越来越担心人工智能可能取代他们的工作。这项调查于6月进行。
随着 ChatGPT 逐渐成为新的搜索工具,需要额外防护措施的可能不只是青少年。OpenAI 于 8 月 18 日宣布推出青少年版 ChatGPT,提供更强的安全保护、家长控制功能以及更符合年龄的回答。文章认为,类似的防护机制也可能帮助老年用户更安全地使用 ChatGPT。
人工智能可以提升领导者的沟通能力,但真诚、文化意识、判断力和信任仍应从根本上由人类来承担。
阿里巴巴发布了 Qwen-UI-Agent,这是一款面向手机、电脑、网页浏览器和 DeepSearch 环境的 GUI 智能体基座模型。据介绍,该模型在 MobileWorld、OSWorld、WebArena 和 ScreenSpot-Pro 等基准测试中达到领先水平。阿里巴巴表示,模型使用 100 多台真实手机和 150 多个应用构建训练与评测环境,并推出了真机基准。Qwen-UI-Agent
币安推出 Agent OS,允许 AI 代理与 ChatGPT、Claude Code 和 Cursor 等工具配合进行交易操作。不过,限制代理权限、监督其行为并控制风险的责任,主要仍由用户承担。
哲学家尼克·博斯特罗姆很早就开始研究人工智能带来的生存风险。在《深度乌托邦》一书中,他转而思考另一种可能:如果人工智能和机器人能把所有事情都做得比人类更好,人类将如何寻找生活的意义与满足感?他讨论了理解人工智能未来的两种不同路径,以及当前可以采取哪些措施,以提高人工智能真正改善人类生活的可能性。
最近,ChatGPT似乎比以前更频繁地使用脏话,其他用户也注意到了类似现象。文章探讨了聊天机器人措辞变化的可能原因,但目前主要依据个人观察,尚无确凿证据表明其底层模型发生了根本性改变。
企业能否成功使用人工智能,将越来越取决于是否把治理和韧性战略纳入业务规划。过度依赖单一或少数人工智能供应商,可能危及运营连续性,并限制组织应对变化的能力。
IDC发布中国生成式AI安全评估平台市场评估报告,将蚂蚁数科列入领导者类别。报告指出,除提示词攻击和敏感信息泄露外,企业还面临工具滥用、智能体越权执行以及多智能体协同攻击等新型风险。蚂蚁数科的蚁天鉴平台据称可覆盖大语言模型和智能体的全生命周期,提供评测、防御、监测和修复能力。公司表示,其AI安全服务已覆盖超过100家金融机构。IDC预计,企业AI安全将从一次性测试逐步转向覆盖开发、部署、运营和治理
Nieman Lab 介绍了 Google DeepMind 的实验性 AI 工具 Backstory,该工具旨在帮助验证图像真伪。目前,记者、研究人员和其他事实核查人员可以试用这一工具。Backstory 希望协助核查每天在社交媒体上传播的大量虚假或误导性图像。
北约计划利用人工智能辅助无人机加强东部防御。不过,这些系统不得在没有人类监督的情况下自行攻击目标。
OpenAI 将面向符合条件的前沿模型 API 客户扩展零数据留存服务。请求处理完成后,提示词和模型回复不会被保留,员工无法审阅客户内容;除非客户明确选择加入,企业数据也不会用于模型训练。OpenAI 正在测试“私密安全处理”(Private Safety Processing),利用自动化系统识别跨多轮交互、跨账户以及持续试探安全机制所形成的风险模式。内容可以保存在客户自行控制的基础设施中,也可