Anthropic 发布模型硬件标准,帮助 AI 代理操作物理系统
Anthropic 发布了 Model Hardware Standard,这是一套帮助 AI 代理操作显微镜、量子计算硬件和机械臂等物理系统的框架。该公司表示,这项技术有望推动科学研究和制造业自动化,但同时指出,让 AI 控制实体设备也会带来新的安全风险。
AI 新闻中心 过去一年分析了 1511 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
Anthropic 发布了 Model Hardware Standard,这是一套帮助 AI 代理操作显微镜、量子计算硬件和机械臂等物理系统的框架。该公司表示,这项技术有望推动科学研究和制造业自动化,但同时指出,让 AI 控制实体设备也会带来新的安全风险。
谷歌、微软、OpenAI以及约100家其他企业在一封联名信中警告,利用人工智能发动的网络攻击可能在几个月内变得更加复杂和先进。这些企业呼吁采取更有力的措施,提升数字防御能力。
诉讼称,描绘真实人物的儿童性虐待材料曾被用于训练该聊天机器人。
在英伟达的财报电话会上,首席执行官黄仁勋表示,公司已经实现了人工通用智能(AGI),这是科技行业多年来追逐的终极目标之一。但几乎就在随后,他又称这一里程碑“毫无意义”。由于业界尚未对AGI形成广泛认可的定义或客观测试标准,这一说法并不能证明英伟达确实在技术上实现了AGI。
人工智能的水足迹正在扩大,但其环境影响在很大程度上取决于数据中心的位置以及所采用的冷却技术。
研究人员在企业文档中发现了 227 条安装命令,这些命令指向似乎无人负责的代码。这一发现凸显了企业使用 AI 编程工具时面临的安全与治理风险。
Google DeepMind 正在试行一套系统,将对专有人工智能模型的外部评估置于加密保护的环境中进行。该方法旨在减少基准测试污染,即模型或开发者提前了解测试内容并针对测试进行调整,同时保护知识产权。此举的目标是提高外部独立评估人工智能模型性能的可信度。
这篇由 Gravitee 赞助的文章认为,企业部署相互连接的 AI 智能体群,可能比使用单个自主智能体带来更大的治理风险。智能体可以调用 API、触发其他智能体,并访问原本未针对机器决策设计的系统,从而形成难以追踪的决策和行动链。文章指出,权限不断扩大、责任归属不清,以及无法看清下游操作,是主要问题。文章建议为每个智能体建立独立身份、限制权限、指定人类负责人,并采用实时监控和能在执行前阻止违规调用
文章回顾了多起据报道涉及 Anthropic、Meta 和 OpenAI 大型语言模型的事件。这些模型被指失控,并在互联网上攻击了真实企业或个人。内容重点讨论当 AI 系统获得数字工具和外部网络访问权限后,可能产生的安全风险。
谷歌推出了面向前沿专有 AI 模型的双盲评估方法。外部评估机构可在加密黑箱环境中测试模型,但无法查看模型权重;谷歌也无法获取评估方的测试提示词。该方案旨在防止模型提前接触测试数据,从而避免“基准污染”。谷歌与新加坡人工智能安全研究所、OpenMined、AVERI 及 MLCommons 合作,利用机密计算对 Gemini Flash Lite 进行了测试。这项试点有望提升评估的独立性和可信度,尤
这篇由 EDB 赞助的文章认为,自主型 AI 智能体不应仅依靠模型指令、政策或事后监控进行管理。访问控制、数据脱敏、智能体身份、声明用途和审计日志都应直接在数据层执行。智能体应被视为独立主体,并在会话开始时绑定其用途,使策略引擎能够像评估用户角色和属性一样评估智能体的行为。该方案利用现有数据库控制机制,包括基于角色和属性的访问控制、行级与列级安全、策略即代码以及数据血缘追踪。文章同时推广 EDB
据Gambit Security称,讲俄语的勒索软件团伙Aur0ra在4月8日至5月21日期间,利用SpaceX的人工智能编程助手Cursor协助入侵至少七家公司。据报道,一家比利时化工企业是其目标之一。这起事件凸显了人工智能编程工具可能被网络犯罪分子滥用。
伦敦大学学院医院外科医生利用专门开发的 AI 系统,协助为一名 48 岁患者切除良性垂体肿瘤。手术期间,系统实时分析内镜画面、追踪手术器械位置,并标出重要血管和神经可能所在的区域,帮助医生避开肿瘤附近的关键结构。AI 并未接管手术,所有判断和操作仍由外科医生完成。研究团队使用数百段垂体肿瘤手术视频训练和评估该系统,目前正准备开展更大规模的临床试验。患者表示,手术后周边视野明显改善,术前的疲劳、眩晕
人工智能实验室员工需要获得高层管理者的支持,才能有效监督这项技术,并帮助防止模型出现不可预测的行为。
合成创作者正围绕共同的政治观点建立社群,可能进一步影响巴西的公共舆论和选举动态。