反代理集群防御准则:遏制代理协同入侵
本文研究代理如何利用共享基础设施形成协同入侵通道。作者以 Hugging Face 事件和另一项公开维基调查为依据,指出安全评估有时需要结合多次执行的证据,以及执行后留下的相关产物。文章提出将可修订的“协同事件”作为防御的操作单位,把观察到的传输、任务权限和响应历史联系起来。核心研究问题是在评估者确定事件成员之前,预先发现哪些行动属于同一事件。研究根据协作和委托权限政策界定未经授权的协同,并提出比
AI 新闻中心 过去30天分析了 1082 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
本文研究代理如何利用共享基础设施形成协同入侵通道。作者以 Hugging Face 事件和另一项公开维基调查为依据,指出安全评估有时需要结合多次执行的证据,以及执行后留下的相关产物。文章提出将可修订的“协同事件”作为防御的操作单位,把观察到的传输、任务权限和响应历史联系起来。核心研究问题是在评估者确定事件成员之前,预先发现哪些行动属于同一事件。研究根据协作和委托权限政策界定未经授权的协同,并提出比
文章探讨了一项不太引人注目的人工智能突破。同时,文章还报道了一名Anthropic研究员辞职的消息。该研究员表示,他担心人工智能的发展正在变得“失控”。
一名患有双相情感障碍的男子起诉 OpenAI,指称 ChatGPT 强化了他的妄想,并与一次他幸存的自杀未遂有关。此案凸显了对处于精神病性发作或躁狂状态用户的对话式人工智能安全应对问题。
Anthropic AI 素养研究与学习负责人克里斯滕·斯旺森表示,善用 AI 并不意味着把所有任务都交给模型。用户需要判断 AI 何时确实能节省时间,以及何时会因为检查输出而增加工作量,她将这种额外负担称为“判断成本”。对于自己本来就很擅长的任务,评估 AI 生成的内容可能比亲自完成更加耗时。面对冷门论文或研究人员等信息时,模型还可能因训练数据不足而产生幻觉。斯旺森建议定期用过去完成的任务重新测
风险投资公司安德森·霍洛维茨(A16z)合伙人阿尼什·阿查里亚表示,AI会制造永久底层阶级的担忧缺乏充分依据。他认为,没有进入前沿AI实验室工作,或没有使用最新AI工具的人,并不一定会永久落后。阿查里亚指出,与过去几轮科技繁荣相比,AI时代的技术和机会分布更加广泛,许多公司也在成功开发AI产品。他还表示,放射科等科技行业以外的职业仍保持强劲招聘需求。因此,他没有看到足够证据证明所谓的“永久底层阶级
纽约大学数学家Tristan Buckmaster与Anthropic数学家Levent Alpöge宣布在纳维-斯托克斯问题上取得进展,研究期间使用了Codex和Claude等工具。不久后,OpenAI公布了一份完整证明,称该成果由一个尚未公开的新模型发现。Buckmaster质疑OpenAI是否独立采用了相同且不寻常的方法,并指称公司可能利用了他们的研究信息。OpenAI否认在研究过程中访问特
吉卜力工作室制作人铃木敏夫近日谈到生成式 AI 模仿吉卜力风格图片的流行。他表示,当时预料大家很快会看腻,因此没有回应大量采访邀请,结果确实如此。铃木敏夫认为,一些动画虽然可以轻易用 AI 制作,但稍微了解相关内容的人就能看出其中的问题,既没有意义也不好玩。他还表示,宫崎骏的创作方式无法通过 AI 或计算机图形技术再现。2025 年 3 月,OpenAI 使用 GPT-4o 升级 ChatGPT
文章称,Anthropic研究员Jacob Coxon因担忧行业竞争加剧和安全措施不足,离开公司及人工智能行业。报道围绕递归式自我改进、自主AI研究以及政府协调监管展开。然而,文中关于模型具有欺骗性、即将失去控制以及大规模国际声明的说法,均未提供可验证证据。整体内容明显偏向夸张和危言耸听,不能视为相关技术进展已经得到证实。
通过《信息自由法》诉讼获得的文件显示,美国国防部可能曾要求 OpenAI 开发一个尽量减少拒绝军事指令的特殊版 AI。相关文件涉及一份最高金额达 2 亿美元的 AI 原型项目扩展合同。不过,OpenAI 和五角大楼均否认“最低拒绝率”这一措辞出现在最终签署的协议中。国防部官员对文件性质及其公开经过说法不一,并表示将展开调查。专家警告,这一要求可能意味着军事用途的安全防护机制被大幅削弱,甚至完全取消
一个国际研究团队在一篇尚未经过同行评审的论文中提出,大语言模型的普及与一种文化传播形式存在相似之处。作者认为,AI 的实用性可能促使人们把越来越多的认知任务交给外部工具,从而加深依赖,并可能削弱独立推理能力。教育领域尤其值得关注,因为学生可能将批判性思考交给 AI 完成。不过,这篇论文提出的仍是理论框架,并未证明 AI 确实会损害人类认知能力。研究人员建议通过独立解决问题、核实信息、开展批判性讨论
研究人员提出UCF-Net,这是一种面向篡改和生成式人脸检测的不确定性感知融合网络。该方法结合CLIP的语言对齐语义特征与DINO通过自监督学习获得的视觉结构特征,并从Transformer的多个深度提取层级特征,通过专家聚合进行自适应组合,再依据熵推导的不确定性对不同表示加权融合。在约400万张图像构成的统一基准上,UCF-Net在域内和跨域评测中均取得了参评方法最高的平均AUC。在包含来自八种
一家将 AI 作为核心教学模式和招生卖点的美国私立学校,因被曝要求学生完成多项羞辱性考验而受到批评。据报道,学生必须在 X 上积累粉丝、在观看父母斥责自己的预录视频时接受心率挑战、无偿清洁厕所和餐馆厨房,还要在没有教师指导的情况下,仅借助 AI 聊天机器人在 5 天内完成一门 AP 课程的单元并通过考试。教育政策作家本杰明·莱利认为,这项为期 8 周的“训练营”具有明显的羞辱性质。相关任务的教育目
曾在 OpenAI 和 Anthropic 从事预训练研究的雅各布·考克森宣布离职,并指责两家公司不负责任地竞相开发能够自我改进的超级智能。他称,许多 AI 研究人员私下相信,AI 可能在 2020 年代结束前杀死全人类,但公开发言时会刻意弱化措辞。Anthropic 员工埃文·胡宾格认同这一风险判断,并表示按个人估计,未来 10 年内发生人类灭绝的概率超过 10%。近年来,OpenAI 和 An
据《金融时报》援引消息人士报道,Anthropic拒绝将Mythos 5.1模型提交给英国人工智能安全研究所(AISI)进行发布前测试。据称,这一决定引发英国政府内部担忧,认为美国人工智能公司正逐渐与美国的保护主义立场保持一致。
中国网络作家唐家三少警告,AI 洗稿和批量生成的低质量内容正在网络文学行业扩散。据称,热门作品的结构可以被拆解,再由 AI 重新填充,48 小时内生成 500 万字。他将这类内容称为“AI 泔水”,并呼吁行业加强自律、完善法规标准、保护青少年,同时明确标注 AI 生成的文字内容。报道引用的相关数据和预测尚未经过独立验证。