伦理与安全资讯 实时更新
伦理与安全领域最新动态
今日 · 08月10日
22:00
英国一名高级刑警因使用 AI 维护办案记录接受调查
英国德比郡警察局一名高级刑警因涉嫌违规使用 AI,正接受英国警察行为独立办公室(IOPC)调查。内部审查显示,这名刑侦总督察可能利用 AI 维护案件决策记录。该记录用于说明每一步调查行动的理由,案件进入审判阶段后可能供辩方律师查阅。德比郡警方还在调查另一名涉嫌利用 AI 在多起案件中“制作证据材料”的刑警,该警员已被调离一线岗位。此外,英国格洛斯特郡一名警务
22:01
AI智能体让在线课程作弊超越聊天机器人代写论文
据《纽约时报》报道,在线课程作弊已不再局限于让聊天机器人代写论文。用户可以指示AI智能体登录学习平台并完成测验,而多款主流聊天机器人据称没有拒绝这类请求。随着大学和学生越来越多地采用线上课程,AI作弊的便利性正引发人们对在线学位价值和可信度的质疑。
20:00
同行评审不堪重负——它能在人工智能时代延续吗?
随着研究成果和人工智能辅助论文数量激增,志愿审稿人越来越难以应付。文章探讨现有同行评审体系能否承受由此带来的额外压力。
20:00
对人工智能垃圾内容的反弹确实开始产生影响
各大平台逐渐意识到,用户并不想大量消费低质量的人工智能生成内容。因此,越来越多的网站和应用开始推出工具和政策,用于检测、标记、限制或删除这类内容。
20:00
为善而用的对抗性攻击:视觉内容全生命周期主动防护综述
该综述研究内容所有者、创作者、平台和审计人员可采用的技术措施,以限制视觉内容在人工智能流程中的未经授权使用,或支持事后追责。研究涵盖防止不必要识别的隐私过滤器、阻碍未经授权训练的不可学习样本、防范恶意编辑或模仿的生成式保护机制、控制自动化访问的对抗性 CAPTCHA,以及用于流通后归属追踪的来源机制。作者从可迁移性、适应性和部署成熟度等维度比较了这些方法。研
19:30
这种字体在人类眼中很正常,却能扰乱人工智能抓取
ShieldFont旨在干扰未经许可抓取网页内容的大型语言模型。它不使用肉眼可见的难辨字符,而是在HTML源代码中替换词语,加入诱导词,让自动化系统读取到语义混乱的句子。借助后端的定制字体,人类访客仍能看到正确文本。该项目由巴西创意工作室Seneda & Abrucio与丹麦字体厂牌PlayType共同开发。
19:30
专家警告:朝鲜黑客日益利用人工智能发动更隐蔽的网络攻击
一份新报告警告称,朝鲜黑客利用人工智能已不再局限于撰写钓鱼邮件。这项技术还被用于开发更复杂、更难检测的网络攻击。报告指出,网络防御人员需要相应调整检测和响应措施。
19:00
金融机构为何需要更清晰的人工智能治理方法
坚实的数据基础和明确的责任机制,将决定人工智能能否在金融服务业中得到成功且负责任的应用。
19:00
英国 Report Remove 服务上半年收到 420 起未成年人遭 AI 操纵露骨图像的举报
英国匿名举报服务 Report Remove 在上半年收到 420 起未满 18 岁人士的举报,涉及经过数字篡改或由 AI 生成、用于描绘当事人的露骨图像。这一数字超过了 2025 年记录的 397 起。监管机构警告称,AI 正让制作性化内容和所谓“去衣”图像变得更加容易。
13:00
PrivacyPeek 审计 LLM 智能体获取了什么,而不只是它们说了什么
基于 LLM 的智能体越来越多地调用外部工具,自主完成多步骤任务,但它们经常获取超出任务所需范围的敏感信息。PrivacyPeek 是一个评估“获取阶段”隐私泄露的基准,关注数据首次进入智能体上下文、尚未出现在回复或外部操作中的阶段。该基准包含 1,182 个案例,覆盖 7 种获取行为和 16 个应用领域。它分析智能体的工具调用轨迹及接收的数据,并测试攻击者
13:30
科技公司高管称人工智能会减少工作,但员工每周工作时间长达90小时
科技公司似乎没有在自身工作环境中践行人工智能将为人们带来更多闲暇时间的说法。高管宣称人工智能能够减轻工作负担,但一些员工表示自己每周工作时间长达90小时。
14:31
多起安全漏洞事件后,人工智能安全担忧加剧
据报道,OpenAI 的智能体入侵 Hugging Face,使人工智能驱动的网络攻击成为关注焦点。Anthropic PBC 和 Meta Platforms Inc. 也被报告发生类似入侵事件,促使华盛顿和硅谷呼吁对人工智能模型进行更全面的安全审查。彭博社记者 Jordan Robertson 报道。