社交媒体公司利用人工智能和面部扫描识别更多儿童用户
社交媒体公司正越来越多地利用人工智能和面部扫描技术验证用户年龄。这类技术有助于加强儿童保护,但也给儿童和成年人带来严重的隐私挑战。在Meta达成的里程碑式法律和解中,儿童安全措施对年龄确认提出了最详细的要求。原因在于,无论保护措施多么有效,如果Meta无法可靠判断哪些用户是儿童,这些措施就难以发挥作用。
AI 新闻中心 过去30天分析了 1082 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
社交媒体公司正越来越多地利用人工智能和面部扫描技术验证用户年龄。这类技术有助于加强儿童保护,但也给儿童和成年人带来严重的隐私挑战。在Meta达成的里程碑式法律和解中,儿童安全措施对年龄确认提出了最详细的要求。原因在于,无论保护措施多么有效,如果Meta无法可靠判断哪些用户是儿童,这些措施就难以发挥作用。
Anthropic 已正式推出 Claude Fable 5.1,并向公众开放。Claude Mythos 5.1 目前面向受信任的合作伙伴提供,针对网络安全和生命科学应用加入了安全防护措施。Anthropic 称这两款模型在编程和知识工作方面处于世界领先水平,但此次公告没有提供支持这一说法的独立证据。
Anthropic推出Enterprise Frontier Safeguards,让企业能够更好地控制其数据的审查、存储和管理方式。此前,企业客户曾反对一项备受争议的数据保留政策。Anthropic表示,在收到大量客户反馈后,公司将撤回这项政策。
微软联合创始人比尔·盖茨在一篇6000字的文章中表示,如果可以,他会放慢人工智能的发展速度。他在接受《纽约时报》采访时补充说,真正了解这项技术能力及其快速进步的人都非常担忧,但很少有人公开提出这些问题。耶鲁大学管理学院讲师高塔姆·穆昆达分析了公众为何越来越不信任科技行业管理自身创造的技术。讨论还涉及Meta与美国51名州检察长提出的一项和解方案,该方案要求Facebook和Instagram对儿童
AIR 已筹集 5000 万美元,用于帮助企业监控并保障 AI 智能体的安全。其平台能够发现企业内运行的智能体,持续审查它们使用的技能和插件,并阻止不受欢迎的行为。
以色列初创公司 Air Security 在获得红杉和 Greenoaks 领投的 5000 万美元融资后走出隐身状态。该公司正在为安装在 AI 智能体上的扩展程序及其他工具开发安全服务。公司研究发现,数千个 AI 插件依赖不受信任的来源,凸显了智能体软件生态中的安全风险。
应始终把聊天机器人当作不可靠的证人。作者最近不得不反驳一条由谷歌人工智能编造的信息。用户因此不应未经核实就相信人工智能生成的内容,而应通过其他可靠来源进行独立验证。
该研究分析社交媒体上的多模态错误信息,即通过结合文字和图像来误导受众的内容。研究人员从 Twitter/X 收集了涵盖七种语言的大规模真实错误信息数据集,并基于定性分析和既有理论研究构建了综合分类体系。随后,他们利用视觉语言模型(VLM)开发多阶段自动标注流程,并通过人工进行验证。研究发现,人工智能生成内容在科技和科学相关的错误信息中尤其常见;而疫苗错误信息则不成比例地使用新闻媒体图片,以增强可信
安全公司 CloudSEK 发布报告,披露勒索软件组织 Aurora 的近期攻击活动及内部信息。研究人员成功进入黑客配置错误的服务器,获取了内部攻击工具、使用 AI 编程助手 Cursor 制定攻击计划的记录,以及用于协商赎金的管理界面。调查显示,Aurora 主要利用 Cursor 协助规划攻击行动,并未使用 AI 开发勒索软件。该勒索软件主要采用 Zig 语言开发,支持 Windows 和 L
SpanCalib-VLM是一种用于定位和评估大型视觉语言模型生成的幻觉文本片段的混合系统。该系统将由XLM-RoBERTa-Large和SigLIP视觉编码器组成的多模态序列标注器,与经过微调的生成模型Qwen3.5-4B-SHROOM-SFT结合。通过Union-Calibrated Fusion策略,系统利用序列标注器校准后的概率,对生成模型提出的候选片段重新评分。在SHROOM-Visio
该研究提出 ContextBias 和 ContextBench,用于评估当职业被置于不同语境中时,文本生成图像模型中的刻板印象视觉关联是否会持续。该基准涵盖 92 种职业和 1,656 个经过语义控制的提示词。研究人员评估了四个先进模型生成的 66,240 张图像,发现与职业无关的语境并未抑制职业相关属性,反而提高了这些属性在不同职业之间的集中程度。人口统计线索、特征性服装和职业专用工具在各种条
Glassdoor 的一项分析显示,在提及人工智能的美国保险理赔员评价中,98% 持批评态度。员工表示,人工智能错误分类案件、生成不可靠的摘要并出现“幻觉”,不仅没有减轻负担,反而增加了工作量;系统出错后,客户通常还会把责任归咎于人工理赔员。保险公司正扩大人工智能在首次报案、文件审核、照片和视频分析、医疗记录摘要以及赔款处理等环节的应用。Lemonade 表示,其聊天机器人已处理 96% 的首次理
黄仁勋认为,通用人工智能(AGI)目前并不是最重要的问题,这一判断或许是正确的。然而,诈骗、虚假信息和操纵等当今人工智能系统的日常滥用所带来的即时风险,比假设中的“天网”式场景更加具体,也更加迫切。
研究人员发现,大型语言模型会将写作推向趋同的风格规范,减少语言多样性,并模糊体现作者个性的表达线索。皮尤研究中心称,自ChatGPT于2022年11月发布以来,互联网上发布的网页中有超过三分之一由人工智能生成。同时,网络文字也正变得前所未有地简单。
一项研究推出了 FACE-Eval,使用5,100个样本评估思维链(CoT)记录是否忠实反映影响模型回答的信息。研究测试了来自8个模型系列的15个开放权重模型,参数规模从40亿到1.60万亿不等。所有模型在接收工具返回内容中的偏好线索时,明确表达受影响程度都低于接收用户消息中的线索,但未明确表达却采纳偏好的比例更高。从原始数据中推断出的隐性线索也呈现类似结果。要求模型标注信息来源的提示,在7个模型