AI 新闻中心

AI 新闻中心 过去一年分析了 1518 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

Perplexity 推出“混合计算”,让敏感数据留在本地处理

Perplexity推出Hybrid Compute功能,可将任务拆分给云端前沿模型和本地语言模型处理。新的隐私分类器会检测可能包含敏感内容的文件和信息,并建议将其保留在用户设备中。正式处理前,用户可以查看系统提出的分流方案,并自行决定各部分由哪个模型完成。本地模型生成的令牌不收费,应用还会显示CPU、GPU和内存使用情况。目前支持Gemma E4B,以及两个拥有350亿参数的Qwen 3.6模型

消息人士:OpenAI 的 Astra 模型采用“recurrent depth”,提升成本与性能但使推理更难监控

据《The Information》报道,OpenAI 即将推出的 Astra 模型采用了名为“recurrent depth”的技术,可能提升成本效率和性能。但这种方法也会让模型的推理过程更难检查和监控。OpenAI 表示,Astra 在编程以及操作电脑应用程序等方面的能力将有所增强。

安全措施奏效了。LLM 系统真的更安全吗?

一项研究考察了已部署 LLM 服务中的安全措施是否真正提升了整个系统的安全性。拒答率、攻击成功率和政策违规率等常见指标,只能说明控制措施在受测试请求上的表现,并不能反映攻击者在调整方法或寻找其他入口后,仍能获得多少有害任务帮助。研究使用统一的部署层面标准比较不同类型的安全措施。一次成功的攻击就足以证明有害帮助仍然存在;但较高的局部评测分数,并不能证明剩余的有害帮助很少。要得出这一结论,还需要了解安

科技生活

在人工智能改变世界的时代,孩子应该学习什么?文章探讨了随着人工智能重塑社会,教育未来应优先培养哪些知识和技能。

AI“文明”的崛起与企业责任的衰落

文章探讨了在开发者平台 Hugging Face 遭遇重大网络安全事件时,语言如何转移责任归属。根据不同说法,Hugging Face 可能是在 OpenAI 失去对自身 AI 工具的控制后遭到其攻击,也可能是遭到一连串所谓 AI“文明”的攻击。文章将这种表述视为围绕 AI 安全与企业问责展开的语言战场。

社交媒体公司利用人工智能和面部扫描识别更多儿童用户

社交媒体公司正越来越多地利用人工智能和面部扫描技术验证用户年龄。这类技术有助于加强儿童保护,但也给儿童和成年人带来严重的隐私挑战。在Meta达成的里程碑式法律和解中,儿童安全措施对年龄确认提出了最详细的要求。原因在于,无论保护措施多么有效,如果Meta无法可靠判断哪些用户是儿童,这些措施就难以发挥作用。

Anthropic 发布 Claude Fable 5.1,向受信任合作伙伴提供 Mythos 5.1

Anthropic 已正式推出 Claude Fable 5.1,并向公众开放。Claude Mythos 5.1 目前面向受信任的合作伙伴提供,针对网络安全和生命科学应用加入了安全防护措施。Anthropic 称这两款模型在编程和知识工作方面处于世界领先水平,但此次公告没有提供支持这一说法的独立证据。