AI 新闻中心

AI 新闻中心 过去7天分析了 963 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。

面向科学领域的终端环境自监督扩展

一种新方法利用现有科学软件工作流,为终端智能体生成训练任务和可验证的参考输出,从而减少逐项手工编写参考解答的需求。研究在六个领域、46个软件系列中的500个工作流上进行了测试。由此生成的训练样例使Qwen3.8-27B在Terminal-Bench 2上的平均成绩在三个随机种子下从47.94%提升至53.56%。结果表明,现有软件工作流有望成为大规模、经过验证的训练数据来源。

AI“攻克数学”引发的争议

过去一年,OpenAI、Anthropic 等 AI 实验室宣布在多个长期未解的数学问题上取得突破。部分成果据称超出人们对现有系统能力的预期,其中包括宣称解决了一道著名的千禧年大奖难题。然而,实验室快速推进也引发了对成果可靠性以及仓促行事风险的担忧。

儿童社交媒体保护措施终于开始推进,AI保护是否也要等这么久?

专家表示,应尽早采取行动,保护儿童免受人工智能可能带来的伤害。美国近期推动社交媒体安全措施的经历或可提供借鉴:儿童面临的风险受到关注多年后,相关应对才逐步展开。人工智能公司已开始推出年龄核验和限制未成年人使用的功能,但这项快速发展的技术对年轻人的影响仍不明确。儿童安全倡导者认为,应在危害显现之前建立防护措施,而不是等问题发生后再补救。

企业需要一套衡量 AI 成效的指标

企业不应只评估 AI 代理是否完成任务,还应衡量它是否改善了业务成果。许多企业目前仍将 AI 用于撰写文档和邮件、开展研究等有限的行政工作。与此同时,企业对更具战略性的 AI 应用兴趣渐增。