我在五个自认为熟悉的领域试用了 ChatGPT 的全新互动测验,它迅速找出了我的知识盲点
ChatGPT 新增了内置测验功能,用户可以针对任何主题测试自己的知识。实际在五个自认为熟悉的领域中试用后,这项功能很快发现了原本不易察觉的知识盲点。
AI 新闻中心 过去7天分析了 919 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
ChatGPT 新增了内置测验功能,用户可以针对任何主题测试自己的知识。实际在五个自认为熟悉的领域中试用后,这项功能很快发现了原本不易察觉的知识盲点。
OpenAI 在 Hugging Face 发生安全漏洞后宣布了新的防护措施,包括在开发过程中更详细地监控模型,并在训练后流程中更加重视对齐和安全性。
Jane Street已安装Etched首套交付的AI集群系统。这家初创公司表示,Jane Street对该系统印象深刻,因此主导了另一轮大规模融资。
法国税务部门计划使用人工智能工具排查安全漏洞。此前,该部门遭到网络攻击,数十万名纳税人的个人信息被泄露。
StateM是一套面向AI代理的运行时系统,通过持久状态、阶段化上下文、经过检查的状态转换、可恢复运行手册和版本化程序规则,改进长时任务执行,同时不修改模型权重。研究团队称,在Terminal-Bench 2.1上,StateM使GPT-5.6 Sol xhigh在445次试验中达到95.3%的原始准确率,并让89项任务全部至少成功一次。GPT-5.5、GPT-5.6 Luna和DeepSeek-
摩根大通资产管理公司的加布里埃拉·桑托斯警告称,与人工智能相关的投资集中风险已从股票市场扩散至固定收益市场。尽管人工智能超级周期仍将持续的观点没有改变,投资者仍需提高谨慎程度。
一种能够从模型中精准移除训练样本的新方法表明,随着数据集规模扩大,模型所学内容与其生成结果之间的联系会逐渐难以追溯。
Asana使用OpenAI Codex,在两周内替换了一套过时的测试系统。该公司表示,这项工作原本预计需要约五年完成,实际成本约为1.2万美元。
文章概述老旧 AI 芯片的新应用、英伟达的融资后盾,以及更优秀的开放权重模型可能对人工智能行业产生的影响。
法律科技公司Harvey宣布推出Harvey Tenet,这是其首款面向法律工作的内部开发专有AI模型。该模型使用模拟争议和案件档案进行训练,并采用了Kimi K3的一个版本。Harvey此前依托其他公司的AI模型建立法律软件业务,如今正试图证明自己也具备开发自有模型的能力。
20 岁的埃及开发者马克·莫拉德开发了 AI 应用 ScribeMe,可实时描述用户周围的影像。这款应用主要面向全盲人士,支持 Meta 智能眼镜以及 iOS 和安卓设备。用户可以询问附近的物体、动物、距离和活动情况,从而在脑海中构建周围场景。据报道,ScribeMe 已覆盖 140 个国家和地区,拥有数千名用户,并支持 20 种语言。莫拉德本人也是盲人,在使用现有辅助工具时遇到困难后,通过 Yo
Stellantis申请了一项专利,计划将虚拟司机投射到挡风玻璃上,以缓解乘客对自动驾驶车辆的陌生和不安。系统会持续判断每名乘员的位置与视线方向,并显示口型与合成语音同步的虚拟人物。乘客还可以选择虚拟司机的外形。专利还设想,在车辆驶出预定运行设计域或遇到自动驾驶系统难以处理的异常情况时,远程真人操作员可以通过投影“出现在”车内,与乘客直接交流并解释情况。目前,这仍只是专利中的技术构想,尚未确认会应
StreamOPD研究在不增加推理时记忆、检索或压缩的情况下,仅通过后训练提升流式视频理解能力。该方法结合可验证的流式视频数据、思考模式下的在线策略蒸馏,以及指令模式部署。StreamingBench成绩从77.9%提升至83.9%,与9B教师模型的差距缩小到0.3个百分点以内。其扩展方法ST-CueGate利用教师模型针对时空线索的信号重新调整蒸馏权重,并在多个基准测试中取得改进。在线策略自蒸馏
闪极在武汉发布 AI 眼镜 loomos L1。产品最轻 43 克,采用钛合金前框,配备 1200 万像素摄像头、音频系统和可遮挡镜头的物理磁吸镜盖。其核心功能是“主动记忆”,可在用户授权并符合相关法规的前提下记录对话、通话和环境信息,再通过 AI 整理人物、重点内容、提醒事项和待办任务。产品深度接入飞书,支持消息收发、内容总结、日程管理和任务指派,也支持腾讯 WorkBuddy AI 助手。开启
微软暂时移除了 Windows 11 任务栏中的 Copilot 搜索框,并将重点转向统一版 Copilot 应用的开发。该功能此前仅以预览形式向少数用户开放,面向普通消费者的版本已在几个月前停用。微软表示,未来将推出全新体验,并继续收集用户反馈。