GazeAnywhere 通过文本和视觉概念估计视线目标
该研究提出可提示式视线目标估计(Promptable Gaze Target Estimation,PGE),这是一种端到端方法,用于识别现实世界图像中人物注视的目标。与依赖头部边界框、人体姿态等独立输入的传统多阶段方法不同,PGE 可通过灵活的文本或视觉提示指定分析对象,例如“穿红色衬衫的男孩”或图像中的某个坐标,从而减少中间步骤中的错误累积。研究团队还开发了 Gaze-Co 数据集和基准,包含
AI 新闻中心 过去一年分析了 504 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
该研究提出可提示式视线目标估计(Promptable Gaze Target Estimation,PGE),这是一种端到端方法,用于识别现实世界图像中人物注视的目标。与依赖头部边界框、人体姿态等独立输入的传统多阶段方法不同,PGE 可通过灵活的文本或视觉提示指定分析对象,例如“穿红色衬衫的男孩”或图像中的某个坐标,从而减少中间步骤中的错误累积。研究团队还开发了 Gaze-Co 数据集和基准,包含
Writer推出了一款新AI系统,该系统基于Z.ai的开源模型GLM-5.2进行后训练。公司称,该系统旨在以显著更低的价格提供可直接部署的能力。升级版工具则用于限制Token使用量,从而降低运营成本。相关信息未提供独立的性能数据或基准测试结果。
X 将“为你推荐”时间线及其核心排序引擎的源代码发布到 GitHub,并新增工具,让用户查看自己的帖子或账号是否受到排序系统的曝光限制。此举提高了 X 推荐算法的透明度,但仅凭代码公开,并不能证明系统已经完全披露,也不意味着外部人士可以独立验证其运行方式。
DeepSeek 正式发布 DeepSeek-V4-Pro-0813,并以 MIT 许可证开放模型权重,同时推出代码智能体框架 Harness 的公开测试版。Harness 用于围绕大语言模型调度上下文、工具、任务状态和反馈,产品定位对标 OpenAI Codex 与 Anthropic Claude Code。命令行工具 dsh 支持 Web、Headless 等运行模式,并可通过 npm 插件
杰弗里·辛顿、李飞飞和吴恩达在 Ai4 大会上分别表达了对 AI 保持一定开放程度的支持。辛顿区分了开源软件与开放权重模型,警告称公开模型权重可能让强大的 AI 更容易被改造用于恶意活动。但他也认为,开放权重模型已经存在,相关争论实际上可能已经结束。吴恩达主要担心市场集中,主张保留多个相互竞争的 AI 供应商,并支持开源 AI。李飞飞反对把开放与封闭简化为二选一,认为 AI 生态系统的不同层面应采
包括Coinbase和Block在内的30多家比特币及加密货币企业,要求主要人工智能实验室向开源安全研究人员提供提前访问权限。这些企业表示,前沿人工智能工具的严格安全防护措施阻碍了正当的安全工作,而攻击者却在使用更强大的工具。
据 Ars Technica 以及安全公司 CloudSEK、Hudson Rock 披露,3 月被植入恶意代码的 LiteLLM 软件包引发了一场约 40 分钟的攻击。攻击者据称从约 2500 个组织中抓取凭据,并外传约 195TB 数据。泄露信息包括云密钥、代码仓库 Token、SSH 和 Kubernetes 密钥、软件包发布凭据、环境变量、CI/CD 凭据以及 AI 服务商 API 密钥等
据《连线》援引知情人士报道,美国目前针对闭源先进AI模型的网络安全审查机制,未来数月可能扩展至开放权重模型。该机制目前仍属自愿性质。报道所称“前沿”模型,是指能力相当于Anthropic Claude Mythos或OpenAI GPT-5.6的模型,但未透露具体版本。部分美国官员担心,强制审查可能抑制AI发展。白宫还在考虑,闭源模型通过审查并投入使用后,是否会降低企业对未审查开放模型的兴趣,进而
AVA-Encoder 是一个研究框架,可将视频转换为包含结构化文本的知识图谱,并关联图像、音频和视频资产,随后再将其重建为视频。该方法旨在帮助 AI 智能体理解、查询和编辑电影级内容。系统利用视频重建差异生成的自然语言反馈来优化编码策略,并可在测试阶段进一步细化知识图谱表征。实验显示,AVA-Encoder 比最强外部基线提升了 20.7 个百分点。在受控策略设置中,经过伪训练的镜头级智能体视频
阿里巴巴通义千问团队已向全球开发者和研究人员开放Qwen3.8-2.4T-A95B的模型权重。该模型总参数量达到2.4万亿,每个Token激活950亿参数,原生支持26万Token上下文,并可扩展至101万Token。阿里称,模型在编程、日常办公、科研辅助和长周期智能体任务方面实现性能提升。据介绍,该模型在PaperBench和OSWorld-Verified评测中位居参评模型前列,部分指标超过多
据《WIRED》援引消息人士报道,开放模型可能很快被纳入美国更新后的人工智能政策框架。白宫仍在努力确定如何监管这项技术,而此前一直试图避免对其进行监管。
Mistral AI表示,其平台将支持第三方开放模型,首个接入的模型是Z.ai的GLM-5.2。该模型将与Mistral自有模型使用相同的基础设施运行。Mistral强调,企业和国家应当能够控制所使用的模型,以及模型运行的位置。
在 Ai4 大会上,杰弗里·辛顿、李飞飞和吴恩达围绕人工智能监管、开源技术获取,以及在中国于亚洲持续推进的背景下美国如何保持竞争力展开讨论。
阿里巴巴 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重。该混合专家模型总参数量为 2.4 万亿,每个 Token 激活 950 亿参数,原生支持 262,144 Token 上下文,并据称可扩展至 1,010,000 Token。阿里表示,这是 Qwen-Max 级别模型首次开放权重。Qwen3.8 采用混合架构,重点面向编程、办公、科研和长周期 Agent 任务。每个 M
AT&T表示,开放式AI模型目前约占其AI使用量的25%,并计划逐步将这一比例提高到70%至80%。这家电信公司平均每天使用450亿个AI token,并押注开放模型,以控制token成本并保护其专有数据。