一项研究表明,混合式 Qwen3.8-27B 模型的全部 496 个线性层,包括 Gated DeltaNet 循环层,都可以采用 NVFP4 W4A4 量化,而不会造成明显的质量损失。在困惑度测试,以及 MMLU-Pro、GSM8K、AIME'25、GPQA-Diamond、LiveCodeBench 和最长 64K 上下文的 RULER 检索测试中,Minima 版本与 BF16 的差异处于随
LLaDA-Image 是一个统一的图像生成框架,由从零开始训练的 60 亿参数 Diffusion Transformer,以及基于扩散语言模型 LLaDA2.0-Mini 的冻结视觉语言理解模块组成。系统没有从一开始就高度依赖图文配对数据,而是先通过纯图像预训练和中期训练建立强大的视觉生成先验。训练过程使用了 2.2 亿个样本,其中包括 9800 万张真实图像。蒸馏版本 LLaDA-Image
ChatGPT 的新贴纸功能起初看起来像又一种用过即弃的 AI 生成内容。但实际体验后,它出人意料地有趣,还能让用户制作出真正符合个人需求、愿意使用的贴纸套装。
特斯拉表示,已在得克萨斯州奥斯汀的部分限定区域提供双座Cybercab乘车服务。这款自动驾驶汽车没有方向盘和踏板。据路透社报道,得州目前登记有45辆Cybercab。此次有限部署是对特斯拉无人驾驶机器人出租车概念的初步实际测试,但尚未证明其具备大规模或完全自动驾驶运营能力。
据报道,英伟达已同意以 129.303 亿美元收购开源人工智能平台 Hugging Face。英伟达 CEO 黄仁勋表示,Hugging Face 将继续保持开放属性,不会变成只服务英伟达硬件的封闭入口。该平台拥有超过 1800 万名开发者、研究人员和创作者,用户已共享超过 300 万个模型、50 万个数据集和 100 万个应用。英伟达计划利用自身的基础设施、工程能力和全球覆盖,提升平台的可靠性、
据 NeoWin 报道,微软计划从 9 月开始推送 Copilot Studio 更新。开发者将可以要求 AI 智能体在调用特定工具前先获得人工批准。启用审批后,工具调用会暂停,并显示智能体的操作意图,供用户审核。微软列举的适用场景包括发送电子邮件、关闭工单和处理付款。只要相关操作被设置为需要审批,AI 智能体就无法自行继续执行。
AI科学家、谷歌研究员雷·库兹韦尔将担任硅谷初创公司Subsense的顾问。该公司正在开发一种非手术脑机接口技术,据称会使用吸入式纳米颗粒。这项技术仍处于开发阶段,其技术可行性和研发进展尚未得到独立验证。
英伟达官网更新显示,面向 Windows on Arm 笔记本的 RTX Spark N1X 超级芯片将提供两种配置。移动端低配版搭载 5120 个 GPU 核心和 18 核 CPU,高配版则为 6144 个 GPU 核心和 20 核 CPU。桌面主机目前仅列出满血配置。英伟达尚未公布 CPU 的具体架构和配置。
特斯拉今天在得克萨斯州奥斯汀举行的私人闭门活动上正式发布了Cybercab。这款车体现了埃隆·马斯克多年来推动无人驾驶汽车的承诺,也反映出特斯拉押注人工智能、自动驾驶汽车和人形机器人的战略方向。现有报道没有提供具体技术细节,也未证明全自动驾驶服务即将推出。
英伟达发布了开源测试版 Personal AI Router(PAIR)。这款软件可在局域网内自动发现可用电脑,并将本地 AI 请求分配给空闲设备,支持 M4 及更新款 Mac、英伟达 RTX PC 和 DGX Spark,同时为 Ollama、LM Studio 等工具提供统一入口。模型仍在目标设备上运行,因此 PAIR 主要用于分担彼此独立的任务,并不意味着增加设备后单个回答会自动变快。英伟达
智谱 AI 为 GLM Coding Plan 付费套餐用户推出夜间优惠:9 月 3 日至 20 日每天 23 时至次日 9 时(北京时间),通过官方编程工具 ZCode 使用 GLM-5.3-Flash 不消耗额度;通过其他支持的 Agent 使用时,可用额度翻倍。活动不适用于 GLM-5.3。GLM-5.3-Flash 是 GLM-5 系列的多模态模型,支持 100 万 token 上下文窗口
据 Downdetector,ChatGPT、Claude、Grok 和 Cursor 等多项主流 AI 服务曾同时出现大范围故障,持续近 4 小时,随后恢复正常。OpenAI 还发布 GPT-6 Astra,宣称这是其目前最强的大语言模型,并首次达到网络安全能力的“关键”门槛。不过,相关性能以及模型可监控性下降的说法尚未得到独立验证。英伟达 CEO 黄仁勋否认 AI 会消灭所有工作。演员戚薇则宣
铭凡确认,搭载 AMD 锐龙 AI Max+ PRO 395 处理器的新款 AI 迷你工作站 MS-S1 MAX-P495 将于 9 月内开售。该设备配备 192GB LPDDR5X-8533 统一内存,最多可将 160GB 分配为显存。根据公布的本地 AI 运行数据,使用 Q4 量化运行 DeepSeek V4 Flash 284B 时,输出速度为每秒 15 个 Token;以 Q8 量化运行
法国 ISC 巴黎商学院的一项小型研究显示,过度依赖 ChatGPT 等 AI 产品,可能与独立思考能力下降、注意力持续时间缩短、记忆力减弱、自我怀疑增加以及部分情况下的社交孤立有关。研究人员访谈了 45 名年龄在 18 至 25 岁、每天使用 ChatGPT 的人士。部分受访者表示,ChatGPT 无法使用时会感到焦虑,也越来越倾向于先与聊天机器人交流,而不是向朋友、老师或同事求助。研究团队将这
AI 公司正在购买二手书,用于训练大型语言模型。今年早些时候的一项版权和解中,法院裁定,购买实体书并将其销毁以用于 AI 训练,从技术层面看可能属于合理使用。