60美元即可终身使用Claude、Gemini、ChatGPT等模型
ChatPlayground将数十种主流AI模型整合到一个平台中,并支持用户比较不同模型的输出结果。这项优惠主要是以折扣价格提供现有服务的访问权限,并未推出新的AI模型或重大技术突破。
AI 新闻中心 过去24小时分析了 180 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
ChatPlayground将数十种主流AI模型整合到一个平台中,并支持用户比较不同模型的输出结果。这项优惠主要是以折扣价格提供现有服务的访问权限,并未推出新的AI模型或重大技术突破。
微软研究人员推出Thinkingbox,这是一个用于评估AI智能体的沙盒和基准测试,重点关注会修改后端持久状态的多步骤业务任务。Thinkingbox-bench包含507个受政策约束的工作流,覆盖零售、酒店、汽车保险、银行和IT支持等领域。系统通过可执行检查验证正确的状态转换,并拒绝缺失、错误或意外的影响。表现最强的模型在pass@1上达到65.36%,但pass^20仅为25.25%。结果表明
一项研究提出环境正则化策略优化(ERPO),作为大语言模型训练中传统 Policy-KL 正则化的替代方案。ERPO 通过 Query-KL 项限制训练查询分布的偏移,同时不对响应分布施加直接的梯度压力,从而在提升训练稳定性的同时保留探索能力。该方法无需额外的前向传播,即可接入 GRPO、PPO 和 REINFORCE 类训练流程。在六项数学推理基准测试中,作者报告称,ERPO 提高了准确率,并在
EchoWM 是面向交互式生成媒体的全模态世界模型。它能够响应连续导航,同时生成 720p 视频、环境音、音乐和语音。在第一人称场景中,镜头意图用于指定观察者的运动;在第三人称场景中,镜头与角色之间的动态关系则从数据中学习。离散指令和连续姿态会映射到统一的米制相对六自由度轨迹。研究团队通过专用数据引擎和渐进式训练,支持长时段生成,并保持环境音与语音同步。公开世界模型基准测试显示,该模型具备较强的轨
据 Wccftech 报道,英特尔披露了 Wildcat Lake 处理器(又称酷睿 Series 3)的技术细节。该平台面向入门级 PC,AI 算力最高可达 40 TOPS,最高约为 Raptor Lake U Refresh 的 2.7 倍;创作与生产力性能最高提升 2.1 倍,处理器功耗降低 64%。为降低封装成本,Wildcat Lake 未采用 Panther Lake 的 Fovero
小米董事长兼 CEO 雷军介绍了两款搭载新一代玄戒芯片的原型机。玄戒 O100 原型机采用 O3 与 O100 双芯协同计算,面向端侧 AI 模型;小米称,搭载 MiMo 模型后,实测推理速度最高可达每秒 295 个 Token。AI Cube 原型机则整合 O3、O100 和 D100 三款芯片,配备 80GB 统一内存,可运行参数量达 1200 亿的模型及较小的端侧模型。目前两款设备均为原型机
英伟达使用 SemiAnalysis 的 AgentX 工作负载和 1.6 万亿参数的 DeepSeek-V4-PRO 模型,对 Vera Rubin 进行了评估。公开结果显示,Vera Rubin NVL72 的每兆瓦 Token 吞吐量约为 GB300 NVL72 的 30 倍。该基准测试主要评估智能体编程推理工作负载,指标包括端到端延迟、首个 Token 延迟以及生成阶段性能。测试还显示,G
台湾首富搭上了人工智能热潮,但他的公司与科技行业毫无关系。家具零部件制造商金滑轨工业(King Slide Works)表明,与人工智能基础设施相关的需求增长,也可能惠及科技行业以外的供应商。
广汽集团董事长冯兴亚再次在深圳会见华为创始人任正非,双方围绕启境品牌下一阶段发展及合作展开交流。继启境GT7上市交付后,定位为五座智能百变SUV的启境GX7计划于9月上市。该车预埋L3级智能驾驶架构,并采用多重冗余设计,搭载华为相关技术,包括最多十块屏幕、前排双15.6英寸车载屏,以及88英寸大画幅增强现实抬头显示。上述内容属于已公布的产品规划和配置,并不代表车辆已经取得L3级自动驾驶的监管许可。
Block3D是一种文本到3D生成扩散框架,将离散的形状标记序列划分为连续区块。该方法以自回归方式生成各区块,同时对当前区块中的所有标记进行联合去噪。基于置信度的区块内校正机制会在每个区块最终确定前修正低置信度标记。在TRELLIS-500K的留出数据集上,Block3D将端到端平均生成时间从25.71秒缩短至4.99秒,相比经过微调的自回归基线提速5.15倍,同时未牺牲几何保真度。
带搜索功能的 LLM 越来越多地利用实时网络内容进行商品推荐,因此可能被经过操纵的网页误导,成为虚假商品的无意推广者。研究团队推出 FORGE 基准测试,将检索网页中的真实商品替换为虚假商品,以评估模型的脆弱性。研究覆盖 225 件商品、15 个类别、5 种消费场景,以及 12 个商业和开放权重模型。结果显示,所有模型都存在漏洞:仅一张被污染的网页就能使虚假推荐率最高达到 27%;将排名前三的网页
漫步者在中国发布开放式蓝牙耳夹耳机 Comfo Clip Q2,预售价 399 元,日常定价为 449 元。产品搭载海思谛听音频芯片和 OpenHarmony 系统。AI 功能包括由豆包与 DeepSeek 协同提供的翻译问答,支持 21 种语言互译,并可进行面对面同声传译以及文本、拍照翻译。鸿蒙系统对“漫问漫答”功能的适配预计于 9 月完成。耳机还支持 AI 通话降噪、0.05 秒低延迟游戏模式
英国气象局的一项调查显示,公众对基于机器学习的天气预测系统信心不足。绝大多数受访者仍然更支持传统的天气预报方式。
MobilePA-Bench 是一个用于评估移动 AI 智能体工具调用和长期规划能力的交互式基准。其可执行沙盒维护实时应用数据库并返回结构化反馈,覆盖 13 个功能领域和 212 个真实移动工具。测试还考察子智能体协作、记忆使用和可复用技能调用。实验表明,即使是当前领先的大语言模型,在严格的工具调用顺序、权限限制和意外运行时错误下仍然不够可靠。
据蓝鲸科技报道,老板电器正在研发新一代AI烹饪眼镜,预计明年3月正式发布。与仅用于线下体验展示的第一代产品不同,新品将面向消费者销售。产品重量预计比约89克的前代机型更轻,显示方案将从全彩改为单色,供电方式则改为可更换电池。软件方面,新品搭载“食神”AI烹饪大模型,具备面向厨房场景的AI算法以及与厨电联动的逻辑。相关算法由老板电器成都算法团队开发,光波导光学模组由谷东智能提供。目前报道内容主要涉及