科大讯飞开源端侧模型,支持百万 Token 上下文
科大讯飞旗下词元星火发布了开源模型星火 X2.5-4B 和星火 X2.5-1.7B。两款模型原生支持最长 100 万 Token 的上下文窗口,并针对智能体、代码、数学和指令遵循等能力进行优化。据介绍,模型在国产算力平台上完成全流程训练,使用了约 20 万亿 Token 的多样化数据。在 Domux 智能家居测试集上,1.7B 模型的控制指令端到端执行正确率达到 90.3%,平均响应时间为 0.8
AI 新闻中心 过去30天分析了 2386 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
科大讯飞旗下词元星火发布了开源模型星火 X2.5-4B 和星火 X2.5-1.7B。两款模型原生支持最长 100 万 Token 的上下文窗口,并针对智能体、代码、数学和指令遵循等能力进行优化。据介绍,模型在国产算力平台上完成全流程训练,使用了约 20 万亿 Token 的多样化数据。在 Domux 智能家居测试集上,1.7B 模型的控制指令端到端执行正确率达到 90.3%,平均响应时间为 0.8
阿里巴巴旗下AI助手通义千问在新学期升级学习功能,并将相关功能全部免费开放。此次更新新增与教材同步的作文辅导,以及初中语文、数学精讲;拍照解题和互动讲解能力则扩展至高中、大学的数学、物理、化学。作文辅导不会直接给出范文,而是通过连续提问,引导学生分析题目、整理素材并搭建文章结构。教材讲解会结合学生已学知识,帮助理解新概念。学生在理工科推导过程中遇到疑问时,也可以随时追问某一步的依据,系统会根据问题
AI初创公司Mirage于8月11日在X上播出了一档号称“直播”的24小时新闻节目。据称,这次实验消耗了约5万美元的代币。节目使用了外形逼真的AI虚拟人,但它们在自然对话方面表现不佳。报道分析了这次AI连续直播实验的效果、问题和成本。
总部位于新加坡的AI代理实验室Manus宣布,在Meta收购交易告吹后恢复独立运营。该交易据称估值约20亿美元,但随后被中国有关部门依据外资安全审查机制叫停,双方开始进行业务、数据和运营分离。Manus表示,创始团队将继续负责公司发展,并专注于能够处理复杂任务的自主AI代理。公司下一阶段将加强产品与日常工作流程的融合,提升与现实世界的互动能力,并更主动地代表用户执行任务。分拆过渡期间,Manus完
PaperGym 是一个将科学论文转化为完整训练环境的框架,用于训练生成研究计划的 AI。它根据论文的研究目标和背景生成问题,再从方法和实验中提取评估标准,从而减少模型仅靠改写内容获得奖励的情况。标准泄漏率降至 3.7%,而现有数据集为 11.90% 至 34.10%。在 Qwen3 模型上训练后,五项基准测试的平均成绩最高提升 5.6 分。研究团队还发布了包含 2 万个样本的 PaperGym-
环天智慧科技发布公告,为卫星遥感大模型应用训练中试基地项目选定招标代理机构。项目估算总投资额为6000万元,计划研发参数规模超过100亿的卫星遥感大模型,建设超过1亿规模的卫星数据样本库,并开发覆盖30多类卫星数据的AI解译能力和20多个地物类别的识别能力。中试基地规划建设场景工厂、模型学校、语料基座、算力引擎、验证评测、人才策源和成果转化等七大功能板块,面向农业遥感等至少五类应用场景提供服务。目
腾讯 WorkBuddy 于9月1日启动开学季 AI 支持专项,向中国大陆符合条件的学生和教师免费提供1000点 AI 积分。除港澳台地区外,全国普通高校在读大学生可于2026年10月31日前通过 WorkBuddy 官方小程序完成认证;各级各类学校在职教师可于2026年9月30日前通过教育部“中国教师”小程序认证。积分可用于资料查询、备考辅导、论文写作、求职咨询以及教学和行政工作。腾讯还推出了
中国科学院大连化学物理研究所联合科大讯飞、阿里云发布化工行业大模型3.0 Pro。开发方称,该系统将从信息检索和文本生成扩展到规划、执行与验证,计划应用于复杂化工工艺规划、生产流程优化和数据验证等场景。此次发布显示该模型正从知识问答工具转向面向工业流程的应用,但公告未提供独立性能基准,也未披露大规模工业部署的实际效果。
英伟达与联发科将深化在AI基础设施、本地AI计算和汽车系统方面的长期合作。联发科将采用英伟达NVLink Fusion平台,帮助超大规模企业、云服务商和AI模型开发者开发可与英伟达机架级系统集成的定制XPU。双方还将继续开发多代RTX Spark和DGX Spark PC芯片,将英伟达GPU与联发科SoC结合,面向消费级PC、AI开发系统和企业工作站。在汽车领域,双方将继续开发由AI驱动的软件定义
据知情人士透露,港股上市公司范式智能近期将出资超过10亿元采购华为昇腾950芯片,用于支持金融、制造等领域的AI大模型部署。公司今年4月曾宣布以4亿元采购GPU服务器,今年上半年资本开支达到22.37亿元。同期,范式API收入同比增长860.8%至4.64亿元,Token调用量增长约620%,在手订单总额约70亿元。新增算力资源将主要用于现有订单的项目交付和AI产品研发。这项合作被视为公司持续扩充
智谱公布2026年上半年营收为9.54亿元,同比增长近400%,半年营收已超过2025年全年。MaaS开放平台及API业务收入达到8.25亿元,占总营收的86.5%。截至8月底,平台Token调用量较年初增长超过40倍,付费日活用户数增长603%,前十大核心客户的日均调用量增长98倍。API平均售价也上涨约101%。随着算法改进和推理基础设施升级,单位Token推理成本较年初下降80%,单位算力投
DeepSeek 已通过 MIT 许可证开源 V4 系列首个实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp。该模型基于 V4-Flash 架构,深度整合视觉模块,支持图像理解与分析。模型总参数量达到 3050 亿。根据官方评测,其在纯文本智能体任务上的表现与 V4-Flash 相当,在多模态测试中展现出接近行业顶尖水平的竞争力。模型还支持调用外部工具,独立完成复杂的智能
Polimill 利用 OpenAI 的 GPT 模型和 Codex,帮助地方政府搜索和使用行政知识,同时加快相关应用的开发。
据Axios援引消息人士报道,面向销售和营销团队的人工智能初创公司Clay正在进行新一轮融资,Wellington将领投。此次融资的投前估值预计为70亿美元,高于今年1月员工股票要约交易中的50亿美元估值。
苹果在针对OpenAI的商业机密诉讼中提交了新证据。苹果称,前工程师张柳加入OpenAI后下载了包括电路图在内的机密信息,并将其用于LTspice模拟。苹果还表示,张柳训练了一个AI代理,使其能够运行LTspice、查看结果并调整参数。诉讼文件进一步指称,他隐瞒了对苹果数据的未经授权访问,并要求同事销毁证据。因此,苹果请求法院加快证据调查,并禁止OpenAI使用涉嫌被盗的商业机密。OpenAI则申