韶音 OpenFit 2 AI 耳机开启预售:搭载千问模型,续航最长 48 小时
韶音已在中国开启 OpenFit 2 AI 开放式耳机预售,首发价为 1398 元。耳机基于千问 AI 模型,支持语音录音、转写、翻译和自动生成总结。用户可通过耳机、充电盒或应用发起录音,最长记录 8 小时。系统支持 30 种语言、19 种方言以及四种翻译模式。耳机还配备 IP55 防护、蓝牙 5.4、双设备同时连接和四麦克风通话降噪功能。单只耳机音乐续航最长 11 小时,搭配充电盒后总续航可达
AI 新闻中心 过去一年分析了 4090 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
韶音已在中国开启 OpenFit 2 AI 开放式耳机预售,首发价为 1398 元。耳机基于千问 AI 模型,支持语音录音、转写、翻译和自动生成总结。用户可通过耳机、充电盒或应用发起录音,最长记录 8 小时。系统支持 30 种语言、19 种方言以及四种翻译模式。耳机还配备 IP55 防护、蓝牙 5.4、双设备同时连接和四麦克风通话降噪功能。单只耳机音乐续航最长 11 小时,搭配充电盒后总续航可达
哈佛商学院教授琳达·希尔表示,下一代首席执行官需要投入更多时间建设灵活的组织。随着人工智能快速部署,企业开展业务和运营的方式正在发生变化。
一项研究发现,时间序列基础模型在预测1,000只美国股票的小时收益率时会出现“预测崩溃”:预测结果近乎扁平,股票排名表现也很差。相比之下,在相同条件下预测交易量时,该现象大幅减弱。研究人员认为,原因包括目标变量的可预测性较低,以及按单个序列优化的目标函数无法识别序列之间的结构。最小化平方误差会导致扁平预测,而直接优化横截面相关性虽能改善排名,却可能使预测幅度放大一个数量级以上。研究提出CalibR
采用ReAct范式的LLM智能体会在推理、行动和观察之间交替进行,但在等待环境响应时,推理会暂停。Second Thought利用这段空闲时间,在每次Thought阶段结束后立即并行启动四个辅助推理分支,并在下一次环境观察到达时合并结果。在三个智能体基准和三个推理模型上,该方法在全部九个模型与基准组合中都降低了平均交互轮数。在其中六个组合中,主线程的顺序解码量最多减少43%,第七个组合基本不变。P
据英国《金融时报》报道,AI视频生成平台Higgsfield已从DST Global、高盛、Liberty Global、英特尔等投资者手中筹集4亿美元,估值升至54亿美元。这家成立仅两年的初创公司计划利用资金拓展企业订阅业务,加强安全能力并 확보算力资源。Higgsfield称,其年化收入在今年8月达到7亿美元,约一年前仅为2000万美元;平台目前在238个国家和地区拥有超过3000万用户。公司
MobileMem 是一个用于研究设备端 AI 智能体长期记忆的基准和框架。它基于为期一年的移动体验数据,并通过知识驱动的合成流程,从用户与应用的交互会话中构建连贯且具有时间一致性的长期轨迹。该基准涵盖文本和多模态场景,评估多跳推理与时间推理、知识更新以及隐式偏好推断。MobileMem 不仅关注对孤立事实的检索,还评估智能体能否记住过去、理解现在,并随着时间推移适应用户。
CPI-Bench是一项用于评估AI图像编辑模型的新基准,重点测试模型在真实应用场景中的表现。它包含三个子集:覆盖多种编辑任务并首次纳入多图像编辑评估的CPI-General-Bench,聚焦高频用户场景的CPI-Practical-Bench,以及评估高难度推理式编辑能力的CPI-Intelligent-Bench。对主流图像编辑模型的评估表明,该基准能够更有效地区分模型在通用编辑、实际部署和高
文章声称,SpaceX 在4月启动合作后收购了 AI 编程助手 Cursor。报道称,交易将使 Cursor 获得大规模算力基础设施,用于开发性能更强、成本更低的 AI 模型。Grok 4.6 被描述为双方团队的首项联合成果。不过,文章关于收购事实、交易估值以及可用 GPU 基础设施规模的多项关键说法目前未经证实。
OpenAI 已向符合条件的 ChatGPT 账户开放 Codex 约 105 万 Token 的上下文窗口。此前,这项能力仅限通过 API 调用,Plus 和 Pro 订阅用户需要手动配置后才能使用。更大的上下文窗口可以让编程代理在自动压缩历史信息前,处理更多代码、工具输出和完整对话记录,有助于大型代码库重构、复杂调试和长时间开发会话。OpenAI 同时提醒,默认上下文长度是在性能与成本之间权衡
HumanTracker是一项用于评估人形机器人动作跟踪能力的基准,旨在让评估结果更符合人类对视频的感知。传统运动学指标通常计算逐帧姿态差异的平均值,却难以捕捉支撑不稳定、脚部滑动和落地时机错误等关键物理问题。该基准收集了来自多名专业表演者的约153小时光学动作轨迹,分为四类动作,并配有文本标签以支持细致诊断。研究人员还提出了HumanScore指标,该指标使用由1.2万组动作对、共2.4万个动作
小米汽车正在招募车主体验 App 内的“车辆助手”公测功能。用户可以通过自然语言对话查询车辆状态、即时或定时控制车辆、创建自定义“超级任务”,并分析驾驶风格和用车习惯。该功能还支持出行前提前开启空调、规划自驾路线,以及查询保养权益和车辆功能。目前功能仍处于测试迭代阶段,首批体验名额有限,所有车主均可报名并由官方筛选。参与测试无需更新车机,只需按照指引将小米汽车 App 升级至公测版本。
中国企业宇树科技生产的一款人形机器人正在全球社交媒体上受到关注。身高约1.3米的“爱德华”接入大语言模型后,可以用波兰语与人实时对话。其拥有者表示,机器人开始说话后,路人的接受度明显提高。爱德华曾进入波兰议会、参加户外活动,并出现在一段于华沙追逐野猪的热门视频中。据报道,相关视频累计播放量超过40亿次,粉丝数超过100万。其他Unitree G1机器人也在美国等地成为网络红人。该型号相对容易购买且
这项研究提出了 RA-Bench,这是一个用于检测描绘现实危机事件的人工智能生成视频的基准数据集。数据集共包含17,886段视频:来自10类社会风险的1,830段真实参考视频,以及由4个开源和5个闭源生成器制作的16,056段生成视频。研究评估了7种传统检测器、10个零样本多模态模型,以及2个专门针对人工智能生成视频检测进行微调的模型。结果显示,三类检测器都无法在整个基准上实现稳定泛化。生成质量、
蓝戟已在中国电商平台上架 Intel Arc Pro B65 TF 32G 专业显卡,官方售价为 8999 元。该卡配备 20 个 Xe-core,显卡时钟为 2400MHz,峰值 INT8 算力达 197 TOPS,TBP 功耗为 200W。蓝戟公布的数据显示,使用 ComfyUI z-image-turbo 生成 720×1280 图片,平均耗时 10.62 秒;使用 wan2.2_i2v_1
鸿蒙智行尊界 V800 和 V680 已获准在合肥市开展 L3 级自动驾驶测试,后续将针对多种驾驶场景进行深度测试。两款车型搭载华为 ADS 5.0 全栈软硬件方案,并对传感器、计算系统、连接系统和电源进行冗余设计。车辆预计于 9 月开始交付。此次牌照仅允许开展测试,并不等同于获得在公共道路上不受限制运行 L3 自动驾驶系统的许可。