AI提前9.24小时捕捉太阳活动早期信号
由美国新泽西理工学院牵头的研究团队开发了机器学习模型 EarlyDetect,用于预测太阳活动区的形成。该模型采用 Transformer 架构,分析 NASA 太阳动力学观测台获取的太阳声学活动和磁场数据。性能最佳的版本平均可在活动区变得可见前9.24小时识别出相关前兆信号。这项技术有望补充空间天气预报,为卫星通信企业和电网运营商争取更多时间,以应对太阳风暴风险。不过,EarlyDetect 目
AI 新闻中心 过去30天分析了 914 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
由美国新泽西理工学院牵头的研究团队开发了机器学习模型 EarlyDetect,用于预测太阳活动区的形成。该模型采用 Transformer 架构,分析 NASA 太阳动力学观测台获取的太阳声学活动和磁场数据。性能最佳的版本平均可在活动区变得可见前9.24小时识别出相关前兆信号。这项技术有望补充空间天气预报,为卫星通信企业和电网运营商争取更多时间,以应对太阳风暴风险。不过,EarlyDetect 目
一项研究指出,长期运行的LLM智能体如果通过持久化记忆错误记录权限、限制或撤销信息,即使没有外部攻击,也可能执行原本未获授权的操作。研究人员将这一问题称为“内生性授权洗白”,并推出EAL-Bench,用于评估记忆系统保存动态授权状态的准确性,以及错误是否会导致后续越权行为。研究覆盖采购、网络安全和金融场景,测试了5个负责写入记忆的LLM和2个负责执行任务的LLM。在渐进式记忆更新下,写入模型最多会
本期科技资讯包含多项 AI 动态。谷歌上线 Gemini 3.8 Flash,面向软件工程、智能体任务和复杂知识处理流程,主打以较低成本进行大规模生产部署。李飞飞创办的 World Labs 发布 Atlas,称其为多模态世界模型,可实现高精度镜头控制、图像和视频生成,以及 3D 重建。腾讯推出 WorkBuddy 开放平台,支持开发者创建和管理智能体技能与专家能力。努比亚表示第二代豆包手机计划于
一项研究在接触密集的机器人 ParcelStow 任务中,以不同执行速度比较脚本专家与利用专家示范训练的 Action Chunking with Transformers(ACT)策略。两者在标称速度下的任务成功率均为 100%。但在测试的最高速度下,专家成功率降至 84%,ACT 仅为 53%。两个 ACT 策略相比标称速度分别下降 34 和 48 个百分点,而专家下降 16 个百分点。ACT
一项研究发现,基于logit的知识蒸馏在不同训练阶段会产生不同效果。在预训练阶段,它能同时提升推理能力和事实记忆;但在中间训练阶段,虽然推理能力继续增强,事实知识的获取却会放缓。研究人员将这一现象归因于教师模型在不同数据领域中的置信度差异,以及学生模型不断变化的知识状态。研究提出了Switch Distillation:利用教师模型的预测熵,仅在教师高度确信的词元上进行蒸馏,否则使用交叉熵训练。与
据称,OpenAI的新模型Astra将采用“递归深度”技术,使模型能够超越大多数推理模型所采用的顺序思考方式运行。这一方法引发了人工智能安全专家的担忧。
麻省理工学院相关人士与MIT-IBM Computing Research Lab展开合作,旨在将严谨的理论研究转化为生产系统。公告没有说明具体技术成果或部署规模。
初创公司 Mostik 正在探索一种不同寻常的方法,以结合多个 AI 模型的能力。该方法旨在让模型无需使用自然语言即可交换信息。
研究提出了一种名为“代理式数据破解”的方法,旨在降低大型语言模型代理处理网页、报告、合同、监管文件和 PDF 时的成本。代理读取文档并进行推理时,子代理会提取有用的结构化信息,并预先整理可能服务于未来相关查询的内容。之后的问题可以直接利用积累的结构化数据回答,无需再次打开原始文档。在 FanOutQA 基准测试中,每个测试问题增加一个相关问题后,该方法在保持准确率的同时将成本降低了 53%。
文章调查了 AI 生成图片和文字为何难以被可靠识别。明显的“AI生成”标识很容易被去除,C2PA 来源元数据也可能在截图、裁剪或压缩后消失。谷歌的 SynthID 隐形水印更耐修改,但不同公司的检测器并不互通,也可能遭到去除和对抗攻击。作者测试多种文本与图片检测工具后发现,知名模型的生成内容有时能够被识别,较冷门模型则经常逃过检测,结果差异明显。文章认为,目前不存在完美的通用检测器。未来与其只关注
该研究提出 CASTER,一种用于冻结模型测试时适应的无梯度方法。CASTER 将源类别统计量存储在判别子空间中,根据目标批次的矩估计类别共享的仿射变换,并在分类前以解析方式传输源分布。该方法无需反向传播、优化器状态或存储特征库。在 4 种骨干网络和 7 个数据集上,CASTER 使用相同的冻结特征,在 28 个设置中的 27 个超过 k-NN,同时所需状态量的中位数减少 18 倍。不过,仿射传输
DramaChain Bench 首次覆盖了 AI 短剧制作的完整流程,包括剧本、分镜、关键帧图像、镜头级视频和成品剧集。该基准采用 5 个评估维度,进一步细分为 63 个叶级指标。5,785 个项目由 3 名专业标注员独立评分,形成 17,488 个有效分数和 255,925 条可追溯的缺陷归因记录。人工标注表明,上游环节产生的缺陷会在后续流程中级联,最终剧集质量并不只取决于视频生成。基于智能体
一种名为 CW-Net 的新方法,可将自动驾驶汽车人工智能系统的推理过程转化为易于理解的概念。这有助于人们更好地解读车辆行为,并预测车辆可能出错的情况。
研究表明,让 AI 客服更像真人并不会自动提升客户满意度。一项针对 1000 多名澳大利亚人的调查显示,只有 39% 的受访者对自动化客服感到满意。在部分情境下,文字聊天机器人比语音机器人带来了更积极的反馈和更强的释然感,可能是因为打字让情绪受挫的客户有更多时间冷静下来。另一项研究发现,当 AI 能准确识别愤怒等情绪并作出具体回应时,客户对其情绪理解能力的评价和整体满意度都会提高。研究认为,企业不
据 DigiTimes 报道,美光正在研究高耐久性 NAND 闪存模块,计划将其部署在比传统存储池更靠近 GPU 的位置。这种目前被称为“近 GPU NAND”的方案,旨在平衡存储密度、耐久性、I/O 速度和带宽。它可能让 GPU 直接访问数百 GB 的 NAND 存储池,并可放置在 GPU 封装内部或电路板上。该存储层位于显存和普通存储之间,可充当高速缓冲层,用于运行更大规模的语言模型。不过,这