Anthropic与OpenEvidence将向约100个中低收入国家的医生提供专业AI搜索工具
人工智能初创公司Anthropic与医学知识平台OpenEvidence展开合作,将向约100个中低收入国家的医生提供OpenEvidence AI搜索工具的专业版本。该计划旨在利用人工智能改善医疗信息的获取。
AI 新闻中心 过去24小时分析了 203 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
人工智能初创公司Anthropic与医学知识平台OpenEvidence展开合作,将向约100个中低收入国家的医生提供OpenEvidence AI搜索工具的专业版本。该计划旨在利用人工智能改善医疗信息的获取。
Go.AI为银行等受监管组织提供本地部署的AI硬件设备和软件工具,近日完成由Updata Partners领投的8500万美元A轮融资。首席执行官David Moscatelli向Axios Pro证实了这一消息。
数字家居改造平台Angi Inc.任命Michael Steib为首席执行官,负责推动公司业务转型,并进一步加大对人工智能的关注。公告未披露具体的新人工智能产品或技术进展。
研究人员提出了ScriptMoE,这是一种覆盖10种文字体系、229种语言的场景文字识别模型。该模型采用共享视觉编码器和稀疏混合专家解码器,将每张图像路由至与其文字体系匹配的专家,同时通过共享专家学习跨文字体系知识。研究团队还构建了合成数据集TextMuSS-10M,以弥补许多语言训练数据不足的问题。ScriptMoE在TextMuSS-Bench上达到82.06%的准确率,比最强基线高1.31个
雷神(THUNDEROBOT)宣布即将推出 STATION 系列迷你 AI 工作站。该系列最高可选 AMD 锐龙 AI Max+ PRO 495 处理器,支持弹性集群组网,可灵活部署多台设备,并根据需求扩展算力。产品面向 AI 开发、专业创作和企业应用等场景。雷神近期已推出基于 Strix Halo 的 AI Master M7000 移动工作站,并计划推出采用 Strix Halo 或 Gorg
Anthropic 发布 Claude Code v2.1.280,并将 Claude Opus 5.5 正式设为默认 Opus 模型。该模型支持 100 万 Token 上下文窗口,输入价格为每百万 Token 4 美元,输出为 20 美元,缓存读取为 0.20 美元。Pro 和 Team Standard 套餐的默认模型也从 Sonnet 切换为 Opus。此次更新还修复了安全检查重试、MCP
研究人员提出 Segment-Snap,用于理解三维场景中的交互,并联合描述可移动部件、部件运动以及操作区域。该方法识别较大的部件表面和较小的把手,再利用几何先验与把手位置推断运动方式和铰链轴,无需训练运动回归器。在 Articulate3D 验证集上,在保持掩码和轴不变的情况下,把手引导使运动门控平均精度从 13.74% 提升至 40.98%。加入额外把手候选后,把手平均精度从 24.63% 提
该研究提出一种紧凑的几何原生潜在空间,用于连接感知与生成。几何原生自编码器(GAE)的潜在表示可同时解码外观、深度、相机参数和点图。在保持生成器和训练流程不变的受控对比中,使用 GAE 潜在表示提升了视觉质量和独立测量的三维一致性。FVD 在 RealEstate10K 上下降 12.7%,在 DL3DV 上下降 23.1%;RealEstate10K 上的相机轨迹误差则降低了一半。
HyperQ在冻结的掩码扩散语言模型中加入令牌条件量子残差分支。轻量级电路超网络针对每个令牌,为共享的稀疏量子电路生成专属参数,训练时只更新新增分支。由于所需期望值可以通过精确的经典表达式计算,该方法能够在11亿参数的骨干模型上训练16至64量子比特的电路。在下游基准测试中,随着电路宽度增加,平均分数从47.65提升至54.30。在64量子比特配置下,HyperQ比骨干模型高4.71分,比低秩适配
本综述将大型语言模型(LLM)在心理健康领域的发展概括为三个阶段:最初作为信息工具和模式识别器,随后成为用于即时互动的共情型对话者,目前则迈向具备持续记忆的长期个性化陪伴者。文章系统分析了相关核心技术,以及涵盖用户画像、记忆、推理和规划的智能体架构,并梳理数据集与评测基准。研究旨在整合这一领域较为分散的文献,为构建负责任、有效且以人为本的心理健康人工智能系统提供发展方向。
OpenRouter 核查了目录中的 37 个嵌入模型条目,并通过 28 项 API 检查测试了 19 个模型。指南建议英文 RAG 以低成本的 text-embedding-3-small 起步,长上下文场景选择 Voyage4-large,多语言开放权重方案则考虑 Qwen3-Embedding-8B。代码搜索可使用 voyage-code-4,文本与图像检索可选择 Gemini Embedd
火山引擎已为Seedance 2.5 API推出Draft模式。创作者可先以较低成本生成480P样片,检查场景、构图、主体动作、对白、音效和运镜节奏,再通过样片ID生成1080P成片。系统会延续提示词、参考素材以及seed、画面比例、时长等关键参数。官方以5秒1080P视频为例称,抽卡4次时成本可降低57%,抽卡20次时节省幅度可达77%。与先生成低分辨率视频再进行超分辨率处理不同,该模式直接生成
阿里巴巴集团正在加快扩建欧洲和中东的数据中心,推进其全球20吉瓦基础设施建设计划。此举正值中国与美国在人工智能芯片和模型领域的竞争不断升级之际。
该报告介绍了 Ovis-Embedding,这是一系列全模态嵌入模型,利用统一的多模态骨干网络,将文本、图像、视频和音频编码到共同的表示空间中。该方法以预训练的 Qwen-Omni 模型为基础,结合对比学习、覆盖多种模态的高质量数据集,以及聚焦损失和基于相似度的嵌入蒸馏等专用技术。低秩特征分解能够在性能损失有限的情况下生成维度灵活的紧凑嵌入。报告中的评测显示,Ovis-Embedding 在 MM
RULER 是一种从自然语言指令生成 SVG 代码的优化方法。由于开放式矢量图形任务通常没有唯一的视觉标准答案,CLIP 和 Aesthetic 等标量指标难以准确评估此类内容,用作强化学习奖励时还可能引发奖励投机。RULER 针对每条指令生成包含六个项目的实例感知式评分规则,覆盖语义、视觉和风格维度。视觉语言模型逐项评估渲染后的 SVG,再通过 Group Relative Policy Opt