AI 安全初创公司 Mindgard 在 A 轮融资中筹集 3000 万美元
总部位于伦敦和波士顿的 Mindgard 在 A 轮融资中筹集了 3000 万美元。该初创公司提供自动化 AI 安全和红队测试工具,帮助企业评估并保护 AI 系统。公司计划将这笔新资金用于扩大产品、工程、销售和营销团队。
AI 新闻中心 过去一年分析了 4061 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
总部位于伦敦和波士顿的 Mindgard 在 A 轮融资中筹集了 3000 万美元。该初创公司提供自动化 AI 安全和红队测试工具,帮助企业评估并保护 AI 系统。公司计划将这笔新资金用于扩大产品、工程、销售和营销团队。
约克大学与卡尔加里大学研究团队分析了Reddit上446篇关于AI编程工具安全问题的帖子及超过6000条评论。这些帖子从2023年2月至2026年3月收集的3801篇热门大语言模型相关帖子中筛选而来。研究发现,当编程智能体获得过大的权限时,可能覆盖文件、删除重要数据,甚至生成恶意代码。问题报告最多的工具是Cursor,其次是Claude、Codex、Copilot、Windsurf、VSCode、
据《金融时报》援引消息人士报道,瑞典法律人工智能初创公司Legora正就一轮新融资展开初步谈判,目标估值超过100亿美元。若达成,这一估值将较仅四个月前的56亿美元大幅上升。据报道,该公司第二季度年度经常性收入(ARR)环比增长50%,达到1.5亿美元。
第二届世界人形机器人运动会将于8月22日在北京开幕,吸引六大洲16个国家的666支队伍和2056台机器人参赛,队伍数量较首届增长138%。赛事设有51个项目、共1301场比赛,除体育竞技外,还覆盖家庭、酒店、工业和应急救援等9类真实场景。大赛进一步提高了自主运行要求:除100米障碍和400米障碍外,几乎所有田径及其他竞技项目都必须由机器人自主完成。场景赛中,遥控方式完成的成绩权重仅为自主完成的一半
韩国人工智能实验室 Upstage 发布了 Solar Pro 4,这是一款面向复杂 AI 智能体任务的商用大语言模型。该模型支持 512K token 上下文窗口,最高输出长度为 128K token,但官方尚未公布参数量。价格为每 100 万输入 token 0.3 美元,缓存读取 0.06 美元,输出 1.2 美元。Upstage 公布的评测成绩包括 Terminal-Bench v2.1
Genesis以持久化项目为核心组织长期软件开发,而不是依赖一个持续运行的编程智能体。系统将软件表示为递归世界:短生命周期智能体提出局部修改,在不同代码仓库路径之间委派任务,只有被接受的结果才能推进持久版本历史。使用DeepSeek V4 Flash时,Genesis在超过120小时内从零构建了一个基于Rust的C编译器,生成约25万行受跟踪代码。该编译器通过了完整的c-testsuite,以及大
Self-Geometry是一种用于3D视觉基础模型的即插即用测试时自适应流程。它将二维像素对应关系作为伪真值,直接施加明确的多视图几何一致性和极线一致性约束。该方法结合了几何解耦优化、基于SO(3)测地距离的视角采样,以及通过LoRA实现的轻量化自适应。在六个视觉模型和四个基准数据集上的实验表明,该方法能够稳定提升相机位姿和几何估计性能。
据知情人士透露,AI编程助手Devin的开发商Cognition正与投资者洽谈新一轮融资,估值可能至少达到400亿美元。Cognition今年5月刚以约26亿美元估值完成10亿美元融资。公司称其年化收入运行率已达到10亿美元,过去半年企业客户对Devin的使用量保持每月50%的增长。其客户包括梅赛德斯-奔驰、美国国家航空航天局和高盛。Cognition表示,Devin并非用于取代程序员,而是帮助处
一项新研究评估了大语言模型(LLM)代理在互动叙事中长期保持逻辑和故事承诺的能力。研究提出的NCP-Bench包含100个由电影梗概衍生的环境,每个环境都设有结构化的事实、情节轨迹和叙事承诺,可在交互过程中自动检查。实验显示,语言表达流畅并不保证逻辑一致性;面对用户的对抗性干预,即使是较强的模型也经常生成相互冲突的内容。表现最佳的GPT-5.2在20轮交互后的存活率仅为42%,不同模型的事实冲突率
阿里巴巴近日在千问开放平台上线菜鸟智能体。用户可以用自然语言输入物品类型、预算和上门取件时间等需求,智能体会推荐合适的快递服务和承运商,回答寄件政策相关问题,并识别重物、大件等特殊寄件需求。获得用户授权后,它还可以结合通讯录关键词和历史寄件记录,自动补全寄件和收件信息。这是物流领域的一项实用型 AI 应用,但不构成重大技术突破。
Automattic 旗下的个人 CRM 和关系管理平台 Mesh(原名 Clay)于 2026 年 8 月 12 日推出 Android 版本。该应用支持分屏、弹出视图和折叠屏设备,并可在不同设备之间实时同步。正在测试的 Nexus AI 可以让用户通过自然语言搜索复杂的人脉数据,例如查找特定公司的联系人、某个城市的人脉或某一领域的专家。Mesh 还在探索语音交互和 AI 名片识别功能。通过与
微软发布 Visual Studio Code 1.133,调整 Agent 窗口的访问方式,并支持用户在会话进行期间切换模型提供商。启用实验性设置后,用户即使不愿登录 GitHub,或设备无法连接 github.com,也可以打开 Agent 窗口。目前免登录功能仅支持 Claude,微软计划后续加入 Copilot 和 Codex。新版还允许用户在 Anthropic 与 Copilot 模型
谷歌 DeepMind 发布了一款大规模多语言手语转文本模型。Pixel 11 系列的 Gboard 和 Live Transcribe 将首先支持美国手语输入,未来计划扩展到更多手语和设备。该模型使用涵盖 50 多种手语的 10 万小时数据训练,能够同时分析身体多个部位的运动,并将手语视为独立的自然语言,而不是简单的手势序列。为保护隐私,系统会将手语转换为身体关键点的位置数据,无需把原始视频流发
AI代码编辑工具开发商Cursor计划提前向全量用户推出自动化代码审查平台Origin。该平台由Cursor于2025年底收购的Graphite团队开发,将在Cursor网页界面中整合GitHub代码库管理和自动化拉取请求处理流程。AI代理可负责处理未解决PR的日常事务,仅在需要人类作出关键决策时通知开发者。这一产品反映出软件开发工具正从单纯的代码生成,逐步转向涵盖代码生成与审查的全流程自动化。
AVA-Encoder 是一个研究框架,可将视频转换为包含结构化文本的知识图谱,并关联图像、音频和视频资产,随后再将其重建为视频。该方法旨在帮助 AI 智能体理解、查询和编辑电影级内容。系统利用视频重建差异生成的自然语言反馈来优化编码策略,并可在测试阶段进一步细化知识图谱表征。实验显示,AVA-Encoder 比最强外部基线提升了 20.7 个百分点。在受控策略设置中,经过伪训练的镜头级智能体视频