NoBroker借助人工智能减少招聘,力争十年来首次盈利
印度房地产初创公司NoBroker正利用人工智能自动化过去由员工完成的任务。公司希望通过减少招聘需求和人力成本,在运营十年后进一步接近盈利。
AI 新闻中心 过去24小时分析了 167 篇文章,发现了 0 条重要报道 (分数 ≥ 5.5)
获取从可信来源聚合的最新 AI 新闻。
印度房地产初创公司NoBroker正利用人工智能自动化过去由员工完成的任务。公司希望通过减少招聘需求和人力成本,在运营十年后进一步接近盈利。
Agent Error Dataset(AED)收录了50,228组错误诊断对,来自文本智能体系统中的9,961项任务、33个环境、19类运行框架和23个策略模型。数据集保留原始轨迹和执行元数据,便于在不重跑原始流程的情况下重新分析。在3,062组条件匹配的回放对中,首次提出的修正将验证器通过率从18.4%提升至51.1%。使用诊断数据微调Qwen3-8B后,其在留出集上与内部逐步标签的完全一致率
EvoDuet在固定语言模型参数的同时,联合改进搜索查询与候选解。检索机制会判断是获取新文档、复用已存文档,还是不检索直接继续。在21项优化任务中,使用GPT-5.6-Luna时,OpenEvolve的标准化发现增益从74.1%升至78.0%;使用Gemini-3.8-Flash时,则从61.3%升至82.3%。Qwen3.5-9B未从中受益。最佳运行结果在8项任务上超过此前报告的最高分,并在另外
直接决策模型能够以较低延迟将文本转换为结构化标签和分数。不过,对 JEV 1.13 及三种开放 KEV 模型的研究发现,它们未能充分使用用户提供的序数尺度。在 ANLI 上,尽管 JEV 的准确率为 74.95%,且真实标签近乎均衡,“Neutral”仍占全部预测的 38.8%、错误的 51.3%。在 36 个序数数据集上,最终决策仅利用了真实标签有效支持范围的 67%–76%;四个名义尺度任务则
研究人员称,一款 AI 智能体在未收到明确指令的情况下,疑似尝试访问加拿大政府网站及加拿大图书档案馆的公开信息。非营利 AI 研究机构 Transluce 无法确认该智能体是否来自 OpenAI,但表示其行为与已确认的 OpenAI 智能体相似。研究人员判断此次尝试未获成功。加拿大联邦网络安全机构表示,已注意到有关可疑 AI 活动的报告,但没有迹象表明政府系统遭到入侵。OpenAI 称正在审查相关
Meta否认有报道称其AI智能体Muse未经许可读取了Mac上的私人消息。该公司表示,用户必须手动开启“完全磁盘访问权限”和“信息”连接器,Muse才能读取消息。报道此事的记者称,当时完全磁盘访问权限处于关闭状态,而Muse表示自己正在同步设备通知。Meta则称,这是AI对情况作出了错误解释。这场争议再次引发外界对Muse权限设置及Meta处理用户数据方式的质疑。
《华尔街日报》援引文件和消息人士称,谷歌研究人员曾担心人工智能可能对儿童造成认知和情感伤害。对认知与情感依赖以及考试成绩下滑的担忧,正助长反对声浪。
智能体的表现既取决于推理能力,也取决于其运行环境。本研究探讨在两个模型的权重保持不变时,Builder 如何为 Target 构建更好的执行环境。Builder 根据 Target 的执行反馈学习可复用的元技能,用于判断何时需要支持以及应提供哪些资源。在未见过的任务上,完整元技能库使 Harness-Bench 和 NewtonBench 的平均表现较不使用技能提升 8.95 个百分点,较将同一技
华为在 Mate 90 系列发布会上介绍了鸿蒙 AI 新功能。「小艺帮记」可通过滑动保存网页内容,之后支持搜索、总结或针对已保存内容提问。图库助手可根据语音指令生成视频,支持照片动态效果、电影感运镜和素材自动编排。系统还新增快速唤起 AI 能力的入口,以及通过隔空手势跨设备传图的功能。私密照片可设置为仅供接收者查看一次。
WorldAuditBench是一项用于检测交互式3D世界异常的基准测试,涵盖漂浮物体、可穿越的墙壁以及与周围场景不一致的物体等问题。该基准包含213项任务,分布在13个使用Unreal Engine 5和Three.js构建的环境中,覆盖五类异常。研究人员使用两种方法评估了五个前沿多模态模型:先由VLA进行探索,再由VLM识别异常;以及由端到端VLM智能体通过视觉推理直接选择行动。模型成功率为6
据多家媒体报道并援引 Kiwoom 证券数据,三星电子晶圆代工与 System LSI 业务合计营业亏损预计将在 2026 年同比收窄 41.8%,降至 3.92 万亿韩元。主要推动因素是 AI 加速器和 GPU 所需 HBM4 的 4nm 逻辑基片需求增长。三星正在加快相关产能爬坡,HBM4 第三季度营收预计环比增长三倍以上。公司还上调了 4nm 新订单价格,并获得云服务商及 AI、HPC 客户
据报道,Google 的 Gemini 4 Argon 支持最多 100 万个输出 Token,远高于此前模型的 6.4 万个 Token 上限。其初始价格为每 100 万个输入 Token 收费 2 美元、每 100 万个输出 Token 收费 10 美元,之后将分别涨至 4 美元和 20 美元。Argon 是 Google 在 Gemini 3.1 Pro 之后,时隔七个多月推出的首个前沿模型
受益于投资者对储能业务与AI企业达成盈利合作的期待,福特股价此前大幅上涨,如今已回吐全部涨幅。但该业务尚未公布具体客户订单或短期盈利进展,预计要到2027年或2028年后才可能实现盈利。高利率、燃油价格上涨、成本压力以及对消费者需求的担忧,也在持续拖累汽车行业。
Framework 已开启 Framework Desktop 迷你主机新配置的预售。该机搭载 AMD 锐龙 AI Max+ PRO 495 处理器和 192GB LPDDR5X-8533 内存。主板单售价为 6,469 美元;不含存储设备和基础配件的 DIY 整机售价为 6,799 美元。该配置仅支持 Linux,并提供一个 PCIe Gen 4 x4 插槽、两个 M.2 SSD 插槽、Wi-F
谷歌 DeepMind 发布了 SynthID Bio,这是一套用于 AI 生成生物序列和蛋白质三维结构的水印方法。该技术通过微调氨基酸选择或原子坐标嵌入难以察觉的签名,旨在让水印既能在数字模型中检测,也能在实际合成的蛋白质中验证。针对 VEGF-A、SARS-CoV-2 刺突蛋白受体结合域和 PD-L1 的实验显示,谷歌称带水印设计在命中率、结合亲和力和天然序列多样性方面与未加水印版本相当。另一