ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
Exa Agent Ultra:深度研究开到穷尽档,费用按美元封顶

Exa Agent Ultra:深度研究开到穷尽档,费用按美元封顶

AI资讯 • Admin • • 6 次浏览

Exa Agent Ultra 是 AI 搜索公司 Exa 在 2026 年 9 月 26 日发布的 Agent API 最高「努力」档位:把 effort 参数设为 ultra,智能体就会为「必须跑到穷尽」的任务投入最多算力——大规模名单构建、实体信息补全、需要翻遍数千个来源的难题。它不追求更快,而是追求更彻底。

从一个问题到几千个来源:它是怎么跑起来的

Ultra 的工作方式是把任务拆成子任务,再编排并行子智能体(subagents)同时在多个领域调研;每个步骤按需混合调用前沿模型与更快更便宜的模型。它是 Exa 目前算力投入最高、最耗时的模式:典型复杂任务约 30 分钟跑完,极难任务最长可达 3 小时(maxDurationSeconds 取值 300 到 10800)。调用已经上线:在 Exa API 里设置 effort="ultra" 即可,也兼容 OpenAI 的 /responses 接口(reasoning.effort="ultra")。注意,它不是开源权重,不能自托管。

费用与适合谁:1 到 100 美元的成本开关

计费按标准 Agent 用量走:默认单次运行上限 20 美元,可在 1 到 100 美元之间调整(maxCostDollars);提前结束只按实际用量计费。SDK 轮询默认 1 小时超时,官方建议加长或改用流式。Exa 点名的三类目标用户是:模型厂商(组装训练数据,比如收录某一技术的所有论文和仓库)、金融(尽调市场地图、KYC、组合监控)、出海与市场团队(客户名单构建与信息补全,每条结果带引用 URL)。它还支持传入已有名单做扩充,传入的行会被自动排除。

基准成绩很亮眼,但全是厂商自报

官方公布的成绩单确实好看:WANDR(Perplexity 的 500 个宽深数据采集任务)soft recall 81.4%,比 Opus 5.5 高 12.6%(相对值;绝对差距 9.1 个点),单任务成本只有 Opus 5.5 的一半;DeepSearchQA(Google DeepMind 的 900 个多步搜索 prompt)F1 93.9%,比 Perplexity 高 4.7%;WideSearch 行级 F1 58.9%,比 Perplexity 高 5.2%,四家中单任务成本最低;Company Find-All 平均每任务返回 2451 个通过实体,约为 Opus 5.5(146 个)的 16.8 倍。但必须把出处说清楚:以上全部来自 Exa 官方发布,参与对比的竞争对手均跑在最高 effort 档,且这些数字尚未经过独立复现。

「彻底」第一次有了价格标签

深度研究正在从「给一个答案」变成「穷尽式枚举」,Ultra 的价值在于把「彻底」做成了一个可按预算开关的 API 参数——1 到 100 美元的成本封顶。这正是企业敢用的关键:效果上限和花费上限可以同时框定。但在第三方复现结果出来之前,建议把这份成绩单当作能力上限的参考线,而不是采购决策的依据。

推荐工具

更多