Exa Agent Ultraとは?——深掘り調査とリスト作りの最高努力モード

コラム

ウェブ検索スタートアップのExa(エクサ)が、Exa Agent Ultraを公開しました。これはチャット用の新しい「巨大モデル」そのものというより、同社の調査エージェントAPI「Exa Agent」のいちばん力を入れるモードです。長いリスト作りや、根拠付きの深掘り調査など、「調べ切る」作業向け、と公式は位置づけています。

本稿では、公式ブログとドキュメントをもとに、何が新しいのか・ベンチマーク表の読み方・料金と向き不向きを、専門用語をかみ砕いて整理します。数値はExaの公式発表に基づくもので、第三者による再現検証までは含みません。

Exa Agent Ultraとは何か

Exaは、人がGoogleでリンクを拾うような検索ではなく、AIエージェントがウェブを調べるための検索・調査APIを提供している会社です。2026年6月には、検索とページ読み取りと推論をまとめたExa Agentを出しており、Ultraはその延長線上にあります。

公式の説明では、Agent Ultraは次のような働き方をします。

  • 大きな依頼を小さな調査タスクに分割する
  • 複数のサブエージェントが、分野や切り口を並行で調べる
  • 難しい判断には強いモデル、単純な作業には軽いモデルを使い分ける
  • 網羅性(取りこぼしを減らすこと)を、速さやコストより優先する

身近な比喩でいうと、「一人の優秀な調査員」ではなく、調査チームを組んで、名簿づくりや会社調査を最後まで走らせるモードです。営業のターゲットリスト、競合の洗い出し、デューデリジェンス寄りの情報収集など、「全部拾いたい」仕事向き、とExaは訴求しています。

APIでは effort: "ultra" を指定します。既存の minimal〜xhigh・auto に加わった、いちばん重い設定です。即答チャットではなく、非同期(時間をかけて完了を待つ)の設計です。

公式ベンチマーク表の読み方

発表ページでは、Agent Ultraを Anthropic の Opus 5.5、OpenAI の GPT-6 Astra、および Perplexity Agent と並べた比較表が示されています。いずれも各社の最大努力設定での比較、とExaは注記しています。以下は公式画像に記載の数値です(Exaの主張)。

Exa公式のベンチマーク比較表(Agent Ultra / Opus 5.5 / GPT-6 Astra / Perplexity Agent)
出典:Exa公式ブログ掲載の比較表(公開ページの図)
指標 Agent Ultra Opus 5.5 GPT-6 Astra Perplexity Agent
WANDR(深掘り調査) 81.4% 72.3% 26.0% 40.1%
DeepSearchQA(多段ウェブ調査) 93.9% 77.6% 85.3% 89.7%
WideSearch(幅広い情報収集) 58.9% 51.6% 54.7% 56.0%
Find-All Company(1タスクあたり合格エンティティ数の平均) 2,451 146 113 98

ビジネス読者向けに、指標のイメージだけ短く補足します。

  • WANDR:条件に合う会社や案件を「広く」集めつつ、各項目の根拠も「深く」確かめる力(公式注記では soft recall)
  • DeepSearchQA:複数ステップのウェブ調査の正答寄り指標(F1)
  • WideSearch:広い情報収集の行単位の精度(row-level F1)
  • Find-All Company:1回の依頼で見つけられた「合格」企業などの平均数(多いほど網羅寄り)

表を見ると、Exaの主張としては Agent Ultra が各指標で先頭にあり、特に Find-All Company では他より桁違いに多くのエンティティを返す、という見せ方になっています。あわせて公式は、WANDRでは Opus 5.5 よりタスク単価が半分程度、DeepSearchQAでは GPT-6 Astra より約46%安い、などコスト面の優位も訴求しています。

注意点として、これはExa自身の発表・評価条件に基づく比較です。採点側のツールやジャッジモデルの違いも公式が説明しており、自社の名簿や業界データで同じ差が出るかは、実際の試用で確かめる必要があります。

試し方・料金・向いている人

試し方:公式ブログでは「今日から利用可能」とし、ドキュメントとAPI Playground(ダッシュボード)への導線を案内しています。開発者向けAPIが中心で、アプリに組み込むか、Playgroundで依頼を投げる形になります。一般向けの無料チャット画面というより、調査を外注するデジタル調査チーム用のスイッチに近いです。

料金の考え方(公式ドキュメント):

  • ultra と auto は従量課金。Ultraの既定の上限は1ランあたり20ドル(必要なら budget.maxCostDollars で1〜100ドルの範囲で調整)
  • 固定effort(例:medium 0.10ドル、xhigh 1.00ドルなど)はリクエスト定額
  • 従量の内訳例:Agent Compute Unit 0.10ドル、検索コール 0.005ドル、など
  • 新規アカウントには無料クレジット枠がある、と価格ページは案内

向いている人・場面:取りこぼしが売上やリスクに直結するリスト作り、根拠URL付きの会社調査、既存名簿への項目追加(エンリッチ)。逆に、会議中の即答や、毎回数秒で返ってほしいチャット用途には向きません。公式も Ultra を「網羅性がレイテンシやコストより大事なとき」と説明しています。

中小企業や個人事業なら、いきなり本番全件ではなく、小さな名簿で1回試して、抜け漏れと費用感を見るのが現実的です。人が最終チェックする前提で「下調べの外注」として使うイメージが近いでしょう。

まとめ

Exa Agent Ultraは、新しい検索エンジン名というより、Exa Agentの最高努力モードです。公式比較では WANDR・DeepSearchQA・WideSearch・Find-All Company で先頭の数値を示し、コスト面でも優位を主張しています。一方で数値は公式発表であり、現場の名簿品質は自前の試用で確かめるのが安全です。

「調べ切るリスト作り」がボトルネックなら候補に入れ、「すぐ答えが欲しい日常チャット」なら別ツール、という切り分けがわかりやすいでしょう。

参考リンク

この記事を書いた人
この記事を書いた人

毎日20時間以上AIの実践・研究に没頭するITエンジニア。20年以上にわたり、オンラインゲームや生活関連など幅広いジャンルのオウンドメディアで執筆・編集長を歴任。現在は上場企業グループの代表取締役を務め、複数の事業者団体で理事を兼務する経営者でもある。テクノロジーの最前線に身を置きつつ、地域の商店街や神社の運営にも深く携わるなど、地域活性化にも尽力。圧倒的な現場経験とITの専門知識、経営者の視点から、信頼性の高い有益な情報を発信している。
Olive株式会社 代表取締役

tanakaをフォローする
コラム
シェアする
tanakaをフォローする

コメント

タイトルとURLをコピーしました