powered by TechFeed
表示モード
Deep Dive

AIエージェント向けWeb検索API 11種を比較 — $0.25から$50まで、精度・速度・コストで選ぶべきはどれか

10月5日、startuphub.aiが「Web Search APIs for AI Agents: Benchmarks and Pricing」と題した記事を公開した。SimpleQA Verifiedで97%を叩き出したParallel AIと、1,000リクエストあたり$0.25という最安値を実現したCeramic.ai——この2つの発見を軸に、AIエージェント向けWeb検索API 11種をレイテンシ・コスト・精度の観点から比較し、Claude CodeのMCP連携設定まで踏み込んだベンチマーク記事だ。

10月5日、startuphub.aiが「Web Search APIs for AI Agents: Benchmarks and Pricing」と題した記事を公開した。SimpleQA Verifiedで97%を叩き出したParallel AIと、1,000リクエストあたり$0.25という最安値を実現したCeramic.ai——この2つの発見を軸に、AIエージェント向けWeb検索API 11種をレイテンシ・コスト・精度の観点から比較し、Claude CodeのMCP連携設定まで踏み込んだベンチマーク記事だ。


「検索してスクレイピング」の時代は終わった

AIエージェントがリアルタイムでWebを参照することは、もはや実験的な機能ではなく構造的な要件になっている。初期のエージェントフレームワークはWeb参照をスクレイピングの延長として扱っていた。ヘッドレスブラウザ、住宅用プロキシのローテーション、返ってくる生のHTMLを処理するという流れだ。

しかし、Claude Codeのような現代の推論スタックが必要とするのは、低レイテンシで、トークン効率が高く、事実に裏付けられたコンテキストだ。ノイズだらけのDOMツリーはアテンションを希薄にし、コンテキストウィンドウを無駄に消費する。

この需要に対し、市場は以下の層に分化した:

  • 高スループットSERPパーサー — 検索エンジンを構造化データエンドポイントとして扱い、JSONで有機的検索結果を返す
  • エージェントネイティブなグラウンディングエンジン — 検索・取得・抽出を1回のAPIコールに集約
  • AIアンサーエンジンスクレーパー — ChatGPTやPerplexityの実UI画面をブラウザ操作で取得
  • 非生成型決定モデル — 推論モデルにプロンプトが届く前に関連性を判定し、ルーティングする
  • エンタープライズゲートウェイ — 複数プロバイダーを一元管理

精度とコスト:どこに差がつくか

エンジニアが最初に気になるのは「結局どれが速くて正確で安いか」だろう。均等に比較しても意味がないので、特に差が出た点を先に整理する。

精度ベンチマークで突出したParallel AI

Parallel AIのAdvancedモードは、SimpleQA Verifiedで97%を記録した。Turbóモードでも94%を出しており、かつレイテンシはTurboで約200ミリ秒、Fastでも1秒以下に収まる。

補足:ベンチマーク指標について

  • SimpleQA Verified:Googleが公開した短形式QAベンチマーク。Wikipedia等の事実に基づく質問に対して「正解・不正解・回答不能」を判定する。単純ファクトチェックに特化しているため、検索グラウンディングの精度を測る指標として広く採用されている
  • SealQA-0:長文・複数ホップの推論を含む難問QAベンチマーク。SimpleQAより格段に難易度が高く、マルチステップ調査が必要なエージェント用途での実力差が出やすい
  • AIMultiple Agent Score:AIMultipleが独自に算出するエージェント適合性スコア。ツール呼び出し成功率・応答構造の安定性・レイテンシの複合指標

記事が指摘する「有用な発見」はここだ:積極的な圧縮をかけてもなお高精度を維持した。Parallelはページテキストをそのまま返さず、事実密度を保ちながらレトリックを除いた圧縮エクサープトを返す。ツールコールループでトークンを節約しながら精度を落としたくない用途に向く。価格はTurbo/Fastが1,000リクエストあたり$1.00、Advancedが$5.00。

欧州グラウンディングならLinkup

LinkupはSOC 2 Type IIとZero Data Retention(データ保持なし)を全プランで提供する独立した欧州インデックスだ。精度はSimpleQA Verifiedで92〜94%、SealQA-0では61%でリードしている。特徴的なのは「型付き構造化出力」で、開発者が定義したJSONスキーマをリトリーバル層で強制する。スキーマ抽出のためのプロンプトを書く必要がなくなる。

FlashモードはSingle-passで200ミリ秒以下、Standardは1〜3秒でアジェンティックリトリーバル、Deepはマルチホップ調査に対応。料金はFlash/Standardが1,000リクエストあたり$5.00、Deepが$50.00。


各プロバイダーの立ち位置

最安値:Ceramic.ai(Cloudflare経由)

1,000リクエストあたり$0.25。Cloudflare AI Gatewayのバックエンドとして提供される400億ページ以上の独立インデックス。ページ説明を最大8,000文字で返すため、二次フェッチが不要になるケースが多い。Zero Data Retention付き。レイテンシは250ミリ秒以下で、高頻度エージェントループに向いている。

Cloudflare Web Search APIはゲートウェイ構造で、Ceramic.ai($0.25/1K)、Exa($7.00/1K)、Linkup($5.00/1K)をproviderパラメータで切り替えられる。プラットフォームのマークアップはなく、クロール時にrobots.txtの遵守と正規URLの返却が義務付けられている点が特徴だ。

セマンティック検索:Exa AI

Exaは転置インデックスを持たず、独自トランスフォーマーモデルによるエンベディングネイティブなベクトルエンジンで動作する。自然言語の説明やコードスニペットをクエリとして受け付けるため、ブール演算のキーワード検索では捕捉できないセマンティックな類似性検索が得意だ。ただし、最新ニュースの精度は時間的境界を明示的に設定しないと劣化する。料金は1,000リクエストあたり$7.00(ハイライト付き)。

DOM処理を丸ごと任せる:Firecrawl

Firecrawl(Mendable維持)はオープンソースのクロール・抽出プラットフォームで、アンチボット対策・動的JavaScript・複雑なレイアウトを通過してMarkdown、構造化JSON、スクリーンショットに変換する。1リクエストあたり2〜5秒と遅いが、DOM清書レイヤーを自前で書かずに済む。AIMultiple Agent Scoreは14.58。

LLMネイティブ検索:Tavily

TavilyはRAGパイプラインへの組み込みを前提に設計された検索APIだ。単なるSERPスクレーパーではなく、検索結果のページを取得・要約・フィルタリングまでを1コールで完結させる。LangChainやLlamaIndexとの公式インテグレーションが整備されており、RAGチェーンに数行で組み込める点が特徴だ。料金は1,000リクエストあたり$5.00〜$8.00。SimpleQA Verifiedでの精度は中位に位置するが、エージェントフレームワークとの親和性の高さから採用実績が多い。

プロキシ経由のWebスクレイピング:Scrape.do

Scrape.doは住宅用プロキシネットワークを基盤とした汎用Webスクレイピングサービスだ。Cloudflare等のアンチボット機構を突破しながら任意のURLのHTMLを取得する用途に向く。検索特化型のAPIとは異なり、返ってくるのは生のHTMLコンテンツであるため、後段でのパース処理が必要になる。実効コストは1,000リクエストあたり約$1.16(プラン・帯域による)。エージェント用途というよりは、特定サイトの継続的データ収集に適したポジションだ。

AIアンサーエンジンの中身を取得:Cloro

Cloroはユニークな立ち位置だ。Google Search、ChatGPT、Perplexity、Microsoft Copilot、Google Gemini、Grokなど9プラットフォームの実UIを自動ブラウザ操作で取得する。直接APIでは得られないグラウンディング引用、UIの配置、中間クエリのfan-outまでJSONで返す。

コストとして、リクエストあたり20〜45秒のレイテンシがある。非同期タスクキューとWebhookで大量処理に対応。月$100から(カード不要の500トライアルクレジット付き)、成功した取得にのみクレジットが消費される。

エージェントコードを変えずに使える:OpenRouter

OpenRouterはサーバーサイドでツール実行を行うルーティングゲートウェイだ。クライアント側でツールループを実装しなくても、ツール配列に渡すだけで推論中間にモデルが自分でクエリを発行し、Markdownの引用付き回答をストリーミングレスポンスに組み込む。バックエンドはPer callでParallel($0.001〜$0.005)、Exa($0.007〜$0.015)、Perplexity($0.005)などをピン留め可能。


Claude CodeのMCP連携設定

元記事はClaude CodeからMCP(Model Context Protocol)経由で各検索APIを呼び出す設定例にも触れている。MCPはAnthropicが策定したオープンプロトコルで、LLMがツールやデータソースを標準インターフェースで呼び出せるようにする仕様だ。Claude Codeでは~/.claude/claude_desktop_config.jsonにMCPサーバー設定を記述することで、エディタ上から直接検索APIを呼び出せるようになる。

元記事ではTavily・Exa・Linkupのそれぞれについて、mcpServersブロックへの記述例が掲載されている。いずれもcommand: "npx"形式でサーバープロセスを起動し、APIキーを環境変数として渡す構造だ。既存のエージェントコードを書き換えずに検索バックエンドを差し替えたい場合、MCPサーバー設定の変更だけで切り替えが完結する点がOpenRouterと並ぶ利点になる。


価格比較一覧

プロバイダー 1,000リクエストあたりコスト アーキテクチャ
Ceramic.ai(Cloudflare経由) $0.25 独立インデックス(400億ページ)
Parallel AI $1.00(Turbo)〜$5.00(Advanced) トークン圧縮セマンティックインデックス
Scrape.do 実効〜$1.16 住宅用プロキシネットワーク
Firecrawl 〜$1.66〜$2.00 ヘッドレスブラウザクローラー
SearchAPI.io $2.86〜$40.00 マルチエンジンSERPスクレイピング
OpenRouter $1.00〜$7.00(パススルー) サーバーサイドLLMツール
Tavily $5.00〜$8.00 LLMネイティブ検索+RAG抽出
Linkup $5.00〜$50.00(Deep) 独立インデックス+グラウンディング
Exa AI $7.00〜$12.00 ニューラルエンベディングインデックス
Cloro $10.00〜$30.00+ ブラウザレベルUIスクレーパー

選定の実際的な指針

記事が示す選び方を要約すると:

  • 高頻度ループでコストを最小化したい → Ceramic.ai($0.25/1K)またはParallel Turbo($1.00/1K)
  • 精度最優先でコンプライアンス要件がある → Linkup(EU、SOC 2、ZDR)
  • セマンティック検索・学術文献・エンティティ探索 → Exa AI
  • RAGパイプラインへの即時統合 → Tavily(LangChain/LlamaIndex対応)
  • DOM処理を丸ごと排除したい → Firecrawl
  • AIアンサーエンジンの実表示を取得したい → Cl