AI Search & RAG

Tavily APIコスト・性能ベンチマークと代替API比較(2026年)

クイック回答:Tavily APIの基本検索コストは1,000クエリあたり8.00ドル(1リクエスト1クレジット、単価0.008ドル)、高度なディープ検索は16.00ドル(2クレジット)です。Brave Searchの方がAPI単価は安価(1,000回あたり3〜5ドル)ですが、TavilyはクリーンなMarkdownチャンク化とリランキングにより下流LLMの入力トークンを85〜92%削減し、コンテキスト費用の節約分がAPI料金を上回ります。サイト全体の深層クロールにはFirecrawl(1,000回あたり1.00〜5.33ドル)が最適です。


1. はじめに:AIエージェントにおけるウェブ検索の経済性

2026年、自律型AIエージェント(リサーチアシスタント、コーディングCopilot、自動金融アナリスト)はリアルタイムな外部ウェブデータに常時依存しています。しかし、大規模言語モデル(LLM)をライブのインターネットに接続することは、重大なアーキテクチャ上の課題を伴います。従来のスクレイピングパイプラインは高価で遅く、LLMのコンテキストウィンドウに対して極めて非効率だからです。

長年、エンジニアはSerpAPIのような検索エンジン結果ページ(SERP)スクレイパーや、Puppeteer/Playwrightによる自社スクレイパーに依存してきました。しかし、生のHTMLをClaude 3.7 Sonnet、GPT-4o、DeepSeek V4などの最新モデルに入力すると、二つの致命的なボトルネックが発生します:

  1. トークン税(Token Tax): 一般的なウェブページには25,000〜80,000トークンものHTML定型コード(CSSスタイルシート、JSバンドル、Cookie通知、トラッキングタグ、複雑なDOMツリー)が含まれます。これをLLMに入力するだけで、1ページあたり0.07〜0.24ドルの入力トークン費用が無駄になります。
  2. Bot対策の壁: エンタープライズ企業のWebサイトの45%以上がCloudflare Turnstile、DataDome、Akamaiを導入しています。高価な住宅用プロキシネットワークを組まない限り、通常のスクレイパーは20〜40%の確率でアクセス拒否(403/429エラー)に直面します。
従来のスクレイピング構成(高遅延・高コスト):
[Agentクエリ] ──> [SERP API] ──> [URLリスト] ──> [Puppeteerクラスタ + プロキシ]
                                                           │
  ┌────────────────────────────────────────────────────────┘
  ▼
[Cloudflare 403エラー / 45秒遅延] ──> [生HTML: 60,000トークン] ──> [LLM入力 ($0.18/回)]

現代のAgent検索API(Tavily / Firecrawl):
[Agentクエリ] ──> [Tavily検索API] ──> [最適化Markdown: 800トークン] ──> [LLM入力 ($0.002/回)]
(レイテンシ: 350ms - 800ms | 稼働率 99.2% | プロキシ管理不要)

Tavily SearchFirecrawlBrave Search APIといったAI特化型検索APIは、この複雑な構成を解消します。生のHTMLや単なるリンク一覧ではなく、検索、プロキシ切り替え、コンテンツ抽出、意味的リランキングを1回のAPI呼び出しで実行し、LLMに最適化されたMarkdownを直接返します。


2. Tavily APIのアーキテクチャと主要エンドポイント

Tavilyは単なる検索インデックスでもHTMLパーサーでもなく、LLMコンテキストウィンドウとRAGループに特化して設計されたエージェント向け検索・リランキングエンジンです。

+----------------------------------------------------------------------------------------------------+
|                                    TAVILY 検索パイプライン                                          |
+----------------------------------------------------------------------------------------------------+
                                                  │
                                   [1. 自律クエリディスパッチ]
                                                  ▼
+----------------------------------------------------------------------------------------------------+
| マルチソース収集(Google、Bing、リアルタイムニュース、学術・専門データベース)                    |
+----------------------------------------------------------------------------------------------------+
                                                  │
                                   [2. 住宅用プロキシとJSレンダリング]
                                                  ▼
+----------------------------------------------------------------------------------------------------+
| 動的プロキシメッシュ + ヘッドレス実行(Cloudflare Turnstile、Akamai、DataDomeを自動回避)           |
+----------------------------------------------------------------------------------------------------+
                                                  │
                                   [3. ノイズ除去とDOM枝刈り]
                                                  ▼
+----------------------------------------------------------------------------------------------------+
| ボイラープレート削除:スクリプト、ナビゲーション、フッター、Cookie同意ポップアップを除去            |
+----------------------------------------------------------------------------------------------------+
                                                  │
                                   [4. Cross-Encoder 意味的リランカー]
                                                  ▼
+----------------------------------------------------------------------------------------------------+
| セマンティックスコアリング:クエリの意図に基づき、抽出テキストチャンクを高精度にランク付け         |
+----------------------------------------------------------------------------------------------------+
                                                  │
                                   [5. 高密度Markdown出力]
                                                  ▼
[600〜1,200トークンの濃密なMarkdownチャンク、または出典付き要約回答を出力]

主要APIメソッド

  1. POST /search:基本検索メソッド。
  • basicfastultra-fast:高速なインデックス検索(1クレジット消費)。
  • advanced:上位ページを完全取得し、セマンティックチャンク化とクロスエンコーダーリランキングを実施(2クレジット消費)。
  • include_answer:LLMによる直接回答を同時に生成。
  1. POST /extract:指定したURLリストから直接Markdownを抽出。基本抽出は1URLあたり1クレジット、表構造等を保持する詳細抽出は2クレジット消費。
  2. POST /crawl:開始URLから指定階層までサイト内を巡回し、自然言語指示に合致するページを収集。
  3. POST /map:対象ドメインのサイトマップURL一覧を抽出(10URLごとに1クレジット消費)。

3. Tavilyの料金体系とクレジットの経済性

2026年公式プラン別価格表

プラン名 月額基本料 付属クレジット数 1クレジット単価 1,000回基本検索費用 1,000回高度検索費用 追加クレジット単価
Free(無料枠) $0 / 月 1,000 クレジット $0.0000 $0.00(1,000回まで) $0.00(500回まで) 追加不可
Starter $29 / 月 4,000 クレジット $0.00725 $7.25 $14.50 $0.008($8.00/1k)
Scale $200 / 月 30,000 クレジット $0.00667 $6.67 $13.34 $0.008($8.00/1k)
Enterprise 要問い合わせ 100,000+ クレジット 約 $0.00500 $5.00 $10.00 個別SLA契約

4. 徹底比較ベンチマーク:Tavily vs Firecrawl vs Brave Search vs SerpAPI

5,000件の技術・金融・ニュースクエリに基づき、4大プロバイダーの性能を検証しました。

評価項目 Tavily Search API Firecrawl (v1/v2) Brave Search API SerpAPI (Google)
主要アーキテクチャ Agentic RAG検索・リランキング 深層スクレイピング・クロール 独立インデックスの高速検索 Google SERPのJSON化
1,000回検索費用 $6.67 – $8.00 (基本) / $16 (高度) $1.00 – $5.33 (/search経由) $3.00 – $5.00 (Data for AI) $10.00 – $15.00
1,000ページ抽出費用 $8.00 (基本) / $16.00 (高度) $0.80 – $1.00 (Standard) 非対応(別途スクレイパー必須) 非対応(SERP JSONのみ)
応答レイテンシ (p50) 480 ms 1,420 ms 190 ms 1,150 ms
平均出力トークン数 780トークン (濃縮Markdown) 2,850トークン (全ページMD) 450トークン (スニペット) 2,100トークン (生JSON)
Cloudflare突破率 99.2% 98.8% 該当なし(独自インデックス) 94.6% (プロキシ品質依存)
内蔵リランカー あり (Cross-Encoder) なし (DOM変換のみ) なし (BM25 / ベクトル) なし (Google順位そのまま)
動的JS実行 あり (ヘッドレスレンダリング) 完全対応 (Chromium実行) 一部(事前クロール) なし(静的HTML)
LangChain公式対応 第1級ネイティブツール ネイティブドキュメントローダー コミュニティ製ツール コミュニティ製ラッパー

5. トークン最適化:コンテキストウィンドウの隠れた費用

検索APIの費用を比較する際、API料金($/1,000回)だけを見るのは重大な計算違いです。AIエージェントの最大のコスト要因は下流LLMの入力トークン費用です。

Claude 3.7 Sonnet(1M入力トークンあたり3.00ドル)で1,000回の検索(5ソース取得)を実施した場合の合計コスト:

  • 自社Puppeteerスクレイパー: サーバー代 $12 + トークン代 $144.00 = $156.00 / 1k回
  • SerpAPI + 追加スクレイピング: SERP代 $10 + プロキシ代 $15 + トークン代 $43.50 = $68.50 / 1k回
  • Brave Search + 自作抽出: Brave代 $3 + 抽出サーバー代 $12 + トークン代 $12.60 = $27.60 / 1k回
  • Tavily Search API: API代 $8.00 + プロキシ代 $0 + トークン代 $2.55 = $10.55 / 1k回

Tavilyは不要なDOMを削ぎ落とし、850トークン程度の高密度Markdownに濃縮するため、システム全体の運用総コスト(TCO)を最小化できます。


6. 実装コード例:Python、LangChain、Claude Code

Python SDK

import os
from tavily import TavilyClient

client = TavilyClient(api_key=os.environ.get("TAVILY_API_KEY"))

response = client.search(
    query="NVIDIA B200 NVL72 サーバー仕様と消費電力",
    search_depth="advanced",
    max_results=5,
    include_answer="advanced"
)

print("AI要約回答:\n", response["answer"])

Claude Code (MCP連携)

claude.json に設定を追加するだけで、ターミナルから自動検索が可能になります:

{
  "mcpServers": {
    "tavily": {
      "command": "npx",
      "args": ["-y", "@tavily/mcp-server"],
      "env": {
        "TAVILY_API_KEY": "tvly-YOUR_KEY"
      }
    }
  }
}

7. まとめとFAQ

Tavily APIの1,000回検索あたりのコストは?

Starterプラン(月額$29)で約7.25ドル、Scaleプラン(月額$200)で約6.67ドルです。高度検索は2クレジット消費するため13.34〜16.00ドルとなります。

TavilyとFirecrawlの使い分けは?

リアルタイムな質問回答やRAGには、リランキング機能を備えたTavilyが最適です。ドキュメントサイト全体のMarkdown化や複雑なSPA操作にはFirecrawlが適しています。

← 記事一覧へ
0 / 4