Googleの表示内容を
言語モデルは、今日のGoogleに何が表示されているかを知りません。Semscraperは実際のブラウザでそれを収集し、JSONで返します。
Googleの実際の順位
すべての結果について、ブロック内の順位、ページ内の順位、掲載ページ、ピクセル位置を、最大10ページまで取得します。
AI Overviewsとそのソース
AI Overviewのテキスト、言及されたブランド、引用、ソースパネルを取得します。ページの後から読み込まれる場合も対象です。
AI Overviews →正確なロケーション
186のGoogleバージョン、117の言語、デスクトップとモバイルに対応。都市単位やGPS座標単位で位置を指定できます。
4つの用途
すでに代理店が、当社の順位チェックツールMonitorankのデータを社内のAIツールで活用しています。Semscraperは、同じSERPの生データへのアクセスをAPIで提供します。
AIでの露出を追跡
GoogleがAI Overviewsでどのソースを、どのキーワードで、どの国で引用しているか。実際のページで計測する、GEOの基本データです。
リサーチ・モニタリング用エージェント
レポートを作成したり、市場やブランドを監視したりするエージェントが、記憶ではなくGoogleの実際の検索結果を根拠にできます。
常に最新のRAG
今日Googleが上位に表示しているページをもとに、キーワードごとに定期的にナレッジベースを更新します。
データセットと評価
実際の完全なSERPを大規模に取得し、コーパスを構築したり、モデルの回答をGoogleの表示内容と比較したりできます。
実例:
Semscraperに接続したAIアシスタントに質問しました。アシスタントはGoogleフランスで6件の検索を実行し、ai_overview_sourcesツールがAI Overviewsで引用されたドメインを集計しました。
「家具に関するこの6つの質問で、GoogleはAI Overviewsでどのサイトを引用していますか?」
{
"searches_done": 6,
"with_ai_overview": 5,
"domains_total": 31,
"domains": [
{"domain": "ikea.com", "keywords_count": 2, "mentions": 3, "keywords": ["comment nettoyer un canapé en tissu", "quelle taille de canapé pour un salon"]},
{"domain": "youtube.com", "keywords_count": 1, "mentions": 8, "keywords": ["comment choisir un matelas"]},
{"domain": "maisonsdumonde.com", "keywords_count": 1, "mentions": 5, "keywords": ["comment nettoyer un canapé en tissu"]},
{"domain": "monsieur-meuble.com", "keywords_count": 1, "mentions": 4, "keywords": ["comment nettoyer un canapé en tissu"]},
{"domain": "maisondelaliterie.fr", "keywords_count": 1, "mentions": 3, "keywords": ["comment choisir un matelas"]}
]
}
仕組みは
Semscraperが担うのは「発見」、つまりある質問に対してGoogleがどのページを上位に表示しているかです。その後、必要なページのコンテンツを取得すれば、LLMがソースを示して回答します。
1. キーワードを送信
1回の呼び出しで最大1,000キーワード。国、言語、都市、デバイスを指定できます。すべてのパラメータはGoogle検索APIのページにあります。
2. 構造化されたSERPを受信
URL、タイトル、スニペット、AI Overview、引用をJSONで取得するか、コールバックURLで直接受け取れます。
3. ページを取得してLLMへ
クローラーが選んだURLを読み込み、モデルがそのコンテンツをもとに、ソースを示して回答します。
import time
import requests
API = "https://api.semscraper.com/v1/serp"
HEADERS = {"Authorization": "Bearer API_KEY"}
question = "中小企業 crm おすすめ"
# 1. 質問に対するGoogleのSERP
job = requests.post(API, headers=HEADERS, json=[{"search_engine": "google_search",
"keyword": question, "device": "desktop", "location": "jp", "language": "ja", "depth": 1}]).json()
serp_id = job["data"][0]["id"]
serp = {"status": "pending"}
while serp["status"] != "done":
time.sleep(10)
serp = requests.get(API, headers=HEADERS, params={"ids": serp_id, "output": "json"}).json()["data"][0]
# 2. Googleが上位に表示するソース
urls = [item["url"] for block in serp["results"] if block["type"] == "organic" for item in block["items"][:3]]
# 3. 自前のツールでコンテンツを読み込み、LLMへ
pages = [fetch_page(url) for url in urls]
answer = llm.ask(question, context=pages, sources=urls)
のための設計
各ページは、実際のグラフィカルインターフェースを備えた本物のブラウザで開かれ、業界でも最安水準のコストを保つキューを経由します。そのため、完全なSERPの取得には中央値で約30秒かかります。
| 最適な用途 | 知っておきたいこと |
|---|---|
| バックグラウンドで動くリサーチ・モニタリング用エージェント | 即座に回答する必要があるチャットボットには、リアルタイム専用のツールが適しています。 |
| キーワードごとのAI Overviewsとそのソースの追跡 | APIが返すのはURL、タイトル、スニペットです。選んだページのコンテンツはご自身で取得してください。 |
| 大規模なデータセットと評価 | 同じ深さで比較してください。SemscraperのSERPは10件のリンクではなく、すべてのブロックとピクセル位置を含む最大10ページ分の検索結果です。 |
から直接
SemscraperのMCPサーバーを使えば、1分でAPIをアシスタントに接続できます。検索の実行、結果の待機、集計までをサーバー側で行います。上の例と同じです。
の料金
サブスクリプションはありません。残高をチャージし、取得したSERPごとに差し引かれます。
チャージ金額に応じて1〜10%の割引。残高に有効期限はありません。
さらに詳しく
フランスのAI Overviews:SERPの2件に1件に表示され、その半数は遅れて届く
フランスのGoogle SERPを200万件以上収集しました。100万キーワードをデスクトップで、同じキーワードをモバイルでも取得し、AI Overviewsの実際の出現状況を計測しています。
ガイドを読む →Googleをスクレイピングする方法(2026年版)
Googleの検索結果を大規模に収集する難しさは、かつてないほど増しています。1ページ100件表示は廃止され、AI Overviewsは遅れて読み込まれ、SERPは都市ごとに変わります。選択肢と注意点をまとめました。
ガイドを読む →ピクセル位置:検索1位だけではもう不十分な理由
自然検索結果で1位であることは、検索ユーザーが実際に何を見ているかをほとんど教えてくれません。ピクセル位置は、あなたの結果が実際にどこに表示されているかを計測します。
ガイドを読む →