SEOの技術的な詳細を掘り下げる前に、 Googlebotの役割Google検索の中核を担うクローラー、Googlebotについて解説します。このセクションでは、Googlebotとは何か、どのように機能するのか、SEOにとってなぜ重要なのか、そしてサイトへのアクセスを管理する方法について解説します。この基礎知識を身につけることで、ウェブサイトのコンテンツがGoogleの検索結果にどのように表示されるのか、全体像を把握できるようになります。
Googlebot とは何ですか?
Googlebotは プライマリウェブクローラー Googleがインターネット上のコンテンツを発見、クロール、インデックスするために使用する検索エンジンです。仮想の司書のように機能し、ウェブサイトを継続的に訪問し、コンテンツを読み、Google検索結果にどのように表示するかを決定します。
Googlebotがなければ、Googleはあなたのページの存在を認識できません。だからこそ、GooglebotはSEO担当者やウェブサイト運営者にとって最も重要なクローラーなのです。
Googlebotの仕組み
誰かがコンテンツを公開または更新すると、Googlebot は次の処理を実行します。
-
URLを検索 リンク、サイトマップ、または以前のクロールを通じて。
-
ページコンテンツを取得します 新しいものを見るために。
-
Googleのインデックスシステムに送信する関連性、品質、ランキングが分析されます。
Googlebotの種類
Google は、デバイスに応じて異なるバージョンの Googlebot を使用します。
| タイプ | ユーザーエージェント文字列 | 目的 |
|---|---|---|
| Googlebot デスクトップ | Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html) |
デスクトップ ブラウザからの場合と同じように Web サイトをクロールします。 |
| Googlebot スマートフォン | Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/... (compatible; Googlebot/2.1; +http://www.google.com/bot.html) |
モバイル端末からのようにウェブサイトをクロールします。これが デフォルトのクローラー Googleは モバイルファーストインデックス作成. |
GooglebotがSEOにとって重要な理由
-
発見: Google が新しいページや更新されたページを見つけるのに役立ちます。
-
クロール予算: 大規模なサイトでは、Googlebot がページをクロールする頻度と深さを管理する必要があります。
-
インデックス作成: Googlebot がコンテンツを取得できない場合、そのコンテンツは検索結果に表示されません。
-
モバイル ファースト インデックス作成: Googlebot スマートフォンがデフォルトなので、サイトはモバイル向けに最適化されている必要があります。
Googlebot のよくある問題
ウェブサイトが意図せずGooglebotをブロックし、SEOに悪影響を与えることがあります。よくある問題には次のようなものがあります。
-
ブロックする
robots.txt(詳しくは robots.txtガイド). -
Googlebot がコンテンツにアクセスできなくなるサーバー エラー (5xx)。
-
読み込み時間が遅い、またはリソースがブロックされている (CSS や JavaScript など)。
Googlebot を確認する方法
クローラーが本当に Googlebot であり、偽のボットではないことを確認するには:
-
IP アドレスについてはサーバー ログを確認してください。
-
実行する 逆DNSルックアップ それが解決されるかどうかを確認します
googlebot.comorgoogle.com. -
やる フォワードDNSルックアップ IP が一致することを確認します。
Googlebotがサイトにアクセスする方法
Googlebot はさまざまな方法を使用してページを検出し、取得します。
-
次のリンク: 他の Web サイトまたは独自の内部リンクから。
-
XMLサイトマップ: Googlebot は、送信されたサイトマップに新しい URL がないか定期的に確認します。
-
RSS/Atomフィード: 最新のアップデートをすぐに見つけるのに役立ちます。
-
以前に知られていた URL: すでに Google のインデックスに登録されているページは、変更を確認するために再度訪問されます。
Googlebotによるサイト訪問をブロックする
サイト所有者によっては、Googlebot による特定のページのクロールをブロックする必要がある場合があります。これにはいくつかの方法があります。
-
robots.txt:
DisallowGooglebot による特定のパスのクロールを停止するディレクティブ。 -
メタロボットタグ(
noindex): ページがインデックスに登録されないようにします (ただし、Googlebot は引き続きクロールする可能性があります)。 -
X-Robots-Tag HTTP ヘッダー: メタ ロボット タグのように機能しますが、サーバー レベルで適用されます。
-
パスワード保護: 許可されない限り、Googlebot はログインの壁の背後にあるコンテンツにアクセスできません。