Googlebotが

SEOの技術的な詳細を掘り下げる前に、 Googlebotの役割Google検索の中核を担うクローラー、Googlebotについて解説します。このセクションでは、Googlebotとは何か、どのように機能するのか、SEOにとってなぜ重要なのか、そしてサイトへのアクセスを管理する方法について解説します。この基礎知​​識を身につけることで、ウェブサイトのコンテンツがGoogleの検索結果にどのように表示されるのか、全体像を把握できるようになります。

Googlebot とは何ですか?

Googlebotは プライマリウェブクローラー Googleがインターネット上のコンテンツを発見、クロール、インデックスするために使用する検索エンジンです。仮想の司書のように機能し、ウェブサイトを継続的に訪問し、コンテンツを読み、Google検索結果にどのように表示するかを決定します。

Googlebotがなければ、Googleはあなたのページの存在を認識できません。だからこそ、GooglebotはSEO担当者やウェブサイト運営者にとって最も重要なクローラーなのです。

Googlebotの仕組み

誰かがコンテンツを公開または更新すると、Googlebot は次の処理を実行します。

  1. URLを検索 リンク、サイトマップ、または以前のクロールを通じて。

  2. ページコンテンツを取得します 新しいものを見るために。

  3. Googleのインデックスシステムに送信する関連性、品質、ランキングが分析されます。

Googlebotの種類

Google は、デバイスに応じて異なるバージョンの Googlebot を使用します。

タイプ ユーザーエージェント文字列 目的
Googlebot デスクトップ Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html) デスクトップ ブラウザからの場合と同じように Web サイトをクロールします。
Googlebot スマートフォン Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/... (compatible; Googlebot/2.1; +http://www.google.com/bot.html) モバイル端末からのようにウェブサイトをクロールします。これが デフォルトのクローラー Googleは モバイルファーストインデックス作成.

GooglebotがSEOにとって重要な理由

  • 発見: Google が新しいページや更新されたページを見つけるのに役立ちます。

  • クロール予算: 大規模なサイトでは、Googlebot がページをクロールする頻度と深さを管理する必要があります。

  • インデックス作成: Googlebot がコンテンツを取得できない場合、そのコンテンツは検索結果に表示されません。

  • モバイル ファースト インデックス作成: Googlebot スマートフォンがデフォルトなので、サイトはモバイル向けに最適化されている必要があります。

Googlebot のよくある問題

ウェブサイトが意図せずGooglebotをブロックし、SEOに悪影響を与えることがあります。よくある問題には次のようなものがあります。

  • ブロックする robots.txt (詳しくは robots.txtガイド).

  • Googlebot がコンテンツにアクセスできなくなるサーバー エラー (5xx)。

  • 読み込み時間が遅い、またはリソースがブロックされている (CSS や JavaScript など)。

Googlebot を確認する方法

クローラーが本当に Googlebot であり、偽のボットではないことを確認するには:

  1. IP アドレスについてはサーバー ログを確認してください。

  2. 実行する 逆DNSルックアップ それが解決されるかどうかを確認します googlebot.com or google.com.

  3. やる フォワードDNSルックアップ IP が一致することを確認します。

Googlebotがサイトにアクセスする方法

Googlebot はさまざまな方法を使用してページを検出し、取得します。

  • 次のリンク: 他の Web サイトまたは独自の内部リンクから。

  • XMLサイトマップ: Googlebot は、送信されたサイトマップに新しい URL がないか定期的に確認します。

  • RSS/Atomフィード: 最新のアップデートをすぐに見つけるのに役立ちます。

  • 以前に知られていた URL: すでに Google のインデックスに登録されているページは、変更を確認するために再度訪問されます。

Googlebotによるサイト訪問をブロックする

サイト所有者によっては、Googlebot による特定のページのクロールをブロックする必要がある場合があります。これにはいくつかの方法があります。

  • robots.txt: Disallow Googlebot による特定のパスのクロールを停止するディレクティブ。

  • メタロボットタグ(noindex): ページがインデックスに登録されないようにします (ただし、Googlebot は引き続きクロールする可能性があります)。

  • X-Robots-Tag HTTP ヘッダー: メタ ロボット タグのように機能しますが、サーバー レベルで適用されます。

  • パスワード保護: 許可されない限り、Googlebot はログインの壁の背後にあるコンテンツにアクセスできません。

ロケット

SEOを自動化する

1 クリックでオーガニック トラフィックを増やすことができます。

今すぐ最適化を始めましょう!

SEOアカデミー

  1. AMP