SEOの基礎と対策方法を公開

ディーボのSEOラボ

  • お問い合わせ

robots.txtとは?書き方や設定方法など徹底解説!

SEO

robots.txtとは、Webサイトのファイル(ページやディレクトリ)の内容を認識する「クローラー」の動作をコントロールする際に記述するテキストファイル(.txt)のことを指します。
このrobots.txtは、主にクロール制限を行う際に活用します。
クロール制限は、大規模サイトにおける膨大な不要ページに対して行うケースが多く、SEOに有効な場合があります。

\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

またrobots.txtに、User-Agentでクローラーの種類を指定して、そのクローラーが拒否したいファイルのURLパス(特定のファイル)をDisallowで指定して記述します。
記述したロボッツテキストファイル(robots.txt)をサーバーにアップすることで、指定したクローラーがサイト内の特定ファイルを巡回しないように命令できます。

このような用途など踏まえて、今回はrobots.txtの書き方など中心に初心者にもわかりやすくポイントをまとめて解説したいと思います。

この記事でわかること

  • robots.txtは、クローラーの巡回を制御するテキストファイルで、主にクロール制限に使う
  • User-Agent・Disallow・Allow・Sitemapの基本的な書き方
  • 動作確認の方法と、活用するうえでの注意点

おすすめの読者層

  • robots.txtの正しい書き方と設置方法を知りたいサイト運営者の方
  • 大規模サイトで不要ページへのクロールを制限したいSEO担当者の方
robots.txtとは?書き方などわかりやすく解説
\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

robots.txtとは?

robots.txtとは、クローラーの動作をコントロールする際に記述する テキスファイル(.txt)のこと

robots.txtとは、冒頭でも少し触れましたが、サイトを巡回するクローラーの動作をコントロールするために記述するテキストファイル(.txt)のことです。

主に、クローラーにサイト内のページ(ブログ記事)やディレクトリといったファイルへの巡回を制限する指定を記述するときに robots.txt(ロボッツテキスト) を用いることが多いです。
これは、User-Agentでクローラーの種類を指定し、巡回させたくないファイルをDisallowを用いて記述することで、クローラーの巡回が制限できます。

基本的にはサイト運用の初期段階でクロール制限することはないので、「すべてのクローラーのサイト内巡回を許可する」以下の記述をして、robots.txtをサーバにアップしておくとよいでしょう。

その他、不要な画像やCSS、javascriptファイルへのクロールを制限してリソースを軽減したり、サイトマップの存在を知らせるための記述もできます。

このような用途が基本となりますが、とくにページ数が膨大な大規模サイトではrobots.txtによるクロール制限を「クロール最適化」として活用する手段もあり、SEOにおいても有効です。

\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

SEOにおけるrobots.txtの重要性

重要なページをGoogleに認識させることがSEOにおいて重要

robots.txtは、簡単に言うと、重要なページをうまく認識させるためのハブ役です。
重要なページは、robots.txtを積極的に利用しなくても小規模サイトであれば通常はクロールされます。

しかし、amazonや楽天などのページ数が膨大にあるような大規模なサイトでは、低品質なページや、内部リンクと被リンクが少なくてリンク階層が深いページが多く見受けられます。
そうなれば、クローラーが効率よくサイト内のWebページを巡回できないので、重要なページがクロールされない可能性があります。
このような場合に、robots.txtの活用が有効です。
例えば、不要なファイル(ページ/ディレクトリ/css/javascript/画像など)をクロール拒否して、クロールのリソースを重要なページに配分するようにクロールバジェット最適化(クロール最適化)を行う方法があります。

このように、クローラビリティを改善して、重要なページをうまくクロールさせるようにrobots.txtを活用することが、SEOにおいて重要となります。

\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

robots.txtの書き方

robots.txtの基本的な書き方を覚えよう!

robots.txtは、先述した通り、クロール制限やサイトマップの指定を行う際に利用します。
なので、これらの用途がrobots.txtにおける基本的な書き方となるので、しっかり記述方法を抑えておきましょう。

\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

基本形式の記述

サイト運用の初期段階・通常のサイトにおいては、特定のクロールを制御する必要性が低いので、基本的に以下の記述をしておくと良いでしょう。
そして、サイトマップの設置が済んでれば、そのパスを追記しておくとなお良いでしょう。

このようにrobots.txtを作成するには、新規テキストファイル(ファイル名は基本的に「robots.txt」)に必要なコードを記述してサーバーにアップします。

その後は、サーチコンソールのrobots.txtレポートで取得状況を確認しつつ、robots.txtファイルはサーバー上で直接作成・編集して運用すると確実です。
※参考:robots.txtの動作確認方法

制御したいクローラーを指定する

Googlebotと呼ばれるメインのクローラー以外にも、クローラーは複数の種類があります。
その中からあらかじめ公式サイトで定義されてるクローラー名を「User-Agent」を使って指定して、クロール制御(制限)の記述を開始する形になります。

全てのクローラーを指定する場合
Googleのクローラーを指定する場合
Google画像検索のクローラーを指定する場合

サイト運用初期や通常は、すべてのクローラーを対象にすることが多いので、基本的にUser-Agentはワイルドカードの1つとなる「*(アスタリスク)」を指定しておくとよいでしょう。
その他のUser-Agentは、ホームページを運用してる間に必要あれば、利用する形になります。

クロールを制限する

クロールを制限するには、「User-Agent」の記述と共に、「Disallow」を使ってクロール拒否したいページやディレクトリのURLパス(ルートドメインに対する相対URL)を記述する形になります。

ディレクトリの場合
ページの場合
サイト全体の場合

このように、「Disallow」にファイル名を記述して、ページやディレクトリを絞り込むことでクロール制限したいファイルが限定できます。

robots.txtではあくまでもクロールの拒否ということを認識しておきましょう。
ちなみに、検索エンジンからのアクセスを拒否したい場合は、robots.txtと併用して、.htaccessファイルでのパスワード保護やnoindexタグを組み合わせて使う手段があります。

クロールを許可する

クロール拒否の指定ができる「Disallow」と真逆の「Allow」ですが、この記述はわざわざ書かなくてもデフォルトがクロール許可となるので、使う機会が少ないのが現状です。

では、実際にどんなときに使うかというと、すでに「Disallow」を使っていて、特定のページやディレクトリだけクロール許可したい場合にAllowを指定する使い方になります。

特定のページのみ許可する場合

このように、「Allow」にページやディレクトリのURLパスを記述して、特定のファイルへクロールを促すことができます。

サイトマップを知らせる

サイトマップはhtml形式やxml形式が多くありますが、いずれにせよクロールされやすい状況にあるか否かが、この「Sitemap」の記述の使い分けとなります。
なので、例えば、XML形式であればWebページから直接リンクが辿れないので、robots.txtにURLパスを記述しておくと、クローラーが見つけやすくなるので効果的です。
HTML形式(sitemap.html)なら、だいたいTOPページなどの重要なページから直接リンクされてクロールされやすい状態なので、そこまで記述する必要性はないでしょう。

XMLサイトマップの場所をクローラーに知らせる場合

このように、Sitemapにサイトマップのパスを記述することで、クロールを促すことが可能です。
複数ある場合には改行して記述しましょう。

\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

robots.txtの動作確認方法

robots.txtの記述内容が正しいかどうか?動作チェックしよう!

robots.txtを設置しても、記述が正しくないとクローラーの動作をコントロールできません。
そこで、公開したrobots.txtが正しく取得・認識されているか?を確認しておくことが重要です。
※かつてサーチコンソールに搭載されていた「robots.txt テスター」は、2023年12月に提供が終了しました。現在は以下の方法で確認します。

サーチコンソールのrobots.txtレポートで確認する

サーチコンソールの「設定」>「robots.txt」(robots.txtレポート)を開くと、Googleが取得したrobots.txtのファイル・最終確認日時・取得ステータス・問題の件数を確認できます。
ステータスが「取得済み」になっていれば、Googleがrobots.txtを正しく読み取れています。ファイル行をクリックすると、Googleが認識している記述内容も確認できます。

サーチコンソールのrobots.txtレポートで、Googleが取得したrobots.txtの状態を確認する

特定ページのブロックはURL検査ツールで確認する

「このページはrobots.txtでブロックされていないか?」を個別に確認したい場合は、サーチコンソールのURL検査ツールに対象URLを入力します。
検査結果の「クロール」欄で、robots.txtによってブロックされていないか(クロールを許可されているか)を確認できます。

また、robots.txtの記述構文そのものをチェックしたい場合は、Google公式のオープンソース版robots.txtパーサーや、サードパーティのrobots.txtテスターも利用できます。

このように、robots.txtが正しく取得・認識されているか?確認して、必要に応じて確実にクロール拒否することがサイトのパフォーマンスを管理するうえで重要と言えます。

\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

robots.txtを活用する上での注意点

robots.txtを活用するうえで注意点を念頭に入れておこう

robots.txtを活用する上で、Webサイトへの影響や使い分け、挙動などを理解しておく必要があります。
なので以下のような注意点を念頭に入れた上で、robots.txtをサイト運用に役立てましょう。

  • robots.txtの記述内容が反映されるまでにタイムラグがある。
  • Webページのクロールは拒否するが、ユーザーはそのWebページにアクセスできる。
  • アドレスバーにURLを入力すれば、robots.txtの内容が外部に見られる。(例:http://example.com/robots.txt)
    見られたくない情報があればアクセス制限を欠けて対処しておきましょう。
  • 重複コンテンツの対処法としては不完全なので、適切にな方法で対処する
  • 数千以下のURL数(数千ページ以下)であれば、基本的にrobots.txtでクロール最適化を行う必要性は低い

このような点を意識して効果的にrobots.txtを活用しながら、重要なページをインデックスさせるなど、サイトのパフォーマンス管理に役立てることが大切です。

\申込簡単!今なら、欠点がわかる調査結果資料無料配布中!SEO無料調査を申し込む

まとめ

robots.txtを必要に応じて活用し、サイトのパフォーマンスを管理しましょう。

重要なWebコンテンツがGoogleにしっかり認識されるようにリンクやファイルサイズなど最適化しながら、サイトの質を上げるようにSEO対策を進めることが大切です。

よくある質問

Q.robots.txtとは何ですか?

A.検索エンジンのクローラーの動作をコントロールするためにサイトのルートに設置するテキストファイルです。主に特定ページやディレクトリへのクロールを制限する際に使います。

Q.robots.txtはどう書けばいいですか?

A.User-agentで対象クローラーを指定し、Disallowでクロール制限、Allowで許可するパスを記述します。Sitemap行でサイトマップの場所を知らせることもできます。

Q.robots.txtでブロックすれば検索結果から消せますか?

A.消せるとは限りません。robots.txtはクロールを制限するだけで、リンクなどから発見されればインデックスされることがあります。確実に非表示にするにはnoindexを使います。

監修者 南保生明(株式会社ディーボ 営業統括マネージャー)

この記事の監修者

南保 生明 なんぽ たかあき

株式会社ディーボ SEO事業部 営業統括マネージャー。2006年入社、WEBマーケティング全般の提案・コンサルティングに従事。コンテンツマーケティングツール「キーワードファインダー」を累計7,000ユーザー以上に成長させ、SEOセミナー講師も務める。

プロフィール詳細 ⇒

SEO対策しても検索順位が上がらない…なぜ?

検索順位の推移

SEO対策しても検索順位が上がらない…なぜ?

検索順位が上がらない理由は、SEO対策の質が低いからです。

例えば、ユーザーの検索意図を無視したり、関連性の低いコンテンツを増やす、内部リンクの最適化など疎かにします。
この場合、SEO対策の質が下がります。
そうなれば、ページやサイト自体の品質が上がらないので、Googleに評価されづらくなります。
結果、検索順位が上がらないというわけです。

こうした悪い状況を回避する為に、サイトの欠点を調査して上位化に必要な対策をご案内します(無料)。

#robotstxt

検索順位を上げたり、検索流入を増やすにはSEOが重要!


イチから学ぶSEOの教科書 【2026年最新版】
イチから学ぶSEOの教科書【2026年最新版】DL簡単! SEOの基本丸わかり資料無料GET!SEO資料を無料ダウンロードする
×