---
title: イラストや文章がAIに学習されることを防ぐ技術的な方法4選
url: https://roboin.io/article/2024/11/23/how-to-protect-your-content-from-ai-learning/
description: この記事では、生成AIに自分のコンテンツを学習されることを防ぐ技術的な方法について紹介します。
publishedDate: 2024-11-22T17:12:41.000Z
modifiedDate: 2024-11-22T17:12:41.000Z
thumbnail: https://roboin.io/api/og/2024/11/23/how-to-protect-your-content-from-ai-learning/
thumbnailAlt: 記事のサムネイル画像
thumbnailCaption: N/A
---

# イラストや文章がAIに学習されることを防ぐ技術的な方法4選

近年では、ChatGPTやStable Diffusionをはじめとした生成AIが普及しています。これらの生成AIは、インターネット上から自動的に収集した大量の学習データを用いて学習しています。一方で、生成AIに自分のコンテンツを学習されたくないという人もいると思います。

この記事では、生成AIに自分のコンテンツを学習されることを防ぐ技術的な方法について紹介します。

:::caution
この記事の情報は記事執筆時点のものです。

この記事で紹介するほとんどの方法はAIによる学習を望まない意思を表明するためのものであり、その意思に従うかどうかはAIの開発者に委ねられています。

また、クローラー（自動的に画像を収集するBot）の対策を中心に紹介しています。悪意のある人間による手作業でのコンテンツ収集を防ぐ方法は、別のサイトを参照してください。
:::

## 1. オプトアウト設定を使用する

一部のプラットフォームは、生成AIによる学習データとして使用されることを望まないユーザーが、オプトアウト設定をできるようになっています。

詳しくは、次の記事を参照してください。

[X（Twitter）の利用規約が改訂へ　投稿がAIの学習に利用されるって本当？](https://roboin.io/article/2024/10/17/the-truth-about-twitter-tos-and-privacy-policy-changes/)

[X（Twitter）でGrokの学習をオフにする方法　Grokでスマホが熱くなるって本当？](https://roboin.io/article/2024/08/05/how-to-prevent-your-content-from-being-learned-by-grok/)

[Adobe製品で作った作品がAIの学習に使われる？規約変更に関するデマに注意](https://roboin.io/article/2024/06/09/misunderstandings-about-adobe-machine-learning/)

[WordPressやTumblrがAIに学習されるのを防ぐ方法](https://roboin.io/article/2024/03/03/how-to-prevent-ai-from-learning-your-wordpress-and-tumblr-content/)

[FigmaのAI機能と学習を無効にする方法](https://roboin.io/article/2024/07/07/how-to-disable-figma-ai-feature-and-opt-out-content-training/)

[noteの記事がデフォルトでAI学習に利用へ　学習を拒否する方法は？](https://roboin.io/article/2025/06/17/note-sets-ai-training-as-default-for-user-content/)

## 2. robots.txtを使用する

生成AIの学習データは、クローラーと呼ばれるBotがインターネット上を巡回して収集しています。

robots.txtは、クローラーがクロールする際に参照するファイルです。robots.txtを使用することで、クローラーに対してクロールを許可するページや許可しないページを指定できます。

robots.txtの指示に従うことは義務ではなく、一部のクローラーはrobots.txtを無視することがあります。しかし、一般的なクローラー、とくに有名な企業のクローラーであればrobots.txtを尊重することが多いため、robots.txtを活用することで生成AIに学習されるリスクを軽減できます。

robots.txtは、Webサイトのルートディレクトリーに配置します。たとえば、当サイトのrobots.txtは次のURLから参照できます。

- [https://roboin.io/robots.txt](https://roboin.io/robots.txt)

robots.txtを使ってクローラーによるクロールを拒否したい場合、ホワイトリスト形式とブラックリスト形式の2つの方法があります。

ホワイトリスト形式は、特定のクローラーにのみクロールを許可し、それ以外のすべてのクローラーによるクロールは禁止するという形式です。ブラックリスト形式はその逆で、特定のクローラーを禁止し、それ以外のすべてのクローラーによるクロールは許可するという形式です。

生成AIの学習データとして使用されることを可能な限り防ぎたい場合は、ホワイトリスト形式を使うことがオススメです。次の例は、GoogleとBing、Yahoo!の検索エンジンのクローラーは許可し、それ以外は拒否するrobots.txtの例です。

```http
User-agent: Googlebot
Allow: /

User-agent: Bingbot
Allow: /

User-agent: Slurp
Allow: /

User-agent: *
Disallow: /
```

また、すべてのクローラーを拒否したい場合は、次のようにします。ただし、この場合はGoogleなどの検索結果にも表示されなくなるため注意してください。

```http
User-agent: *
Disallow: /
```

参考：

- [robots.txt の概要とガイド | Google 検索セントラル  |  ドキュメント  |  Google for Developers](https://developers.google.com/search/docs/crawling-indexing/robots/intro?hl=ja)
- [robots.txt の書き方、設定と送信 | Google 検索セントラル  |  ドキュメント  |  Google for Developers](https://developers.google.com/search/docs/crawling-indexing/robots/create-robots-txt?hl=ja)

## 3. メタタグを使用する

DeviantArtなどが提唱している、`noai`というタグがあります。robots.txtほどは普及していない新しい規格ですが、将来的にはさらに普及する可能性があります。

robots.txtと同様に、このタグに従うことは義務ではありません。しかし、単純にクローラーをブロックするだけのrobots.txtと違い、こちらの方法ではAIによる学習を望まない旨をより直接的に表明できます。

`noai`タグを使うには、対象となるWebページのHTMLの`<head>`タグ内に次のように記述します。

```html
<meta name="robots" content="noai, noimageai">
```

または、HTTPヘッダーに次のような記述を追加します。

```http
X-Robots-Tag: noai, noimageai
```

参考：

- [UPDATE All Deviations Are Opted Out of AI Datasets by team on DeviantArt](https://www.deviantart.com/team/journal/UPDATE-All-Deviations-Are-Opted-Out-of-AI-Datasets-934500371)

## 4. スクレイピング保護機能を使用する

Cloudflareなどの一部のサービスは、AIの学習データを収集しているクローラーによるアクセスを自動的にブロックする機能を提供しています。

こうした機能を利用することで、robots.txtや`noai`タグを無視するクローラーを効果的にブロックできます。

CloudflareのAIスクレイピング防止機能の詳細については、こちらの記事で紹介しています。

[AIスクレイピング防止機能をCloudflareがリリース　設定方法は？](https://roboin.io/article/2024/07/04/cloudflare-protects-content-from-ai-crawlers/)

## まとめ

この記事では、生成AIに自分のコンテンツを学習されることを防ぐ技術的な方法について紹介しました。

生成AIの学習データとして使用されることを可能な限り防ぎたい場合は、robots.txtや`noai`タグ、スクレイピング保護機能を活用することがオススメです。