---
title: BlueskyはXよりAIの学習に使われやすい？意外な落とし穴に注意
url: https://roboin.io/article/2025/12/27/bluesky-is-easier-than-x-for-ai-training/
description: X（Twitter）の代替として注目されているBlueskyですが、実はXよりも投稿がAIの学習に使われやすいという意外な落とし穴があります。
publishedDate: 2025-12-26T22:02:22.182Z
modifiedDate: 2025-12-26T22:02:22.182Z
thumbnail: https://roboin.io/api/media/file/unsplash-robot.jpg
thumbnailAlt: 緑色のロボットが膝の上にノートパソコンを載せた状態で座っている画像
thumbnailCaption: N/A
---

# BlueskyはXよりAIの学習に使われやすい？意外な落とし穴に注意

X（Twitter）の代替として注目されているBlueskyですが、実はXよりも投稿がAIの学習に使われやすいという意外な落とし穴があります。

## BlueskyはAIの学習に使われやすい

Xは、X自身がユーザーの投稿をAIの学習に利用していますが、ほかの企業がAIの学習に使うことは許可していません。

Blueskyでは、[Bluesky自身はユーザーの投稿をAIの学習に利用しないと明言していますが](https://bsky.app/profile/bsky.app/post/3layuzbto2c2x)、ほかの企業がAIの学習に使うことは許可しています。

Xは、ユーザーが自身のポストをXのAIの学習に使われないようにオプトアウト（拒否）できる設定を用意しているので、AIの学習に使われにくいという観点では、むしろBlueskyよりもXの方が優れているとも言えます。

[【2026年最新版】自分のポストがGrokに学習されるのをオフ・拒否する方法](https://roboin.io/article/2025/12/24/how-to-opt-out-of-grok-training-on-your-posts/)

AIの学習データは通常、クローラーと呼ばれる自動化されたプログラムで収集します。

Webサイトは、`robots.txt`というファイルを用意することで、クローラーによるクロール（データ収集）を許可するかどうかを設定できます。

[Xの`robots.txt`](https://x.com/robots.txt)では、Google検索のクローラー（Googlebot）と、Facebookで共有されたリンクの情報をMetaが収集するのに使っているクローラー（facebookexternalhit）を除き、すべてのクローラーをブロックしています。

一方で、[Blueskyの`robots.txt`](https://bsky.app/robots.txt)では、すべてのクローラーに対して、Blueskyのすべてのデータの収集を許可しています。

Blueskyの`robots.txt`のコメント（メモ書き）には、「By default, may crawl anything on this domain.」（デフォルトでは、このドメイン上のあらゆるものをクロールできます）と書かれています。

robots.txtを尊重するかどうかは各クローラーの開発者に委ねられていますが、一部を除いてすべてのクローラーを拒否しているXに対して、Blueskyはすべてのクローラーを明示的に許可しているということになります。

## なぜBlueskyはクロールを許可しているのか

Bluesky自身は、ユーザーのデータをAIの学習に利用しないと明言しているのに、なぜほかの企業がクロールすることは許可しているのでしょうか。

それは、Blueskyが分散型SNSで、クロールを拒否しても意味がないからです。

BlueskyはXのような一般的なSNSと異なり、分散型SNSと呼ばれています。

Xのような一般的なSNSは、中央集権型と呼ばれており、特定の企業や組織がすべてのシステムやデータをコントロールしています。

これに対して、BlueskyやMisskeyのような分散型のSNSでは、システムやデータをコントロールする特定の企業や組織は存在しません。

分散型SNSは、決められた仕組みに従えば、ほかのSNSと相互にやり取りできるようになっています。

たとえば、MisskeyはActivityPubという仕組みを採用しており、同じくActivityPubを採用しているThreadsと相互にやり取りできます。

BlueskyはATプロトコルという仕組みを採用しているので、同じくATプロトコルを採用しているほかのSNSと相互にやり取りできます。

こうした分散型のSNSでは、開発や運営を主導している企業や組織はあるものの、別の運営元の別のSNSとも相互に接続できるので、特定の企業や組織がシステムやデータをコントロールしているわけではありません。

分散型SNSでは、決められた仕組みを実装してさえいれば、誰が作ったどのSNSでも相互に接続できます。

そして、その決められた仕組みを実装していれば、接続するのがSNSである必要すらありません。

つまり、分散型SNSの仕組みを使って、AIの学習データを集めるプログラムも作れるということです。

もしもBlueskyが`robots.txt`でクローラーを拒否したとしても、Bluesky上の投稿を容易に学習データとして収集できます。

このように、クローラーをブロックしても意味がないため、Blueskyはすべてのクローラーがすべてのデータをクロールすることを許可しているのだと考えられます。

## まとめ

BlueskyはXよりも投稿がAIの学習データに使われやすいという、意外な落とし穴を紹介しました。

Xは、ユーザーの投稿をAIの学習データに使っていますが、ユーザーはオプトアウトできます。

Blueskyは、ユーザーの投稿をAIの学習データに使っていませんが、ほかの企業が学習データに使うことは許可しています。

Blueskyは分散型SNSという性質上、クローラーをブロックするのが難しいという事情があります。

AIの学習データに使われにくいという観点でのみ考えれば、むしろBlueskyよりもXの方が優れているとも言えます。