<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<oembed>
  <author_name>doudoudoudou</author_name>
  <author_url>https://blog.hatena.ne.jp/doudoudoudou/</author_url>
  <blog_title>SEO最前線</blog_title>
  <blog_url>https://seo-frontline.com/</blog_url>
  <categories>
    <anon>SEO</anon>
    <anon>海外SEO</anon>
    <anon>AI検索</anon>
  </categories>
  <description>概要 米国のデジタル出版社を代表する業界団体であるDigital Content Next (DCN)は、Common Crawl Foundationに対し、停止勧告書を送付しました。 この書簡は、Common Crawlが出版社コンテンツの収集を停止し、既にデータセットに含まれている資料を削除することを要求しています。 Common Crawlは2007年以来、毎月数十億ページをクロールし、無料の公開アーカイブを構築してきました。 このアーカイブは、現在利用されている多くのAIモデルのトレーニングに使用されており、例えばOpenAIのGPT-3は、トレーニングミックスの60%にフィルタリン…</description>
  <height>190</height>
  <html>&lt;iframe src=&quot;https://hatenablog-parts.com/embed?url=https%3A%2F%2Fseo-frontline.com%2Fentry%2F2026%2F06%2F11%2F110724&quot; title=&quot;米出版社がCommon Crawlによるコンテンツスクレイピング停止を要求 - SEO最前線&quot; class=&quot;embed-card embed-blogcard&quot; scrolling=&quot;no&quot; frameborder=&quot;0&quot; style=&quot;display: block; width: 100%; height: 190px; max-width: 500px; margin: 10px 0px;&quot;&gt;&lt;/iframe&gt;</html>
  <image_url>https://cdn.searchenginejournal.com/wp-content/uploads/2026/06/171c63b2-642b-46fd-9961-cf661cd21c20-25.jpeg</image_url>
  <provider_name>Hatena Blog</provider_name>
  <provider_url>https://hatena.blog</provider_url>
  <published>2026-06-11 11:07:24</published>
  <title>米出版社がCommon Crawlによるコンテンツスクレイピング停止を要求</title>
  <type>rich</type>
  <url>https://seo-frontline.com/entry/2026/06/11/110724</url>
  <version>1.0</version>
  <width>100%</width>
</oembed>
