Google は、AI モデルを改善するために、画像、ファイル、音声およびビデオ記録などの個人データを大幅に保存できるようにプライバシー設定を密かに変更しました。 TechCrunch によると、このアップデートは、Google の検索サービスにメディアをアップロードすると、手動でオプトアウトしない限り、そのメディアを同社の人工知能のトレーニングに使用できるようになるということを意味します。この変化により、大手テクノロジー企業が AI 用のデータをどのように収集するかについて改めて厳しい目が向けられるようになりました。これは、私たちの AI ニュース速報 の報道が、データ慣行の進化を綿密に追跡している類の話です。

選択を装ったオプトイン

この変化は、Google の検索サービスのプライバシー設定に対する目立たないアップデートによってもたらされ、6 月に顧客の電子メールを通じて初めて発表されました。 TechCrunchのサラ・ペレス氏が報じたように、同社は基本的に、ユーザーが保存された履歴やパーソナライズされた推奨事項をより詳細に制御できるようにするための変更を枠組みとして、拡張されたAIトレーニングに人々を参加させることを選択した。

このアップデートでは、検索サービス履歴パーソナライズされた推奨事項 という 2 つの新しい設定が導入されました。これらは合わせて、Google エクスペリエンスをパーソナライズするためにユーザー アクティビティがどのように使用されるか、およびウェブとアプリのアクティビティが保持される期間を制御します。 Google はユーザーに AI トレーニングへの積極的な同意を求めるのではなく、新しいデータ収集をデフォルトで有効にし、ユーザーが自分で見つけて無効にすることを要求しました。

プライバシー擁護団体は、この設計を古典的な「暗いパターン」であると批判しており、抵抗が最も少ない経路によりユーザーが思っている以上に多くのデータを共有することになる。

現在キャプチャされているもの

拡張されたトレーニング範囲は、テキスト検索クエリをはるかに超えています。 TechCrunch によると、この変更は以下を含む Google の広範な検索エコシステム全体に適用されます。

  • Google マップ
  • ショッピング
  • フライト
  • ホテル
  • 翻訳
  • ニュース

この幅広さは、多くの日常的な Google 製品を流れるメディアが同社の AI モデルにフィードを提供できることを意味します。このアップデートは、特に画像、ファイル、音声およびビデオの記録を対象としています。

具体例

いくつかの一般的なインタラクションがその傘下に収まるようになりました。 Google レンズを使用して写真を撮って視覚的に何かを検索すると、その画像が AI トレーニング用に保存されることがあります。新しい ライブ検索 機能を使用して、Google アプリで音声入力によって検索すると、それらの音声録音を保存できます。 Google 翻訳を使用して言語を話す練習をすると、その音声も保存されます。

音声検索や写真検索が一時的なものであると考えていたユーザーにとって、この拡張は、Google が保持する内容とその目的に意味のある変化をもたらします。

Google がデータを必要とする理由

この変化は、必要なあらゆる手段を使ってトレーニング データを収集するという業界全体の傾向を反映しています。 TechCrunchが指摘したように、Googleとその競合他社は、オープンウェブから収集した情報だけに依存するのではなく、自社製品から直接取得したファーストパーティデータをますます望んでいる。

高品質のマルチモーダル データ、コンテキストと組み合わせた画像、トランスクリプトを含む音声、メタデータを含むファイルは、AI モデルを改善するための最も貴重なリソースの 1 つになっています。テキスト、画像、音声 AI の分野で OpenAI や Anthropic などと競合する Google にとって、自社のサービスはそのようなデータのユニークな豊富なソースです。プライバシーの変更により、毎日の数十億のユーザー インタラクションが潜在的なトレーニング資料に効果的に変わります。

この動きは、Web パブリッシャーが AI クローラーのブロックにますます積極的になり、企業に代替データソースを見つけるよう促していることも踏まえて行われた。

オプトアウトする方法

この変更を懸念するユーザーは、Google アカウント設定を通じて新しいコレクションを無効にすることができます。関連する切り替えは、検索サービス履歴パーソナライズされたおすすめ 設定で、Google の検索サービスからのアクティビティがどのように保存され、使用されるかを制御します。

データ収集を制限する手順

1. Google アカウントのプライバシー設定を開きます。
2. [検索サービス履歴] 設定を見つけてオフにし、トレーニング用にメディアが保存されないようにします。
3. パーソナライズされた推奨事項を確認します。これは、アクティビティがパーソナライゼーションにどのように影響するかにも影響します。
4. ウェブとアプリのアクティビティ コントロールをチェックして、データの保持期間を調整します。

これらの設定を無効にすると、検索サービスの操作から Google が保存するデータが減りますが、一部のパーソナライズ機能も制限される可能性があります。

プライバシーの反発

このアップデートは、プライバシー研究者やデジタル権利団体からの新たな批判を引き起こし、AIトレーニングにはデフォルトの登録ではなく、明示的なインフォームド・コンセントが必要であると主張している。中心的な不満は構造的なものです。Google は、データ収集を自動的にオンにすることで、ほとんどのユーザーがデフォルト設定を変更しないことを承知の上で、データ収集を検出して無効にする負担をユーザーに負わせています。

Googleはこの変更を、ユーザーのアクティビティの利用方法に対する透明性と制御性を高める一環として擁護した。同社によれば、設定は明確に説明されており、ユーザーはいつでも調整できるという。

より幅広い業界パターン

Google だけではありません。 Meta、X、その他のプラットフォームでも同様に、オプトイン メカニズムではなくオプトアウト メカニズムを使用して、ユーザー コンテンツに対する AI トレーニングを許可する条件が更新されました。トレーニング データの争奪戦が激化するにつれ、デフォルトで登録されたデータ収集が消費者のインターネット全体で例外ではなく標準になりつつあります。

欧州連合の規制当局は、一般に個人データの処理には明示的な同意を必要とする GDPR に基づくこうした慣行を厳しく監視する姿勢をすでに示しています。米国の規制当局がどのように対応するかは未解決の問題のままだが、カリフォルニア州などの州プライバシー法により、最終的にはデフォルトのデータ収集が制限される可能性がある。

現時点では、ユーザーにとって実際に得られることは単純です。Google を使用している場合、その AI をトレーニングしている可能性があり、それを停止する唯一の方法は自分でオプトアウトすることです。

AI の先を行く

AI のプライバシー、データ倫理、および最大手のテクノロジー企業がデータの実践方法をどのように再構築しているかに関する継続的な報道については、AI Buzz Wire をフォローして AI 業界の最新情報を入手してください。

AI倫理ニュースをもっと読む→