フォーブスが以前報じたように、AI企業はカスタマーサービス、金融サービス、スケジュール管理などの分野におけるモデルの性能を向上させるため、Slackのアーカイブ、Jiraのチケット、Eメールのスレッド、Googleドライブのファイルなど、破綻した企業の内部コミュニケーションデータを買い求めている。
グーグルは今回、膨大な社内外の通信記録を含む、大手航空会社の運営状況が書かれた巨大なデジタルフットプリントを取得しようとしている。メルコアとの入札競争は、AI企業がこの価値ある新たな訓練用データをめぐって激しい争奪戦を繰り広げる実態を浮き彫りにしている。
裁判資料によると、匿名化されたデータは「特定の消費者と関連付けられたり、情報の推測に合理的に利用されたり、あるいは結び付けられたりすることはない」とされている。この匿名化プロセスは、データがAIモデルの訓練やプロンプトに使用される前に、個人のプライバシーを保護し法的遵守を維持することを目的としている。
今回の買収に詳しい匿名の情報筋がフォーブスに語ったところによると、グーグルはロイヤルティプログラムの会員情報やクレジットカードの詳細など、顧客の個人情報の取得には関心がないという。代わりに、識別子を排除した実社会のデータを利用して、AIエージェントの性能向上に役立てる意向だ。米司法省傘下の破産監視機関である米連邦管財官局は、フォーブスからの追加情報の照会には応じなかった。


