ChatGPTの研究から「某ゲームのとんでもない二次創作を毎日数千件書かせていた人」がいたことが発覚した怪談のような話 こんなデータセットがウッカリ別のAIに学習されたらどうなってしまうんや
米ワシントン大学らの研究が、無料チャットのログを集めた「WildChat」を分析し、会話の3割超がフィクション生成、とくにエロ寄りが多いことを示した。中でも一人の超ヘビーユーザーが、特定ゲームキャラの出産二次創作を何千回も生成していた事実が話題になっている。
この手のログが学習データに紛れ込むと、モデルの出力が性描写に寄ったり、特定の作風に偏るおそれがある。偏った二次創作が大量に学習データへ紛れ込むリスクが可視化された形だ。
安全対策も「医学的な説明」といった回し方で抜け道があるという指摘が出た。個人の欲望を満たす用途は自由だが、履歴は見られる前提と、データ公開・二次利用の管理が要ると論じている。

togetter.com





