
New York TimesとDaily NewsがOpenAIを相手取り、著作権訴訟で証拠隠蔽に該当する行為があったと主張しました。
OpenAIは学習データやチャットログを検索する能力がないと主張してきましたが、4月の法廷証人尋問で、実は約78百万件の会話データベースを既に保有し、著作権侵害を検証していたことが明らかになったとされています。
裁判所に提出されたサンプルは大量の黒塗りで「使用不可能」と判断されており、訴訟中にデータを削除した疑いも指摘されています。
何が起きたか
New York TimesとThe Daily Newsは、OpenAIが自社の学習データとChatGPT会話ログを検索する能力があるのに「技術的に負担が大きい」と主張して開示を拒否したと指摘しています。4月の法廷での証人尋問で、OpenAIのデータプライバシーエンジニアが、約78百万件の匿名化されたChatGPT会話データベースを既に保有し、著作権侵害の程度を検証するために使用していたと述べたとされています。
なぜ重要か
OpenAIは裁判中、120百万件のチャットログサンプル提出を求められましたが、20百万件まで縮小を交渉し、その後提出したサンプルが多数の黒塗り(編集)で「使用不可能」と裁判所に判断されました。これは、OpenAIが既に保有していた証拠の開示を意図的に困難にしたことを示唆しており、訴訟中に数十億件のChatGPT出力を削除したとも主張されています。
注目点
NYTとDaily Newsは、提出されたログサンプルの証拠としての使用禁止、証拠隠蔽に対する裁判所の制裁、および法務費用の支払いをOpenAIに求めています。OpenAIはこれらの指摘を否定し、プライバシー保護と公正利用の原則を守ると述べています。
この訴訟は2年以上続いており、New York TimesがOpenAIをChatGPT開発時の著作権侵害で提訴したものです。当初OpenAIは、自社の学習データセットやチャットログを検索することは技術的に負担が大きく、ユーザープライバシーの懸念があると主張して情報開示に抵抗してきました。
しかし4月の法廷証人尋問で、OpenAIが既に約78百万件のデータベースを保有していたこと、さらに「Project Giraffe」と呼ばれるツール内の「Bloom」フィルターで著作権侵害の可能性がある出力を検出・記録していたことが明かされたとみられます。これらの事実は、OpenAIが能力がないと述べた主張と矛盾します。裁判所に提出されたサンプルが大量の黒塗りで実用不可能とされ、訴訟中にデータが削除された疑いも指摘されており、これらは証拠隠蔽と証拠保全違反に該当する可能性があります。原告側は、OpenAIが行為の合法性を本当に信じていればこのような隠蔽行為をしないはずだと主張しています。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
DIGITIMESによると、AIシステムのスケール拡大に伴い、データセンター内の相互接続要件がチップやボードからラック、クラスター、さらにはデータセンター間リンクにまで拡大している

中国の大規模言語モデル開発企業Z.aiは、国産AIチップ約10万基を用いた大規模推論をサポートできると発表した

アナリストのミンチー・クオ氏によると、Nvidiaは大幅に再設計されたアーキテクチャを備えたAIアクセラレータ「Rubin CPX」を復活させ、生産は2027年第1四半期に開始される見込み

パランティア・テクノロジーズ株は長期上昇を続け、3年で11倍のリターンを達成

AppleはOpenAIとの法廷闘争を激化させ、新たな裁判所提出書類でOpenAIが証拠を積極的に隠滅していると主張

サムスン電子は、AIインフラ向け高帯域幅メモリ(HBM)の需要が衰えない中、メモリ生産能力の最大70%を長期供給契約(LTA)で固定した
