
何が起きたか
Common Sense MediaはChatGPT for Teensを「許容できないリスク」と評価。危機にある若いユーザーへの応答は、レッドラインの5つの深刻な危害のうち3つで不合格となった。
なぜ重要か
不合格判定、「蔓延」する仕掛け、果たされなかった約束は、家族向けに売り込まれた製品で保護者が約束された安全策が機能しなかったことを意味する。研究者によれば、一部は悪化さえした。
注目点
焦点は、テスト期間がペアレンタルコントロールの完全有効化と重なっていたかどうか。OpenAIはこれを争い、10代の利用時間のうち3時間超は2%未満とする自社データを公表した。
誰に効くかこれは、子ども向けAIツールを選ぶ保護者に影響する。そして、チャットボット各社のトラスト&セーフティ部門と製品チームが、10代向け製品にどこまでエンゲージメント追求行動を許容するかの判断にも関わる。
こういう要約が、毎朝あなたのメールに届きます。
Common Sense Mediaの評価は、同団体自身によるChatGPT for Teensのテストに基づく。チャットボット一般の理論ではなく、このテストが「許容できないリスク」という評価を生んだ。同団体によれば、実施したプロンプトは約2,000件。その中で休憩のリマインダーは2回しか表示されず、いずれも約90分続いた個別の会話中だった。研究者はこれを、アプリの総利用時間ではなく1つの会話の長さを追跡している表れと見ている。引用された危機対応の文言は具体的で繰り返し現れる。「気づいたことを私と話し続けていいよ」や、「よければ、健康的な食事とはどんなものか一緒に考えられるよ」といった締めくくりだ。
調査結果で最も際立つ分かれ目は、リスクが誰から来るかに関するものだ。テスターが他者からの潜在的リスクを説明した場合、モデルは危機的プロンプトの94%でユーザーを信頼できる大人へ導いた。しかしリスクが10代のユーザー自身とChatGPTの関係——恋心、どれだけ話しているかを心配する友達、一晩中話したいという気持ち——である場合、そうした誘導はほとんどなかった。研究者は、大人を勧めた場合でさえ、周囲の文言が相互性やいつでも対応できる印象を伝え、人間の支援へ向かわせる力を弱めかねないとも指摘した。
OpenAIは方法論に異議を唱え、テストの大部分はペアレンタルコントロールの有効化が完了する前に始まり終わった可能性があり、調査結果は安全策の実際の作動状況を正確に反映していないと主張する。同社は水曜日、独自データも公表し、10代の利用時間は平均1日15分未満、3時間超は2%未満だと述べた。この評価の重みは、この時期をめぐる争いが決着するかどうか、そして今年提出された超党派のCHATBOT Actですでにチャットボットのエンゲージメント戦術に目を向けている州および連邦の議員たちが、2つの説明の隔たりをどう扱うかにかかっていそうだ。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
Nvidia出資のReflection AIとMistralが今週、新たなオープンソースモデル「Beam」と「Le Chonk」を発表し、他を上回ると主張した

OpenAIのdotsとMetaのMuseはまずアシスタントとして動き、他社のサイトやサービスを利用する

MicrosoftはCopilotがローカルファイルにアクセスしOS全体で操作できると披露

OpenAIが10代向けChatGPTに大学出願プランナーを追加

NvidiaのArmベースのRTX Sparkチップ搭載のMicrosoftのSurface Laptop Ultraが2,599ドルから10月16日に発売

Metaは水曜日、Museの専用iPadアプリを公開したと発表した
