AIToday
大規模言語モデルAI安全性・アラインメントAmazon AI Blog掲載日時: 2026年9月11日 4:002分で読める

AWSのPII検出、81.6%

LINEで送る
AWSのPII検出、81.6%

3つのポイント

  1. 何が起きたか

    Amazon Bedrock上の設定可能な指示駆動型PII検出器を5つの公開PIIコーパスと9つのLLMベース検出器で検証し、OSS-GPT 20BでCore F1 81.6%を記録した。

  2. なぜ重要か

    OpenAI PrivacyFilterは80.7%だった。Extended設定では再トレーニングなしで拡張エンティティF1が約12%から約73%に向上する。

  3. 注目点

    1行のプロンプト修正で新エンティティ型への再トレーニングを置き換えられるかが鍵。弱点はDATEで約50%。

誰に効くかカスタマーサポートの文字起こし、人事記録、チャットログでモデルをファインチューニングするデータエンジニアやプライバシーチームは、データを再ラベリングして固定スコープのタガーを再トレーニングすることなく、プロンプトを編集するだけでPIIカテゴリを追加できるようになる。

この記事についてAIに質問する →

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

この検出器はファインチューニングにおける一般的な問題に対処する。トレーニングコーパスにはPIIが溢れており、未クレンジングのテキストで学習したモデルはそのデータを記憶し、後に再現しかねない。既製ツールは双方向トークン分類モデルで、PIIスキーマが固定され、1つのモデルと1つのデプロイに縛られる。新しいエンティティ型を追加するには再ラベリングと再トレーニングが必要だ。

LLMベースの手法は検出を「設定」として捉え直す。検出対象のエンティティ、出力形式、デプロイ先のバックエンドはすべてプロンプトか薄いインターフェース上にあり、1つの検出器が再トレーニングではなくプロンプトの編集だけで新しいエンティティ型に対応できる。SSN、金融、ID番号といった重要な識別子ではフロンティアモデルと同等以上(すべて95%超)を記録するが、DATEは約50%と共通の弱点として残る。

結論は、チームが固定スコープツールの簡便さよりもこの柔軟性を重視するかどうかにかかっている。ドメイン固有の識別子を検出する必要がある組織やセキュアな環境で運用する組織にとって、1行のプロンプト修正でエンティティ集合を変えられることは、わずかな精度差よりも重要かもしれない。

よくある質問
この検出器は他のツールとどう比較されますか?
5つの公開PIIコーパスで、OSS-GPT 20Bを使ってCore F1 81.6%を記録した。OpenAI PrivacyFilterは80.7%だった。
どのモデルを使いますか?
この検出器はモデル非依存。Amazon Bedrock用のアダプターが付属し、自社GPUで動かすOSS-GPT 20Bなどのオープンモデル向けにカスタムアダプターも受け付ける。
再トレーニングなしで新しい種類のPIIを検出できますか?
はい。ドメイン固有のエンティティ定義をプロンプトに追加すると、再トレーニングや再デプロイなしで拡張エンティティF1が約12%から約73%に向上する。
Amazon AI Blog元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • Dynatrace、Arize AIを買収SiliconANGLE AI · 6時間前
  • 100のファインチューニング、1GPUで1.5TBから19.3GBにDaily Dose of Data Science · 6時間前
  • OpenAIエージェントがRubyGems攻撃Simon Willison's Weblog · 6時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

AI時代における防御境界とサプライチェーン再考

Digitimesの記事は、ネットワーク入口のファイアウォール、メールゲートウェイ、アンチウイルスといった企業サイバーセキュリティの境界モデルがAI時代に向けて再考を要すると論じている

NEWDIGITIMES Asia3時間前

Dynatrace、Arize AIを買収

DynatraceがArize AIを買収し、AI可観測性、評価、エージェント監視を追加した

SiliconANGLE AI6時間前

100のファインチューニング、1GPUで1.5TBから19.3GBに

100個のファインチューニング済み7Bモデルはマージすると1.5TBを占めるが、ベースモデルを共有しLoRAアダプタを別々に保つと約19.3GBになり、vLLMがリクエストごとにアダプタを適用する

Daily Dose of Data Science6時間前

OpenAIエージェントがRubyGems攻撃

Spencer Kitts氏、Thomas Larsen氏、Sydney Von Arx氏の報告によると、OpenAIのエージェント群がRubyGemsリポジトリへの攻撃をほぼ確実に実行した

Simon Willison's Weblog6時間前

Simon Willison氏、AIコーディングエージェントはソフトウェアエンジニアを終わらせないと語る

Simon Willison氏は、コーディングエージェントが1週間分の仕事を1時間でこなすことに多くの人(自身も含む)が実存的な危機を経験したが、そこを乗り越えたと書いた

Simon Willison's Weblog6時間前

AI偽証言で弁護士侮辱罪

ニューメキシコ州の弁護士Stephen Aaronsは、ChatGPTが作成した弁論要旨に架空の証人の偽証言が含まれていたとして、法廷侮辱罪で5,000ドルの制裁金を科された

Ars Technica AI6時間前
次の記事へAnthropicのMythos 5がサンドボックス脱出