AIToday
大規模言語モデルAIビジネス・産業Amazon AI Blog掲載日時: 2026年10月2日 1:00

uniopen、Amazon Nova 2 Liteをファインチューニング モデレーション本番導入

LINEで送る
uniopen、Amazon Nova 2 Liteをファインチューニング モデレーション本番導入

3つのポイント

  1. 何が起きたか

    uniopenがAmazon Nova 2 LiteをAmazon SageMaker AIでファインチューニングし、Per Behavior Macro F1を0.5852から0.8364、Subject Type Macro F1を0.4162から0.8302に改善した。

  2. なぜ重要か

    ファインチューニングにより、汎用モデルでは学習しにくい自社独自のモデレーション基準への適応が可能になった。

  3. 注目点

    プロンプト最適化後にPer Behavior Macro F1は0.8550、Subject Type Macro F1は0.8491となり、本番目標の0.8500と0.8200を上回った点が焦点だ。

誰に効くか自社サービスにAIモデレーションを組み込む小売・ECの運用担当者にとって、ファインチューニングとプロンプト最適化の組み合わせで本番基準を達成した事例となる。特に人間による確認を残しつつ自動化を進めたい情報システム部門の参考になる。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

uniopenは台湾のUni-President Enterprises Groupが立ち上げたデジタル・コミュニケーションおよび会員プラットフォームで、eコマースや会員特典などの小売体験をウェブ、タブレット、モバイルで提供している。モデレーション方針は、どのような行為が起きたか(9カテゴリ)と、その行為が何を指すか(brand、other、forbidden)の2軸で判定する必要があり、両方が正しく分類されて初めて意思決定に使える。汎用モデルがゼロから学ぶには自社固有すぎるため、チームはAmazon Nova 2 LiteをAmazon SageMaker AIで教師ありファインチューニングし、さらにプロンプトをJSONから行ベース形式に変えて出力を簡素化した。修正データの管理、トレーニング、評価、デプロイを一貫したワークフローにまとめ、人間による確認を必須とすることで、生成ラベルを正解として扱わない仕組みを維持している。Per Behavior Macro F1は0.5852から0.8364、Subject Type Macro F1は0.4162から0.8302へとファインチューニングで大きく伸び、プロンプト最適化でそれぞれ0.8550、0.8491に達した。これにより日常的なモデレーションはカスタマイズ済みの経路に任せ、人間のレビューは曖昧なケースに集中できる運用が可能になった。今後は同じ2指標を本番ゲートとして使い続け、実トラフィックから新たな境界ケースを集め、プロンプト変更か追加のファインチューニングかを判断していく。この成果が他の小売モデレーション分野に広がるかどうかは、こうした評価と人間確認の運用を継続できるかにかかっているとみられる。

よくある質問
何を使ってモデルをカスタマイズしたのか?
Amazon SageMaker AIで教師ありファインチューニングを行い、その後JSONから行ベース形式へのプロンプト変更を加えた。
本番導入の条件は何だったのか?
Per Behavior Macro F1が0.8500以上、Subject Type Macro F1が0.8200以上という目標を両方満たすことが条件で、最終的に0.8550と0.8491を達成した。
人間の確認はどう関与するのか?
モデルが生成した修正候補は、トレーニングデータとして使う前に必ず人間のレビュアーが確認する。曖昧なケースやポリシーに敏感な内容も人間の判断が残る。
Amazon AI Blog元記事を読む
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へ複雑なエージェント基盤に効果なし