AIToday
動画生成Zenn AI/ML掲載日時: 2026年10月10日 22:00

3モデルとも同じ3項目が不合格

LINEで送る
3モデルとも同じ3項目が不合格

動画生成モデル3つ——h3-max-turbo、veo3.1-lite、wan-3.0——に同じ1672×941のチンチラ画像と同じプロンプトを渡した。3つとも5項目中同じ3項目で不合格になった。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

テストは実用的な問いから始まった。どの動物の映像が再生数を稼ぐのか。YouTubeの動物動画1,279本を数えると、中央値は桁違いにばらついていた——飲むシーンは5,310万回、くしゃみは2,125万回だが、毛づくろいは516万回だった。毛づくろいは無難に見え、動きも分かりやすいので選んだ。この選択が後に効いてくる。

第1回はモデルだけを変え、画像、プロンプト、長さ、判定を固定し、Codexが5項目を採点した。3モデルともカメラ固定と中央配置は合格し、残り3項目は不合格。しかも壊れた箇所が一致していた。秒0.10ドルで最も高価なwan-3.0だけが中央配置で落ち、クリップの途中で顔が変わった。安い2モデルは項目ごとに一致したため、価格は品質を予測しなかった。

次に著者は前脚を隠し、動きをひげの揺れとまばたきに縮めて、wan-3.0を外し、モデルの限界と題材の難しさを切り分けた。融合、歪み、消失は再現しなかった。残ったのは両モデル共通で細い線——ひげの本数と長さ、額と頬の縞だった。これはモデル間の差ではなく、現行モデルに共通する弱点を示している。

よくある質問
どのモデルを試したのか?
h3-max-turbo、veo3.1-lite、wan-3.0で、いずれもfal.ai経由。秒単価はそれぞれ0.01ドル、0.03ドル、0.10ドルだった。
テスト費用はいくらだったか?
合計は1.12ドル(約170円)。生成直後に表示された残高には請求が反映されておらず、後から計上された。
3本すべてで何が壊れたのか?
カメラ固定と中央配置はほぼ合格したが、自然な動き、形状の一貫性、画質は3本とも不合格。前脚が融合したり、輪郭が消えたり、左右で形が違ったりした。
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へ詐欺師を翻弄するAIボット35万体を運用