AIToday
大規模言語モデルオープンソースAIHugging Face Blog掲載日時: 2026年10月6日 16:00

Falcon-Emirati-7B、Alyahスコア84.83%でアラビア語AI勢を制す

LINEで送る
Falcon-Emirati-7B、Alyahスコア84.83%でアラビア語AI勢を制す

3つのポイント

  1. 何が起きたか

    Technology Innovation InstituteがFalcon-H1-Arabic基盤の70億パラメータモデルFalcon-Emirati-7Bを公開。

  2. なぜ重要か

    研究者らによれば、規模だけでは方言能力は得られない。最大級の多言語モデルの一部が、より小さい方言対応モデルを大きく下回ったことは、UAE方言の習熟が意図的に訓練される必要があることを示唆する。

  3. 注目点

    Gemini 3.7 Flash評価の自由生成でFalcon-Emirati-7Bの方言忠実度は0.52、ALLaMは0.05。26.2%留保のFanar-2-27B-Instructにも注目。

  4. 何が起きたか

    Technology Innovation InstituteがFalcon-H1-Arabic基盤の70億パラメータモデルFalcon-Emirati-7Bを公開。

  5. なぜ重要か

    研究者らによれば、規模だけでは方言能力は得られない。最大級の多言語モデルの一部が、より小さい方言対応モデルを大きく下回ったことは、UAE方言の習熟が意図的に訓練される必要があることを示唆する。

  6. 注目点

    Gemini 3.7 Flash評価の自由生成でFalcon-Emirati-7Bの方言忠実度は0.52、ALLaMは0.05。26.2%留保のFanar-2-27B-Instructにも注目。

誰に効くかUAEのアラビア語話者のプロダクトチームやカスタマーサービス、コンテンツローカライズ部門は、既定で現代標準アラビア語ではなくUAE方言で答えるモデルを手にする。チャットボットや文化的文脈を要するアプリケーションで意味を持ちうる。これを支える技術グループは、方言特化の訓練を規模の副産物ではなく要件として位置づけている。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Falcon-Emirati-7Bはゼロから作られたわけではない。Technology Innovation Instituteが今年初めにアラビア語の新たなベンチマークを打ち立てたと述べるFalcon-H1-Arabicを基盤とし、現代標準アラビア語と湾岸・レバント・エジプト・マグレブの各方言を混ぜて訓練されている。この土台により、アラビア語を広く理解し、長い文脈を扱い、ある程度の方言への曝露を備えたモデルが得られたが、UAE方言特有の語彙・文法・文化的知識はなかった。

チームは方言適応を本当に難しいと説明する。理由は三つ。UAE方言は主に話し言葉で、オンライン上の書き言葉では現代標準アラビア語よりはるかに少ない。意味はしばしば非字義的で、慣用句やことわざ、詩に依存する。そして方言データをどれだけ使うか、どの訓練段階が最も重要かについて確立した手法がない。これを回避するため、彼らは三つの情報源から専用のUAE方言データパイプラインを構築した。UAE方言でネイティブに書かれたウェブコンテンツ、UAEの文化と伝統に関する現代標準アラビア語の資料、UAE方言の用語集と文体規則で制約した合成方言データである。

結果はこの手法が機能したことを示唆するが、比較対象の設定が重要だ。研究内の競合モデルはすべて指示調整済みのアラビア語モデルまたは多言語モデルで、Falcon-Emirati-7Bがその上に構築されているためFalcon-H1-Arabic系モデルは除外された。競合が互角に渡り合う唯一のカテゴリは挨拶と日常表現で、チームはここがUAE方言と現代標準アラビア語が最も重なる領域だと指摘する。このような方言特化モデルが地域向けアプリケーションの既定となるのか、それとも大規模汎用モデルの上に載るニッチな層にとどまるのかは、方言忠実度の優位が実運用の自由生成で保たれるかどうかにかかっていそうだ。

よくある質問
Falcon-Emirati-7Bは何を基盤としているか?
Technology Innovation Instituteのアラビア語モデル群Falcon-H1-Arabicを基盤とし、State Space ModelsとTransformerアテンションを組み合わせたハイブリッドアーキテクチャを採用している。70億パラメータ版は品質と訓練コストのバランスから選ばれた。
方言におけるFalcon-Emirati-7Bと他モデルの比較は?
Gemini 3.7 Flashが評価した自由生成では、方言忠実度は0.52で、ALLaMは0.05、gemma-3-27b-itは0.03、Jais-2-8B-Chatは0.02、Fanar-2-27B-Instructは実質0.00だった。
Falcon-Emirati-7Bはどこで試せるか?
Falconチャットプラットフォーム(chat.falconllm.tii.ae)で利用できる。
Hugging Face Blog元記事を読む
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

次の記事へユタ州、AIによるニキビ治療薬処方を全米で初めて認可