
Cohereは、アラビア語音声認識に特化したオープンソースモデル「Cohere Transcribe Arabic」を公開しました。
このモデルはアラビア語固有の課題である方言の多様性、二言語混合、専門用語に対応するよう開発され、既存の大手システムを上回る性能を示しています。
何が起きたか
Cohereが「Cohere Transcribe Arabic」という20億パラメータのオープンソース音声認識モデルを公開しました。Apache 2.0ライセンスの下でHugging FaceおよびCohere APIを通じて利用可能です。
なぜ重要か
アラビア語の方言の多様性、アラビア語と英語の二言語混合、コード・スイッチング(異なる言語の混用)、専門用語といったアラビア語音声認識の固有の課題に対応するよう設計されています。
注目点
人間による評価では、Cohere Transcribe ArabicがWhisper Large V3および標準のCohere Transcribeモデルを総合品質、方言の忠実性、コード・スイッチングの点で上回りました。
アラビア語は世界で数億人が話す言語ですが、その音声認識は複数の言語系統の方言が存在し、さらに都市部ではアラビア語と英語が混用される環境も多くあります。Cohereが公開した「Cohere Transcribe Arabic」は、こうしたアラビア語話者の現実に直面する課題を明確に対象に設計されています。人間による1~5段階の評価で既存システムを上回ったという検証結果は、実際のアラビア語ユーザーのニーズに応える可能性を示唆しています。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
DIGITIMESによると、AIシステムのスケール拡大に伴い、データセンター内の相互接続要件がチップやボードからラック、クラスター、さらにはデータセンター間リンクにまで拡大している

中国の大規模言語モデル開発企業Z.aiは、国産AIチップ約10万基を用いた大規模推論をサポートできると発表した

アナリストのミンチー・クオ氏によると、Nvidiaは大幅に再設計されたアーキテクチャを備えたAIアクセラレータ「Rubin CPX」を復活させ、生産は2027年第1四半期に開始される見込み

パランティア・テクノロジーズ株は長期上昇を続け、3年で11倍のリターンを達成

AppleはOpenAIとの法廷闘争を激化させ、新たな裁判所提出書類でOpenAIが証拠を積極的に隠滅していると主張

サムスン電子は、AIインフラ向け高帯域幅メモリ(HBM)の需要が衰えない中、メモリ生産能力の最大70%を長期供給契約(LTA)で固定した
