AIToday
大規模言語モデルHacker News掲載日時: 2026年4月27日 16:011分で読める

DeepSeekが1 million トークンの長文処理に対応したV4モデルをリリース、Huaweiの国産チップに最適化

LINEで送る
DeepSeekが1 million トークンの長文処理に対応したV4モデルをリリース、Huaweiの国産チップに最適化

3つのポイント

  1. DeepSeekは金曜日にフラグシップモデルV4をプレビュー公開。V4-ProはAnthropicのClaude-Opus-4.6、OpenAIのGPT-5.4、GoogleのGemini-3.1とベンチマーク上で同等のパフォーマンスを発揮。V4-Flashは$0.14 per million input tokens、$0.28 per million output tokensで業界最安級の大規模モデルの1つ。

  2. V4は1 million トークン(『ライラの冒険』3巻とホビットを合わせたサイズ)の長文処理に対応。注意メカニズム(AIが入力テキストの各部分を相互に理解する機能)を選別的にし、古い情報を圧縮して現在関連性の高い部分に焦点を絞ることで実現。同じ1 million トークン処理でV4-Proは前世代V3.2比で27%の演算処理能力と10%のメモリ使用量に削減。

  3. DeepSeekがV4をHuaweiのAscendなど国産中国チップに最適化した初のモデル。Huaweiは金曜日にAscend 950シリーズ搭載製品がV4をサポートすることを発表。米国の輸出規制下でNvidiaへの依存を減らす中国のAI産業戦略における重要な一歩として位置付けられている。

この記事についてAIに質問する →

LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • World Labs、写真数枚から3D世界を生成するAI「Atlas」発表THE DECODER · 3時間前
  • 有料俳優とAI脚本、反民主党動画ネットワーク発覚Semafor Tech · 6時間前
  • ICRAパネルが論文氾濫に警鐘Robohub · 6時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へMicrosoft と Stellantis が5年間の戦略提携を開始 — 自動車メーカーが Microsoft のクラウド・AI・サイバーセキュリティを採用