
AmazonはAmazon EC2 P6eおよびP6インスタンスファミリー(NVIDIA Blackwellアーキテクチャ搭載)を最近立ち上げた。P6e UltraServerは単一のNVLinkドメイン内に72個のNVIDIA Blackwell GPUを搭載し、130 TB/sのバイセクション帯域幅、13.4 TB のHBM3e、360 petaflopsのFP8コンピュート(FP4で720)を備えている。
Amazon FSx for LustreとNVIDIA GPUDirect Storage(GPU High Bandwidth Memoryへのダイレクトメモリアクセス)を組み合わせることで、従来のCPUベースのモデル読み込み(CPUメモリを経由し、PCIe経由で各GPUに順序立てて重みをコピー)をバイパスし、シャード化された並列モデル読み込みが可能になる。テスト構成では、Persistent_2 EFAファイルシステム(1000 MBps/TiBで20個のObject Storage Targets搭載、容量96 TiB)が約94 GiB/sのファイルシステムスループットを提供する。
従来のCPUベースのモデル読み込みでは、Llama 3.1 405B(BF16で約800 GBのチェックポイントデータ)を単一スレッドで読み込むと10~20分かかるが、GDSを使用することで分単位のコールドスタート遅延の問題(新規インスタンスがモデル読み込み完了まで通信できない、オートスケーリングが分単位で遅延、インスタンス障害時の交換容量オンライン化に分単位を要する、GPU時間が読み込み中に無駄になる)が緩和される。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
Anthropicが9月1日、大規模言語モデル「Claude Fable 5.1」と「Claude Mythos 5.1」を発表した

AI研究機関AI2が、LLMベンチマークを個別問題レベルで監査する新手法「BenchMIRT」を発表した

グーグルはディズニー、ワーナー・ブラザース・ディスカバリー、ユニバーサルなど大手スタジオに著作権コンテンツのAI学習用ライセンス供与を打診し、数億ドル規模のオファーを提示したと報じられた

OpenAIは新型モデル「Astra」の詳細を公開し、同社の「重要サイバーセキュリティ基準」を満たす初の大規模言語モデルと説明

ウォルマートはオピオイド調剤に関する請求を5000万ドルで和解した

AT&T、Dell Technologies、AMDが、通信業界向けとして最大かつ最高性能のオープンソースモデル「OTel 2.0」を発表した
