Open-Weight Frontier 日本企業「データ主権」デプロイガイド ── IDC「2027年推論元年」× Fujitsu 自国製造 × 6 モデル比較で見る「Fable 5 輸出規制後」の実務設計

2026 年 6 月 12 日の米国 BIS (産業安全保障局) による Claude Fable 5 輸出管理発動、続く 6 月 13 日の AWS Bedrock における 30 日データ保持強制 ── この 48 時間で「クローズド・フロンティア・モデル」を前提にしていた日本企業の AI 戦略は、「データ主権 Sovereign AI」軸での再設計 を不可避とした。本稿は、当ブログが 6 月 4 日〜 15 日にかけて断片的に報じてきた Open-Weight Frontier 6 モデル (Nemotron 3 Ultra / Gemma 4 12B / Command A+ / DiffusionGemma / GLM 5.2 / MiMo Code) を 5 軸比較で統合し、IDC Japan が 2026 年 4 月に提示した「2027 年推論元年」フレームワークと、Fujitsu 笠子プラントの国産サーバ製造 (2026 年 3 月稼働開始) を組み合わせた 日本企業向け「データ主権」実装設計のハブ記事 である。 ...

June 16, 2026 · 33 min · 6571 words · Appwright

Nemotron 3 Ultra完全解説:長時間自律エージェント時代の「データセンターモデル」を読み解く

2026年6月4日、NVIDIAはNemotron 3 Ultra 550B-A55Bを公開した。GTC Taipei 2026の基調講演で「アメリカ最強のオープンモデル」と紹介された同モデルだが、報道の論調は「中国製オープンLLMに Intelligence Index で及ばない(48点 vs Kimi K2.6 の54点)」という比較に偏っている。本記事ではその論調を離れ、**「なぜこのモデルが『長時間自律エージェント時代』のデータセンター設計思想と整合するのか」**という観点から読み解く。TCO(総保有コスト)、MOPD学習法、OpenMDW-1.1ライセンス、ソブリンAI展開まで、日本企業のAIエンジニアが意思決定するための材料をコード例と試算とともに整理する。 1. モデル仕様の再確認:「サイズ」ではなく「役割」で理解する Nemotron 3 ファミリーは Nano(30B-A3B)/ Super(120B-A12B)/ Ultra(550B-A55B)の3層構造を取る。Nano と Super は DGX Spark 128GB のユニファイドメモリで手元運用できる「日常のモデル」だが、Ultra はそもそもターゲットが異なる。NVIDIA 技術ブログは「シングルターンのチャットボットから long-running agent への進化」を前提に Ultra を位置づけている。 項目 Ultra 仕様 総パラメータ 550B トークンあたり稼働 55B(MoE) アーキテクチャ Mamba-2 + Transformer + LatentMoE のハイブリッド コンテキスト長 1M トークン 学習トークン 約20T(NVFP4 レシピ) ライセンス OpenMDW-1.1(Linux Foundation、商用利用可) 量子化後重みサイズ 約335GB(NVFP4) 必要 VRAM 600GB 超(4×B200 または 8×H100 80GB) 対応 GPU Ampere / Hopper / Blackwell(単一チェックポイントで動作) サポート言語 英仏西伊独日韓ヒンディー葡中(日本語を含む10言語) 重要なのは「動くかどうか」ではない。「どの規模の問題を、何時間止めずに回し続けられるか」 が設計の出発点にある。Hugging Face モデルカードで公開されている GA v1.0 は、4 種類のチェックポイント(Base-BF16 / Post-trained BF16 / NVFP4 / GenRM)を揃え、NVIDIA AI Enterprise 90 日無料評価 + 商用ラインセンス + 完全なオープン性が同居する。 ...

June 6, 2026 · 22 min · 4245 words · Appwright