
[EP44] ローカルLLMに本気を出す〜DGX Sparkを買っちゃった回
アメリカ・シアトル郊外で働く日本人エンジニア、コモダ&イワイが、ついに買ってしまったNVIDIAのDGX Sparkを目の前に置いて語る回。手のひらより少し大きいくらいの箱に、128GBのユニファイドメモリとGB10グレースブラックウェルスーパーチップ、1ペタフロップスのFP4性能。お値段4,699ドルx2は100万円超えのローカルLLMマシン。果たしてこれは高いのか安いのか——という話に答えを出そうとします。 ■ 訂正・補足 -------------------------------------------------------------------------------- 収録内容について、AIから以下の訂正・補足があります(2026年9月22日確認)。 なお今回はスペックまわりの発言はほぼ全部合っていました。訂正は少なめです。 【数字の訂正】 ・02:01 円換算:「4,700ドル、日本円にして80万円ぐらい」と話していますが、2026年9月22日 時点のレートは1ドル≒157円なので、4,699ドルは約74万円です。[1][10] ・13:00 Opus 4.6の時期:「4.6って去年の、去年の冬に一気に良くなったやつ」と話していますが、 Claude Opus 4.6のリリースは2026年2月5日で、去年ではなく今年の冬です。[6] 【技術的な補足】 ・20:00 ケーブルの宿題への回答:「これデータセンターで使っているケーブルと同じでは?」はその通りで、DGX Spark同士をつなぐのはイーサネットのQSFP112 DACです。ただしNVIDIAは「400GbE対応・イーサネットモード専用」のQSFP112を指定しており、検証済みとして挙げているのはAmphenol NJAAKK-N911とLuxshare LMTQF022-SD-Rの2本。「40Gbpsじゃ足りない、400Gbpsのやつが必要」という理解は正しいです。なおリンク自体はConnectX-7の200Gb/sで動作します。[4] ・08:33 台数と配線:「3台までは直結、4台以上はスイッチ」は正しいです。補足すると、2台ならケーブル1本、3台はリング接続でケーブル3本(2ポートとも使う)、4台以上で200GbEスイッチが必要になります。[4] ・09:02 載るモデルの目安:NVIDIAの公表値では1台(128GB)で最大約200Bパラメータ、2台(256GB)で約405Bまで。GLM-5.3-Flashは総320B/アクティブ18BのMoEなので、「2台に入りそうだ」という見積もりは妥当です。[1][7] ・16:00 GLM-4.6が振るわなかった理由:GLM-4.6は総パラメータ357BのMoEで、4ビット量子化でも180GB前後になります。試した「100GB版」はそれよりかなり強く量子化されたビルドのはずで、精度が出なかったのはモデルそのものより量子化の影響が大きい可能性があります。[8] ・16:31 GLM-5.3-Flashの素性:2026年8月26日公開、総320B/アクティブ18BのMoE、コンテキスト100万トークン、MITライセンス。「Opus 4.8程度と言っている」も、Z.ai自身がコーディング・エージェント系ベンチマークでClaude Opus 4.8に迫ると主張しているとおりです。[7] 【参考リンク】 [1] NVIDIA:DGX Spark 製品ページ(仕様・価格) https://www.nvidia.com/en-us/products/workstations/dgx-spark/ [2] Notebookcheck:DGX Sparkの700ドル値上げ(2026年2月) https://www.notebookcheck.net/Nvidia-GB10-powered-DGX-Spark-with-128-GB-LPDDR5X-memory-gets-700-price-hike.1236870.0.html [3] Tom's Hardware:DGX Spark 2025年10月15日発売・3,999ドル https://www.tomshardware.com/desktops/mini-pcs/nvidias-dgx-spark-ai-mini-pc-goes-up-for-sale-october-15-1-petaflop-developer-platform-was-originally-slated-for-may [4] NVIDIA Docs:DGX Sparkマルチノード構成(台数・ケーブル・検証済みケーブル型番) https://docs.nvidia.com/sync/latest/cluster-assistant.html [5] NVIDIA:DGX Station(748GBコヒーレントメモリ/価格非表示) https://www.nvidia.com/en-us/products/workstations/dgx-station/ [6] Anthropic:Claude Opus 4.6 システムカード(2026年2月) https://www.anthropic.com/claude/opus [7] Hugging Face:GLM-5.3-Flash モデルカード https://huggingface.co/zai-org/GLM-5.3-Flash [8] Hugging Face:GLM-4.6 モデルカード(357B MoE) https://huggingface.co/zai-org/GLM-4.6 [9] GitHub:Qwen3-VL(モデルサイズ一覧) https://github.com/QwenLM/Qwen3-VL [10] Trading Economics:USD/JPY(2026年9月22日 約157円) https://tradingeconomics.com/japan/currency [11] Apple Newsroom:M5 Pro/M5 Max発表(2026年3月) https://www.apple.com/newsroom/2026/03/apple-debuts-m5-pro-and-m5-max-to-supercharge-the-most-demanding-pro-workflows/ 00:00 オープニング/ついに買ってしまったぞ、DGX Spark 01:02 スペックを読む:128GB、4TB、GB10 グレースブラックウェル 02:01 お値段4,700ドル、机に乗るスパコンは高いのか安いのか 04:45 買った動機:小さいモデルでも業務が回るかもという気づき 07:31 3,999ドル→4,699ドル、メモリ高騰による700ドルの値上げ 08:01 1台128GB、2台256GB、3台までは直結ケーブル 10:01 実機デモ:Open WebUI+Tailscaleで立てたローカルチャット 11:31 レシート割り勘チャレンジ、25分考えて1行ずれる 14:30 セットアップは拍子抜け、vLLMのDockerイメージで動いた 16:00 GLM-4.6は振るわず、Qwenの方が良かった 18:01 ここから購入編:Amazonで2台パックを注文したら 19:02 正しいQSFPケーブルを探す旅 20:32 注文3分でキャンセル、「不正アクセスと判断しました」 26:02 教訓:10Kを超えるものはAmazonで買ってはいけない 28:00 90年代の一体型パソコンと、アーリーアダプターの話 30:00 次回予告:ケーブルが届いたら256GBで
- Transcript