限定

米 NVIDIA AI チップ輸出規制の後、中国はどう先進演算を得るか:第三国 DC・クラウド GPU・国産チップ

AI エンジニアリング 輸出規制 · 演算
2026-09-08 約14分

結論:H100 が無いことは先進 AI 演算が無いことではない。学習・推論・実行を分けよ。第三国データセンターは中国本社事業体の合法バイパスではない。

分水嶺はコンプライアンス軌道:API Token、認可クラウド GPU、国産 AI チップ、Cloud Mac 実行層。

結論

  1. H100 / B200 が買えないことは、先進 AI 演算力が無いことを意味しない。学習・推論・Agent 実行を三軌道に分け、規制対象の一枚に縛るな。
  2. 2026-05-31 の BIS ガイダンスは、D:5(中国を含む)またはマカオに本社がある、あるいは最終親会社がそこにある事業体は、世界のどこで受け取っても先進計算品目に許可が必要と明記。第三国データセンターは合法バイパスではない。
  3. 大半の製品と Agent チームはカードではなく Token(API)を先に買うべき。クラウド GPU は「審査に耐える契約主体 + 自己ホスティング必須」の時だけ。
  4. 国産 AI チップ(Ascend、Cambricon など)はグラフを移植でき、CUDA 移行コストを払える学習/推論向け。明日ストック CUDA が必要なら向かない。
  5. Cloud Mac は MCP、署名、常駐 Agent を担い、データセンター GPU を代替しない。蓋閉じ再試行は同じ推論を再購入する。
チップが買えるかどうかが分水嶺ではない。各ワークロードがどのコンプライアンス軌道に載るかが分水嶺だ。
輸出規制下の AI 演算選択を示すデータセンターラックと冷却通路
ボトルネックは「NVIDIA カードの有無」ではなく、学習・推論・実行を審査可能などの軌道に置くかだ。

0. 結論

2026-09-08 時点で、米国の NVIDIA AI チップ輸出規制は H100 / H200 / Blackwell から、許可制の H20、そして阻止された降格 B30A まで広がった。並行して中国は財政支援データセンターに国産アクセラレータを求め、未完成サイトから外国部品の撤去を求める場合がある。旧答「旗艦カードを部屋に入れる」は死んだ。

今週決める人向けの対比:

  • 製品推論 / Agent ループ:既定は Token。DeepSeek、Qwen、Gemini、Claude は規制シリコンを動かさずに先進能力を API として売る。コストは DeepSeek V4-Flash の Token コスト
  • 自己学習・ファインチューン必須:グラフを変えられるなら国産クラスタ。最終親会社が明らかに非 D:5 の時だけライセンス済みクラウド GPU。「シンガポール子会社 + 中国本社」は例外ではない。
  • 第三国データセンター:中国本社の買い手にとって 2026 年半ば以降は灰色ショートカットではなく、許可と執行の問題。BIS 2026-05-31NVIDIA 輸出コンプライアンスを先に読め。
  • 実行層:MCP、Keychain、xcodebuild、常駐 Agent は Cloud Mac。学習 GPU と同じ規制パッキングリストに載せるな。

推論スループットで GPU か Mac かは別切断面。NVIDIA GTC Berlin 2026:GPU か Mac か

1. なぜ旧案は輸出規制後に死んだか

チームは「先進 AI 演算」を「ケージの中の NVIDIA 旗艦」と同一視した。2022 年以降、米国は性能密度とインターコネクトで A100、H100、後続 Blackwell を先進計算管理に入れた。中国向けビン(A800 / H800 / H20)が出るたび、クラスタ規模の最先端学習に近づくと規則が締まった。2025–2026 年に H20 は許可制になり、B30A はクラスタで大規模モデルを学習できるとして全面制限扱いになった。

北京は財政案件に国産チップを求め、初期サイトは既設の外国アクセラレータ撤去を求められる場合がある。残る手はグレー市場か第三国ラックだ、という高い錯覚が生まれた。コンプライアンス、納期、CUDA ロックインを束ね、来週の Agent は出荷できない。

  • 規制は品目 + 最終利用者事業体に付き、ケージの国旗には付かない。15 CFR 742 と BIS メモ。
  • クラウドが D:5 本社顧客の KYC を締めた後、第三国契約は自動的に H100 を届けない。
  • グレー市場カードにドライバ支援、インターコネクト保証、合法的な本番配置経路は無い。

本当の問いは「中国はまだ NVIDIA を買えるか」ではない。自己ホスティング必須の負荷、Token で足りる負荷、FLOPS のふりをした実行ホストの比率だ。

2. 五つの演算軌道

2.1 軌道 A:モデル API / Token 購入

入口は API キーまたは企業契約。実行は推論、ツール、長文脈。文脈は送ってよいプロンプトとファイル。コストは百万 Token。境界はベンダーの駐在と学習条項。2026 年の中国製製品と海外向け Agent の既定先進演算。70B 学習の発注書をサポートボットに貼るな。

2.2 軌道 B:ライセンス済みクラウド GPU

入口は AWS / Azure / GCP / 認可 GPU クラウド。実行は CUDA 学習と自己ホスト推論。コストは GPU 時間 + 下り + 遊休。境界は署名者、最終親会社、クラウドが再輸出許可案件と見るか。事業体が審査を生き抜く時だけ軌道は存在する。

2.3 軌道 C:第三国データセンター

パンフ上はマレーシア、タイ、シンガポール、UAE のケージと「現地会社」。2026-05-31 以降、BIS は D:5 / マカオ本社または最終親会社がそこにある事業体向けの先進計算品目は、受領者の設立地に関係なく許可が必要と再確認した。EAR に沿う善意の事業者は、当面このメモだけで既存利用を止めなくてよい。それは中国本社の買い手に新しい購入扉を開けない。「第三国 DC で NVIDIA 輸出規制を回避」と書くのは、執行休暇にマイルストーンを賭けることだ。

2.4 軌道 D:国産 AI チップ

Huawei Ascend、Cambricon、Biren、Moore Threads は CANN または独自ランタイムであり、透明な CUDA 置換ではない。Ascend コミュニティから始めよ。グラフ、通信、テレメトリを書き直せば学習と推論をカバーする。文脈は国内クラスタと国内駐在。コストは人月と電力であり、一枚のドル札ではない。財政案件はほぼここしかない。

2.5 軌道 E:ヘテロ実行(Cloud Mac / Apple silicon)

入口はクラウドまたはローカル Mac への SSH / VNC。実行は MCP、署名、worktree、オンデバイス Core ML であり、H100 学習ではない。低同時実行の試作は統一メモリで小モデルを試せるが、本番スループットは API か GPU に戻る。メモリが本当の瓶颈:Mac mini を AI Agent サーバにする。レンタル課金の自動化:FOSSBilling 演算レンタル基盤

3. 同じ見出しの比較

第三国ケージ、クラウド GPU、国産チップ、API、実行ホストを一表に載せ、「CUDA か」だけを問うな。

層/方案入口実行文脈コスト権限境界
API / Tokenキー / 企業契約推論・ツール・長文脈許可されたプロンプトとファイル百万 Token;再試行で倍ベンダー駐在と学習条項
認可クラウド GPUコンソール / コミットCUDA 学習 + 自己ホスト推論VPC に置いた重みGPU 時間 + 遊休 + 下り署名主体と最終親会社
第三国 DC海外ケージ契約紙の上ではクラウド GPUケージの国 ≠ 許可例外賃料 + デューデリ + 執行リスクBIS は本社を見る
国産 AI チップ国内クラウド / 自前ホールネイティブスタックで学習推論国内データとツール移行人月 + 電力財政案件はほぼ必須
Cloud Mac 実行SSH / クラウド MacMCP、署名、常駐 Agentリポジトリ、証明書、Keychain日貸しホスト、FLOPS ではないプロセスユーザと下り

非対称な一文:ケージを別の国に移しても「最終親会社が中国」は消えない。安い国産カードも、蓋閉じ後の Token 再課金は止めない。SKU は軌道上の目盛りだ。

4. シナリオ行列

層/方案入口実行文脈コスト権限境界
サポート / コーディング Agent、低 QPSAPI 既定Flash または国内 API、手数制限短文脈 + キャッシュした system出力を入力の 3–8× で予算キーはバックエンドのみ
7B–70B を移植可能なファインチューン国産クラスタAscend / Cambricon 学習栈データは国内人月 > カード価格財政・国内コンプライアンス優先
独立した非 D:5 最終親会社認可クラウド GPU短い CUDA レンタルで証明VPC + キーローテ日次のあとコミット法務が先に BIS / クラウド KYC
中国本社 + 海外ケージ希望既定にするな許可は否認と仮定第三国の紙では足りないデューデリが API を超えることが多いBIS を読み、ローンチ計画から外せ
iOS / MCP / 常駐オーケストレーションCloud Mac + APIMac は実行し、学習しない証明書と DerivedData は Mac日貸しマシン + TokenKeychain は箱から出さない
財政データセンター国産チップ入札スタックを出荷国内駐在移行を工程に書く外国アクセラレータは撤去され得る

5. 推奨スタック

A | 製品既定(大半のチーム)
  国内または国際 API 推論
  → 手数上限 + 日次予算
  → MCP / 署名は Cloud Mac
  → 規制対象 NVIDIA 旗艦は買わない

B | 自己学習必須
  Ascend / Cambricon クラスタ
  → まず本物の学習グラフを一本移植
  → 通信と監視も同時に書き換える
  → オンライン推論は API のまま

C | 適格な海外主体
  法務が最終親会社を確認
  → 短い認可クラウド GPU
  → 下りとキーローテを runbook へ
  → 第三国シェルを許可にしない

D | 財政 / 国産化案件
  アクセラレータは 100% 国産
  → SOW で CANN(または入札栈)を固定
  → 「B30A 緩和待ち」をクリティカルパスに置くな

6. 落とし穴

  • 落とし穴 1:シンガポール / マレーシアのケージ = 合法 H100。BIS は最終親会社の本社を見る。
  • 落とし穴 2:先進 AI には自前 NVIDIA が必要。大半のライブ要求は推論であり、Token は既に先進演算だ。
  • 落とし穴 3:国産チップは「弱い CUDA」。別スタックだ。演算子を移植しなければ演算は無い。
  • 落とし穴 4:グレー市場カードを本番へ。ドライバも保証もコンプライアンス経路も無い。
  • 落とし穴 5:主体の無いクラウド GPU 見積。KYC 失敗で契約は紙切れになる。
  • 落とし穴 6:ノートで Agent を回し、GPU 不足を責める。蓋閉じ再試行が買うのは Token だ。
  • 落とし穴 7:輸出規則を「中国は二度と NVIDIA を得られない」と読む。許可とビンは動く。計画は軌道で書け。

7. 7 ステップ

  1. 来週の負荷を学習 / 推論 / 実行に分け、「全部 H100」を禁止する。
  2. 推論列に API を選ぶ(DeepSeek API 文書または国内ホスト)。本物のプロンプトで Token を測る。
  3. BIS 2026-05-31 に対して主体図を描く:本社、最終親会社、クラウド口座。中国本社なら第三国ケージを設計に入れるな。
  4. 学習が必要なら国産スタックを選び、ホールを埋める前に loss を再現できるグラフを一本移植する。
  5. 事業体がクラウドと輸出審査を生き抜いた後にだけ、短い認可クラウド GPU の PoC を開く。
  6. MCP、署名、常駐オーケストレーションを Cloud Mac へ移し、蓋閉じ再試行を殺す。境界は MCP:Cloud Mac vs VPS vs ローカル
  7. 一枚物を出す:既定 API、学習は国産、グレー市場禁止、第三国バイパス禁止。毎月請求と主体を突き合わせる。

8. FAQ

第三国データセンターで NVIDIA 輸出規制を回避できる?

中国・マカオ本社、または最終親会社がそこにある事業体には不可。BIS(2026-05-31)は先進計算品目を世界のどこへ納品しても許可が必要と述べる。マレーシアやシンガポールのラックは合法バイパスではない。

H100 が無いと先進 AI は無理?

大半の製品と Agent は自前 H100 不要。推論は API、学習は移植可能な国産クラスタか、適格主体のライセンス済みクラウド GPU。足りないのは軌道であり、一つの SKU ではない。

国産 AI チップは CUDA の代替?

学習・推論の一部は可。全 CUDA カーネルの既定代替ではない。コストは演算子・インターコネクト・ツールチェーン。

クラウド GPU と Token どちらが得?

低同時実行と Agent ループは Token と本番投入速度で勝つ。ファインチューン、自己保持の長文脈、API の遅延・駐在が足りない時だけ GPU を借りる。

Cloud Mac はデータセンター GPU?

違う。MCP、署名、常駐 Agent、オンデバイス検証用。推論は API か GPU。蓋閉じ再試行は Token を再購入する。

9. まとめ

2026 年の NVIDIA AI チップ輸出規制の後、中国チームが先進 AI 演算を得る合法経路は軌道分割であり、ケージに密輸する旗艦カード探しではない。第三国データセンターは D:5 本社事業体のバイパスではない。クラウド GPU は主体審査に耐える契約だけ。国産 AI チップは移植可能な学習と財政案件。API Token は大半のライブ推論。

手順:負荷を分ける → 推論は API → 最終親会社を描く → 学習は国産または認可クラウド → 実行は Cloud Mac → 「第三国ケージで回避」をマイルストーンから消す。規則は動く。軌道を毎週書き直すな。

演算は軌道で買い、実行を閉じたノートに鎖でつなぐな

輸出規則はどのカードが買えないかを決める。蓋を閉じた後に同じ推論を再課金するかは決めない。MCP、リポジトリ、署名を常時稼働の M シリーズ Cloud Mac に置け。推論は API か適法に持てる GPU、学習は移植できるスタック。日次検収のあと月次固定で、百万 Token を再試行ではなく実ステップに打て。

比較を見る · プラン · 開通