Акция

После ограничений экспорта NVIDIA: как Китай получает продвинутую ИИ-мощность

AI-инженерия Экспортный контроль · вычисления
2026-09-08 ~14 мин

Итог: Нет H100 не значит нет продвинутой ИИ-мощности. Разделите обучение, инференс, исполнение. ЦОД в третьей стране не законный обход для HQ в Китае.

Водораздел — соответственный путь: токены API, лицензированный облачный GPU, отечественные ИИ-чипы или исполнение на Cloud Mac.

Итог

  1. Нет H100 / B200 не значит нет продвинутой ИИ-мощности. Разделите нагрузку: обучение, инференс, исполнение агента — не прикручивайте к одной контролируемой карте.
  2. Руководство BIS от 31.05.2026 говорит: штаб-квартира в D:5 (включая Китай) или Макао либо конечная материнская компания там — лицензия на передовые вычислительные изделия нужна везде. ЦОД в третьей стране — не законный обход.
  3. Большинству продуктовых и агентных команд нужны токены (API), не карты. Облачный GPU — только для проверяемого субъекта, которому надо хостить веса.
  4. Отечественные ИИ-чипы (Ascend, Cambricon) подходят тем, кто портирует графы и платит миграцию с CUDA — не тем, кому «завтра стоковый CUDA».
  5. Cloud Mac держит MCP, подпись и постоянно живых агентов и не заменяет GPU дата-центра. Повтор после закрытой крышки покупает тот же инференс снова.
Можно ли купить чип — не водораздел. На каком соответственном пути сидит каждая нагрузка — водораздел.
Стойки ЦОД и холодный коридор как образ выбора ИИ-мощности при экспортном контроле
Узкое место не в том, есть ли карта NVIDIA, а на каком проверяемом пути лежат обучение, инференс и исполнение.

0. Итог

На 2026-09-08 американские ограничения экспорта ИИ-чипов NVIDIA дошли от H100 / H200 / Blackwell до лицензируемого H20 и заблокированного урезанного B30A. Китай параллельно толкает государственные ЦОД на отечественные ускорители и может требовать снять иностранные детали с незавершённых площадок. Старый ответ «просто занести флагманскую карту в зал» мёртв.

Контрасты для тех, кому решать на этой неделе:

  • Продуктовый инференс / циклы агента: по умолчанию токены. DeepSeek, Qwen, Gemini, Claude продают продвинутую способность как API, не перевозя контролируемый кремний. Стоимость: стоимость токенов DeepSeek V4-Flash.
  • Нужно учить или дообучать: портируйте на отечественный кластер, если меняете граф. Лицензированный облачный GPU — только если конечная мать явно не D:5. «Дочка в Сингапуре + HQ в Китае» — не исключение из лицензии.
  • ЦОД в третьих странах: для покупателя с HQ в Китае после середины 2026 это вопрос лицензии и enforcement, не серый ярлык. Читайте BIS 31.05.2026 и экспортный комплаенс NVIDIA.
  • Исполнение: MCP, Keychain, xcodebuild, постоянно живые агенты — на Cloud Mac, не в том же контролируемом packing list, что обучающие GPU.

GPU против Mac по пропускной способности инференса — другой срез; см. NVIDIA GTC Berlin 2026: арендовать GPU или Mac.

1. Почему старый план умер после ограничений экспорта

Команды равняли «продвинутую ИИ-мощность» с «флагманом NVIDIA в клетке». После 2022 США затянули A100, H100 и затем Blackwell в контроль advanced computing по плотности и интерконнекту. Появились китайские бины (A800 / H800 / H20); каждый раз, когда они приближались к frontier-обучению в кластере, правило ужесточалось. В 2025–2026 H20 ушёл под лицензию, а B30A трактовали как полный запрет, потому что кластеры всё ещё могли учить большие модели.

Пекин потребовал отечественные чипы для госстроек; ранние площадки могут снять уже поставленные иностранные ускорители. Отсюда дорогая интуиция: остались только серый рынок или стойка в третьей стране. Это связывает комплаенс, comms поставки и CUDA lock-in и не отдаёт агента на следующей неделе.

  • Контроль крепится к изделию плюс субъекту конечного пользователя, не к флагу на клетке. См. 15 CFR 742 и записку BIS.
  • После ужесточения KYC облаков для клиентов с HQ в D:5 контракт в третьей стране сам по себе не доставляет H100.
  • У серых карт нет драйверов, гарантии интерконнекта и законного пути положить веса в прод.

Настоящий вопрос не «может ли Китай ещё купить NVIDIA». Вопрос: какая доля нагрузки должна хостить веса, какая может быть токенами, а какая — просто хост исполнения, притворяющийся FLOPS.

2. Пять путей вычислений

2.1 Путь A: API моделей / купить токены

Вход — ключ API или корпоративный контракт. Исполнение — инференс, инструменты, длинный контекст. Контекст — разрешённые промпты и файлы. Стоимость за миллион токенов; граница — резидентность и оговорки об обучении. Это дефолтная продвинутая мощность большинства китайских продуктов и исходящих агентов в 2026. Не клеите заказ «обучить 70B» на саппорт-бота.

2.2 Путь B: лицензированный облачный GPU

Вход — AWS / Azure / GCP / лицензированное GPU-облако. Исполнение — CUDA-обучение и свой инференс. Стоимость — GPU-часы + egress + простой. Граница: кто подписывает, где конечная мать, считает ли облако заказ лицензируемым реэкспортом. Путь есть, только если субъект переживает эту проверку.

2.3 Путь C: ЦОД в третьей стране

В брошюре: клетка в Малайзии, Таиланде, Сингапуре или ОАЭ и «местная компания». После 31.05.2026 BIS подтвердил: передовые вычислительные изделия для субъектов с HQ в D:5 / Макао или чья конечная мать там — нуждаются в лицензии независимо от места регистрации получателя. Добросовестные операторы в рамках EAR пока не обязаны прекращать текущее использование из‑за этой записки. Это не новая дверь покупки для HQ в Китае. Писать в план запуска «ЦОД третьей страны обходит ограничения экспорта NVIDIA» — ставить веху на паузу enforcement.

2.4 Путь D: отечественные ИИ-чипы

Huawei Ascend, Cambricon, Biren, Moore Threads идут на CANN или своих рантаймах — не прозрачная замена CUDA. Старт: сообщество Ascend. Исполнение покрывает обучение и инференс, если переписать графы, связь и телеметрию. Контекст — отечественный кластер и отечественная резидентность. Стоимость — человеко-месяцы плюс электричество, не долларовый стикер. Госпроекты почти обязаны жить здесь.

2.5 Путь E: гетерогенное исполнение (Cloud Mac / Apple silicon)

Вход — SSH / VNC на облачный или локальный Mac. Исполнение — MCP, подпись, worktree, on-device Core ML, не обучение на H100. Низкоконкурентные прототипы могут пробовать малые модели в unified memory; прод-пропускная способность возвращается к API или GPU. Память как узкое место: Mac mini как сервер ИИ-агента. Автоматизация аренды: платформа FOSSBilling.

3. Сравнение с одним набором заголовков

Поставьте клетки третьих стран, облачные GPU, отечественные чипы, API и хост исполнения в одну таблицу, чтобы не спрашивать только «это CUDA?».

Слой / вариантВходИсполнениеКонтекстСтоимостьГраница прав
API / токеныКлюч / корп. контрактИнференс, инструменты, длинный контекстРазрешённые промпты и файлыЗа миллион токенов; ретраи удваиваютРезидентность и обучение у вендора
Лицензированный облачный GPUКонсоль / commitCUDA-обучение + свой инференсВеса в VPCGPU-часы + простой + egressПодписант и конечная мать
ЦОД третьей страныКонтракт на клетку за рубежомНа бумаге как облачный GPUСтрана клетки ≠ исключение из лицензииАренда + due diligence + enforcementBIS смотрит HQ, не наклейку
Отечественные ИИ-чипыОтечественное облако / свой залОбучение/инференс на своём стекеОтечественные данные и тулингМесяцы миграции + электричествоПочти обязательно для фискальных строек
Исполнение Cloud MacSSH / облачный MacMCP, подпись, живые агентыРепозитории, сертификаты, KeychainСуточная аренда, не FLOPSПользователь процесса и egress

Асимметричная строка: перенос клетки в другую страну не стирает «конечная мать в Китае». Более дешёвая отечественная карта также не останавливает повторную покупку токенов после крышки. SKU — риска на пути.

4. Матрица сценариев

Слой / вариантВходИсполнениеКонтекстСтоимостьГраница прав
Саппорт / кодинг-агент, низкий QPSAPI по умолчаниюFlash или отечественное API, лимит шаговКороткий контекст + кэш systemБюджет выхода 3–8× входаКлючи только на бэкенде
Дообучить 7B–70B, можно портироватьОтечественный кластерСтек обучения Ascend / CambriconДанные остаются в странеЧеловеко-месяцы > цена картыСначала фискальный или внутренний комплаенс
Независимая не-D:5 конечная матьЛицензированный облачный GPUКороткая аренда CUDA для доказательстваVPC + ротация ключейСуточно, потом commitЮристы сначала BIS / KYC облака
HQ Китай + желание зарубежной клеткиНе делать дефолтомСчитать лицензию отказаннойБумага третьей страны недостаточнаDue diligence часто дороже APIЧитать BIS; убрать из плана запуска
iOS / MCP / оркестрация 24/7Cloud Mac + APIMac исполняет, не учитСерты и DerivedData остаются на MacСуточная машина + токеныKeychain не покидает коробку
Государственный ЦОДОтечественные чипыСдать стек тендераОтечественная резидентностьВписать миграцию в графикИностранные ускорители могут снять

5. Рекомендуемые стеки

A | Продуктовый дефолт (большинство команд)
  Отечественный или мировой API-инференс
  → потолок шагов + дневной бюджет
  → MCP / подпись на Cloud Mac
  → без покупки контролируемого флагмана NVIDIA

B | Нужно учить самим
  Кластер Ascend / Cambricon
  → сначала портировать один реальный граф обучения
  → переписать связь и мониторы вместе с ним
  → живой инференс оставить на API

C | Соответственный зарубежный субъект
  Юристы подтверждают конечную мать
  → короткий цикл лицензированного облачного GPU
  → egress и ротация ключей в runbook
  → никакой оболочки третьей страны как лицензии

D | Фискальный / локализационный проект
  100% отечественные ускорители
  → зафиксировать CANN (или стек тендера) в SOW
  → никогда не ставить «ждём послабление B30A» на критический путь

6. Ловушки

  • Ловушка 1: клетка в Сингапуре / Малайзии = законный H100. BIS смотрит HQ конечной матери, не наклейку.
  • Ловушка 2: продвинутый ИИ требует своего NVIDIA. Большинство живых запросов — инференс; токены уже есть продвинутая мощность.
  • Ловушка 3: отечественные чипы — «слабый CUDA». Другой стек. Нет порта операторов — нет вычислений.
  • Ловушка 4: серые карты в проде. Нет драйверов, гарантии, пути комплаенса.
  • Ловушка 5: котировка облачного GPU без субъекта. Проваленный KYC делает контракт бумагой.
  • Ловушка 6: крутить агента на ноутбуке и винить нехватку GPU. Ретраи после крышки покупают токены, не карты.
  • Ловушка 7: читать экспортные правила как «Китай больше никогда не получит NVIDIA». Лицензии и бины двигаются. Пишите план по путям.

7. Семь шагов

  1. Разделить нагрузку следующей недели на train / infer / execute. Запретить «всё нужно на H100».
  2. Выбрать API для колонки infer (документация DeepSeek API или отечественный хост) и измерить токены на реальном промпте.
  3. Нарисовать субъект против BIS 31.05.2026: HQ, конечная мать, облачный аккаунт. HQ Китай → не класть клетку третьей страны в дизайн.
  4. Если надо учить — выбрать отечественный стек и портировать один граф, воспроизводящий loss, до заполнения зала.
  5. Открыть короткий PoC лицензированного облачного GPU только после того, как субъект пережил облачную и экспортную проверку.
  6. Перенести MCP, подпись и оркестрацию 24/7 на Cloud Mac, чтобы убить ретраи после крышки. Границы: MCP на Cloud Mac vs VPS vs локально.
  7. Выпустить одну страницу: дефолт API, обучение отечественное, без серого рынка, без обхода через третью страну. Сверять счёт и субъект ежемесячно.

8. FAQ

Обходит ли ЦОД в третьей стране ограничения экспорта NVIDIA?

Нет для компаний с штаб-квартирой в Китае или Макао или чья конечная материнская компания там. BIS (31.05.2026): на передовые вычислительные изделия лицензия нужна по всему миру. Стойка в Малайзии — не законный обход.

Без H100 нет продвинутого ИИ?

Большинству продуктов и агентов свои H100 не нужны. Инференс — через API; обучение — на переносимых отечественных стеках или лицензированном облачном GPU у правомерного субъекта. Разрыв — путь, не одна SKU.

Заменяют ли отечественные чипы CUDA?

Частично для обучения и инференса, не как дефолт для каждого ядра. Цена — операторы, интерконнект и тулинг.

Облачный GPU или токены?

Низкая параллельность и циклы агента обычно выигрывают на токенах и time-to-prod. GPU — для дообучения, резидентности или лимитов API.

Cloud Mac — это GPU дата-центра?

Нет. MCP, подпись, постоянно живые агенты, on-device проверки. Инференс — API или GPU. Ретраи после крышки покупают токены снова.

9. Вывод

После ограничений экспорта ИИ-чипов NVIDIA в 2026 китайские команды получают продвинутую ИИ-мощность, разделяя пути — не охотясь за флагманской картой в клетку. ЦОД в третьей стране не обход для HQ D:5. Облачный GPU служит только контрактам, пережившим проверку субъекта. Отечественные ИИ-чипы служат переносимому обучению и фискальным стройкам. Токены API — большинству живого инференса.

Порядок: разделить нагрузку → инференс на API → нарисовать конечную мать → учить на отечественном или лицензированном облаке → исполнять на Cloud Mac → вычеркнуть «клетка третьей страны как обход» из вех. Правила сдвинутся; пути не стоит переписывать каждую неделю.

Покупайте мощность на пути; не приковывайте исполнение к закрытому ноутбуку

Экспортные правила решают, какую карту вы не купите. Они не решают, перекупит ли агент тот же инференс после крышки. Держите MCP, репозиторий и подпись на всегда включённом Cloud Mac серии M. Инференс — на API или GPU, который можно законно держать; обучение — на переносимом стеке. Суточная приёмка, затем месячная фиксация — чтобы каждый миллион токенов бил в реальный шаг, а не в ретрай.

Сравнить варианты · Тарифы · Начать онбординг