Итог
- Нет H100 / B200 не значит нет продвинутой ИИ-мощности. Разделите нагрузку: обучение, инференс, исполнение агента — не прикручивайте к одной контролируемой карте.
- Руководство BIS от 31.05.2026 говорит: штаб-квартира в D:5 (включая Китай) или Макао либо конечная материнская компания там — лицензия на передовые вычислительные изделия нужна везде. ЦОД в третьей стране — не законный обход.
- Большинству продуктовых и агентных команд нужны токены (API), не карты. Облачный GPU — только для проверяемого субъекта, которому надо хостить веса.
- Отечественные ИИ-чипы (Ascend, Cambricon) подходят тем, кто портирует графы и платит миграцию с CUDA — не тем, кому «завтра стоковый CUDA».
- Cloud Mac держит MCP, подпись и постоянно живых агентов и не заменяет GPU дата-центра. Повтор после закрытой крышки покупает тот же инференс снова.
Можно ли купить чип — не водораздел. На каком соответственном пути сидит каждая нагрузка — водораздел.
0. Итог
На 2026-09-08 американские ограничения экспорта ИИ-чипов NVIDIA дошли от H100 / H200 / Blackwell до лицензируемого H20 и заблокированного урезанного B30A. Китай параллельно толкает государственные ЦОД на отечественные ускорители и может требовать снять иностранные детали с незавершённых площадок. Старый ответ «просто занести флагманскую карту в зал» мёртв.
Контрасты для тех, кому решать на этой неделе:
- Продуктовый инференс / циклы агента: по умолчанию токены. DeepSeek, Qwen, Gemini, Claude продают продвинутую способность как API, не перевозя контролируемый кремний. Стоимость: стоимость токенов DeepSeek V4-Flash.
- Нужно учить или дообучать: портируйте на отечественный кластер, если меняете граф. Лицензированный облачный GPU — только если конечная мать явно не D:5. «Дочка в Сингапуре + HQ в Китае» — не исключение из лицензии.
- ЦОД в третьих странах: для покупателя с HQ в Китае после середины 2026 это вопрос лицензии и enforcement, не серый ярлык. Читайте BIS 31.05.2026 и экспортный комплаенс NVIDIA.
- Исполнение: MCP, Keychain, xcodebuild, постоянно живые агенты — на Cloud Mac, не в том же контролируемом packing list, что обучающие GPU.
GPU против Mac по пропускной способности инференса — другой срез; см. NVIDIA GTC Berlin 2026: арендовать GPU или Mac.
1. Почему старый план умер после ограничений экспорта
Команды равняли «продвинутую ИИ-мощность» с «флагманом NVIDIA в клетке». После 2022 США затянули A100, H100 и затем Blackwell в контроль advanced computing по плотности и интерконнекту. Появились китайские бины (A800 / H800 / H20); каждый раз, когда они приближались к frontier-обучению в кластере, правило ужесточалось. В 2025–2026 H20 ушёл под лицензию, а B30A трактовали как полный запрет, потому что кластеры всё ещё могли учить большие модели.
Пекин потребовал отечественные чипы для госстроек; ранние площадки могут снять уже поставленные иностранные ускорители. Отсюда дорогая интуиция: остались только серый рынок или стойка в третьей стране. Это связывает комплаенс, comms поставки и CUDA lock-in и не отдаёт агента на следующей неделе.
- Контроль крепится к изделию плюс субъекту конечного пользователя, не к флагу на клетке. См. 15 CFR 742 и записку BIS.
- После ужесточения KYC облаков для клиентов с HQ в D:5 контракт в третьей стране сам по себе не доставляет H100.
- У серых карт нет драйверов, гарантии интерконнекта и законного пути положить веса в прод.
Настоящий вопрос не «может ли Китай ещё купить NVIDIA». Вопрос: какая доля нагрузки должна хостить веса, какая может быть токенами, а какая — просто хост исполнения, притворяющийся FLOPS.
2. Пять путей вычислений
2.1 Путь A: API моделей / купить токены
Вход — ключ API или корпоративный контракт. Исполнение — инференс, инструменты, длинный контекст. Контекст — разрешённые промпты и файлы. Стоимость за миллион токенов; граница — резидентность и оговорки об обучении. Это дефолтная продвинутая мощность большинства китайских продуктов и исходящих агентов в 2026. Не клеите заказ «обучить 70B» на саппорт-бота.
2.2 Путь B: лицензированный облачный GPU
Вход — AWS / Azure / GCP / лицензированное GPU-облако. Исполнение — CUDA-обучение и свой инференс. Стоимость — GPU-часы + egress + простой. Граница: кто подписывает, где конечная мать, считает ли облако заказ лицензируемым реэкспортом. Путь есть, только если субъект переживает эту проверку.
2.3 Путь C: ЦОД в третьей стране
В брошюре: клетка в Малайзии, Таиланде, Сингапуре или ОАЭ и «местная компания». После 31.05.2026 BIS подтвердил: передовые вычислительные изделия для субъектов с HQ в D:5 / Макао или чья конечная мать там — нуждаются в лицензии независимо от места регистрации получателя. Добросовестные операторы в рамках EAR пока не обязаны прекращать текущее использование из‑за этой записки. Это не новая дверь покупки для HQ в Китае. Писать в план запуска «ЦОД третьей страны обходит ограничения экспорта NVIDIA» — ставить веху на паузу enforcement.
2.4 Путь D: отечественные ИИ-чипы
Huawei Ascend, Cambricon, Biren, Moore Threads идут на CANN или своих рантаймах — не прозрачная замена CUDA. Старт: сообщество Ascend. Исполнение покрывает обучение и инференс, если переписать графы, связь и телеметрию. Контекст — отечественный кластер и отечественная резидентность. Стоимость — человеко-месяцы плюс электричество, не долларовый стикер. Госпроекты почти обязаны жить здесь.
2.5 Путь E: гетерогенное исполнение (Cloud Mac / Apple silicon)
Вход — SSH / VNC на облачный или локальный Mac. Исполнение — MCP, подпись, worktree, on-device Core ML, не обучение на H100. Низкоконкурентные прототипы могут пробовать малые модели в unified memory; прод-пропускная способность возвращается к API или GPU. Память как узкое место: Mac mini как сервер ИИ-агента. Автоматизация аренды: платформа FOSSBilling.
3. Сравнение с одним набором заголовков
Поставьте клетки третьих стран, облачные GPU, отечественные чипы, API и хост исполнения в одну таблицу, чтобы не спрашивать только «это CUDA?».
| Слой / вариант | Вход | Исполнение | Контекст | Стоимость | Граница прав |
|---|---|---|---|---|---|
| API / токены | Ключ / корп. контракт | Инференс, инструменты, длинный контекст | Разрешённые промпты и файлы | За миллион токенов; ретраи удваивают | Резидентность и обучение у вендора |
| Лицензированный облачный GPU | Консоль / commit | CUDA-обучение + свой инференс | Веса в VPC | GPU-часы + простой + egress | Подписант и конечная мать |
| ЦОД третьей страны | Контракт на клетку за рубежом | На бумаге как облачный GPU | Страна клетки ≠ исключение из лицензии | Аренда + due diligence + enforcement | BIS смотрит HQ, не наклейку |
| Отечественные ИИ-чипы | Отечественное облако / свой зал | Обучение/инференс на своём стеке | Отечественные данные и тулинг | Месяцы миграции + электричество | Почти обязательно для фискальных строек |
| Исполнение Cloud Mac | SSH / облачный Mac | MCP, подпись, живые агенты | Репозитории, сертификаты, Keychain | Суточная аренда, не FLOPS | Пользователь процесса и egress |
Асимметричная строка: перенос клетки в другую страну не стирает «конечная мать в Китае». Более дешёвая отечественная карта также не останавливает повторную покупку токенов после крышки. SKU — риска на пути.
4. Матрица сценариев
| Слой / вариант | Вход | Исполнение | Контекст | Стоимость | Граница прав |
|---|---|---|---|---|---|
| Саппорт / кодинг-агент, низкий QPS | API по умолчанию | Flash или отечественное API, лимит шагов | Короткий контекст + кэш system | Бюджет выхода 3–8× входа | Ключи только на бэкенде |
| Дообучить 7B–70B, можно портировать | Отечественный кластер | Стек обучения Ascend / Cambricon | Данные остаются в стране | Человеко-месяцы > цена карты | Сначала фискальный или внутренний комплаенс |
| Независимая не-D:5 конечная мать | Лицензированный облачный GPU | Короткая аренда CUDA для доказательства | VPC + ротация ключей | Суточно, потом commit | Юристы сначала BIS / KYC облака |
| HQ Китай + желание зарубежной клетки | Не делать дефолтом | Считать лицензию отказанной | Бумага третьей страны недостаточна | Due diligence часто дороже API | Читать BIS; убрать из плана запуска |
| iOS / MCP / оркестрация 24/7 | Cloud Mac + API | Mac исполняет, не учит | Серты и DerivedData остаются на Mac | Суточная машина + токены | Keychain не покидает коробку |
| Государственный ЦОД | Отечественные чипы | Сдать стек тендера | Отечественная резидентность | Вписать миграцию в график | Иностранные ускорители могут снять |
5. Рекомендуемые стеки
A | Продуктовый дефолт (большинство команд) Отечественный или мировой API-инференс → потолок шагов + дневной бюджет → MCP / подпись на Cloud Mac → без покупки контролируемого флагмана NVIDIA B | Нужно учить самим Кластер Ascend / Cambricon → сначала портировать один реальный граф обучения → переписать связь и мониторы вместе с ним → живой инференс оставить на API C | Соответственный зарубежный субъект Юристы подтверждают конечную мать → короткий цикл лицензированного облачного GPU → egress и ротация ключей в runbook → никакой оболочки третьей страны как лицензии D | Фискальный / локализационный проект 100% отечественные ускорители → зафиксировать CANN (или стек тендера) в SOW → никогда не ставить «ждём послабление B30A» на критический путь
6. Ловушки
- Ловушка 1: клетка в Сингапуре / Малайзии = законный H100. BIS смотрит HQ конечной матери, не наклейку.
- Ловушка 2: продвинутый ИИ требует своего NVIDIA. Большинство живых запросов — инференс; токены уже есть продвинутая мощность.
- Ловушка 3: отечественные чипы — «слабый CUDA». Другой стек. Нет порта операторов — нет вычислений.
- Ловушка 4: серые карты в проде. Нет драйверов, гарантии, пути комплаенса.
- Ловушка 5: котировка облачного GPU без субъекта. Проваленный KYC делает контракт бумагой.
- Ловушка 6: крутить агента на ноутбуке и винить нехватку GPU. Ретраи после крышки покупают токены, не карты.
- Ловушка 7: читать экспортные правила как «Китай больше никогда не получит NVIDIA». Лицензии и бины двигаются. Пишите план по путям.
7. Семь шагов
- Разделить нагрузку следующей недели на train / infer / execute. Запретить «всё нужно на H100».
- Выбрать API для колонки infer (документация DeepSeek API или отечественный хост) и измерить токены на реальном промпте.
- Нарисовать субъект против BIS 31.05.2026: HQ, конечная мать, облачный аккаунт. HQ Китай → не класть клетку третьей страны в дизайн.
- Если надо учить — выбрать отечественный стек и портировать один граф, воспроизводящий loss, до заполнения зала.
- Открыть короткий PoC лицензированного облачного GPU только после того, как субъект пережил облачную и экспортную проверку.
- Перенести MCP, подпись и оркестрацию 24/7 на Cloud Mac, чтобы убить ретраи после крышки. Границы: MCP на Cloud Mac vs VPS vs локально.
- Выпустить одну страницу: дефолт API, обучение отечественное, без серого рынка, без обхода через третью страну. Сверять счёт и субъект ежемесячно.
8. FAQ
Обходит ли ЦОД в третьей стране ограничения экспорта NVIDIA?
Нет для компаний с штаб-квартирой в Китае или Макао или чья конечная материнская компания там. BIS (31.05.2026): на передовые вычислительные изделия лицензия нужна по всему миру. Стойка в Малайзии — не законный обход.
Без H100 нет продвинутого ИИ?
Большинству продуктов и агентов свои H100 не нужны. Инференс — через API; обучение — на переносимых отечественных стеках или лицензированном облачном GPU у правомерного субъекта. Разрыв — путь, не одна SKU.
Заменяют ли отечественные чипы CUDA?
Частично для обучения и инференса, не как дефолт для каждого ядра. Цена — операторы, интерконнект и тулинг.
Облачный GPU или токены?
Низкая параллельность и циклы агента обычно выигрывают на токенах и time-to-prod. GPU — для дообучения, резидентности или лимитов API.
Cloud Mac — это GPU дата-центра?
Нет. MCP, подпись, постоянно живые агенты, on-device проверки. Инференс — API или GPU. Ретраи после крышки покупают токены снова.
9. Вывод
После ограничений экспорта ИИ-чипов NVIDIA в 2026 китайские команды получают продвинутую ИИ-мощность, разделяя пути — не охотясь за флагманской картой в клетку. ЦОД в третьей стране не обход для HQ D:5. Облачный GPU служит только контрактам, пережившим проверку субъекта. Отечественные ИИ-чипы служат переносимому обучению и фискальным стройкам. Токены API — большинству живого инференса.
Порядок: разделить нагрузку → инференс на API → нарисовать конечную мать → учить на отечественном или лицензированном облаке → исполнять на Cloud Mac → вычеркнуть «клетка третьей страны как обход» из вех. Правила сдвинутся; пути не стоит переписывать каждую неделю.
Покупайте мощность на пути; не приковывайте исполнение к закрытому ноутбуку
Экспортные правила решают, какую карту вы не купите. Они не решают, перекупит ли агент тот же инференс после крышки. Держите MCP, репозиторий и подпись на всегда включённом Cloud Mac серии M. Инференс — на API или GPU, который можно законно держать; обучение — на переносимом стеке. Суточная приёмка, затем месячная фиксация — чтобы каждый миллион токенов бил в реальный шаг, а не в ретрай.