Читай-Китай

🧮 Деньги в ИИ-чипах идут не только в GPU — от США до Китая

Модель могут обучить один раз, а вызывать — миллиарды раз: миллионы агентов, миллиарды пользователей. Инвестор Etched Мамун Хамид из Kleiner Perkins: победителя всё чаще определяют не пиковые FLOPS, а токены на доллар и ватт.

В I квартале 2026 года 80 полупроводниковых стартапов привлекли $8,4 млрд, у 18 из них раунд превысил $100 млн (Semiconductor Engineering). Оценка Etched меньше чем за месяц удвоилась до $21 млрд, хотя её первый чип ещё проверяют заказчики.

Почему вычисления упёрлись в память

Около 2016 года Groq, Cerebras, Graphcore, SambaNova, Habana и Tenstorrent атаковали матрицы через AI Accelerator, NPU и ASIC. Но даже плюс 20% или удвоение мощности не заменили CUDA, сеть, серверы и ПО NVIDIA. Важнее перенос модели, масштабирование и готовность к новой архитектуре.

Обычная модель могла генерировать сотни токенов; Coding- и научные агенты, беспилотные системы и роботы могут создавать десятки тысяч или миллионы. По оценке Fractile, предел задаёт память: параметры и KV Cache читаются снова, данные переходят между чипами, платами и серверами.

Маршрут сокращают вычислениями у памяти, оптикой или моделью в кремнии. Reuters в марте передавал прогноз NVIDIA: потенциал выручки от ИИ-чипов к 2027 году — не менее $1 трлн; компания активнее развивает инференс в реальном времени.

Китай сокращает путь данных при дефиците передовых HBM

Ограничения на передовые техпроцессы, HBM, EDA и корпусирование не делают китайские решения лучше. Etched может взять N4P и строить всю систему; часть китайских стартапов идёт к зрелым нормам, 3D, памяти, RISC-V и фотонике.

КомпанияРаунд 2026 годаТехнология
Цяньхэ Ибан (谦合益邦)август, B, свыше 2 млрд юаней3D DRAM, вычисления в памяти
Вэйна Хэсинь (微纳核芯)июнь, B3/B4; серия B свыше 1 млрд юаней3D-CIM: ближние/внутрипамятные вычисления, RISC-V
Дунфан Суаньсинь (东方算芯)апрель, A+, сумма не раскрытапрограммный чип, 3D DRAM/Logic на зрелом процессе
Цзютянь Жуйсинь (九天睿芯)январь B+; апрель B++ почти 200 млн; май C свыше 100 млн юанейаналого-цифровые вычисления в памяти
Ичжу Кэцзи (亿铸科技)апрель, стратегический, сумма не раскрытаReRAM+3D DRAM, универсальные и ИИ-чипы
Ханьсюй Кэцзи (寒序科技)март, несколько десятков млн юанейSpinPU, потоковый инференс больших моделей
Гуанлянь Синькэ (光联芯科)март Pre-A; июнь A почти 500 млн юанейOptical I/O для AI Scale-up
Цисуань Гуанци (奇算光启)август, Angel/Angel+, несколько сотен млн юанейоптические интерференционные вычисления, чип 256×256
CIX Technology (此芯科技)март, B, почти 1 млрд юанейгетерогенный Arm CPU
Ланьсинь Суаньли (蓝芯算力)март, A/A+/A++, несколько сотен млн юанейсерверный CPU RISC-V+AI
Линжуй Чжисинь (灵睿智芯)июль, Pre-A, несколько сотен млн юанейпроизводительный RISC-V CPU
Божуй Цзинсинь (博瑞晶芯)январь, новый раунд свыше 1 млрд юанейсерверный CPU
Хунцзюнь Вэйдяньцзы (鸿钧微电子)июнь, стратегический, сумма не раскрытасерверный Arm CPU

Гуанлянь Синькэ передаёт данные светом, а Lightelligence (曦智科技) и Цисуань Гуанци считают светом. CPU планирует и координирует работу агента. Память, фотоника и RISC-V отвечают на тот же дефицит данных, что зарубежные ASIC и Dataflow.

За рубежом универсальность меняют на эффективность

КомпанияДеньги и база сравненияСтавка
Etched18 августа — $700 млн при оценке $21 млрд; 23 июля — C на $300 млн при $10,3 млрдFrontier Inference Cluster: Prefill/Decode, низкое напряжение, HBM+SRAM и Scale-up; A0 на N4P проверяют заказчики
Velaura AI18 августа — A на $110 млн, оценка выше $1 млрдпредельно низкое энергопотребление
Cerebrasфевраль — $1 млрд и оценка около $23 млрд против $8,1 млрд за четыре месяца до этогоWafer Scale Engine; Cloud Service
Rebellionsв марте $400 млн, оценка около $2,34 млрд; около $165 млн дал Корейский национальный фонд ростаэнергоэффективный инференс в стратегии K-Nvidia
Fractileмай — B на $220 млнпамять рядом с вычислением: низкая задержка и высокая пропускная способность
Taalasфевраль — $169 млн, всего около $219 млн; 6 августа AMD объявила о покупкеThe Model is The Computer: HC1 аппаратно отображает Llama 3.1 8B
Tensordyneпрогноз спроса выше $200 млн; D готовят позднее в 2026 годуэнергоэффективный инференс

Etched проектирует корпусирование, охлаждение, стойку и ПО; до заметной выручки получила контракты на $1 млрд и может вложиться в испытания класса 10 МВт. Инвесторы — Jane Street, Sequoia, a16z, Tiger Global; у Fractile — Accel и Founders Fund. Cerebras дошла до IPO, OpenAI ищет инференс вне NVIDIA.

Цена Taalas: триллионы запусков одной неизменной модели в день могут окупить специализацию, но HC1 менее гибок, чем GPU. AMD планирует включить технологию в AI Accelerator. В конце 2025 года NVIDIA крупно лицензировала технологию Groq и забрала часть руководителей; Qualcomm, по сообщениям, обсуждает покупку Tenstorrent за $8–10 млрд.

Что это значит

Cambricon (寒武纪), Biren Technology (壁仞), Moore Threads (摩尔线程), Iluvatar CoreX (天数智芯) и MetaX (沐曦) создавали мощный китайский ИИ-чип. Новая волна атакует перенос из DRAM, обмен в Scale-up или CPU агента. За Цяньхэ Ибан стоят государственный фонд реформ и China Mobile (中国移动), за фотоникой и CPU — местный госкапитал.

Узкий ускоритель — ставка на неизменность нагрузки: новая модель может обесценить настройку. Специализация способна снизить цену токена, зато экосистема GPU страхует смену моделей.

Стартапу необязательно победить NVIDIA: технологию памяти или архитектуру могут купить AMD, NVIDIA, Qualcomm либо облачный гигант. Как двадцать лет назад ПК породили рядом с CPU GPU, NIC, DSP и контроллеры памяти, так ИИ разделяет функции. GPU не заканчивается — может заканчиваться рынок, где для ИИ достаточно только GPU.

По материалам 36Kr, Ду Цинь DQ, 28 августа 2026.
По теме:Полупроводники и памятьИскусственный интеллект в КитаеРоботы и дроныЭнергетика и климатТехнологииЭкономика и бизнес

Каждый день — 4–5 разборов из китайской прессы. Без рекламы и воды.

Читать в Telegram