🧮 Деньги в ИИ-чипах идут не только в GPU — от США до Китая
Модель могут обучить один раз, а вызывать — миллиарды раз: миллионы агентов, миллиарды пользователей. Инвестор Etched Мамун Хамид из Kleiner Perkins: победителя всё чаще определяют не пиковые FLOPS, а токены на доллар и ватт.
В I квартале 2026 года 80 полупроводниковых стартапов привлекли $8,4 млрд, у 18 из них раунд превысил $100 млн (Semiconductor Engineering). Оценка Etched меньше чем за месяц удвоилась до $21 млрд, хотя её первый чип ещё проверяют заказчики.
Почему вычисления упёрлись в память
Около 2016 года Groq, Cerebras, Graphcore, SambaNova, Habana и Tenstorrent атаковали матрицы через AI Accelerator, NPU и ASIC. Но даже плюс 20% или удвоение мощности не заменили CUDA, сеть, серверы и ПО NVIDIA. Важнее перенос модели, масштабирование и готовность к новой архитектуре.
Обычная модель могла генерировать сотни токенов; Coding- и научные агенты, беспилотные системы и роботы могут создавать десятки тысяч или миллионы. По оценке Fractile, предел задаёт память: параметры и KV Cache читаются снова, данные переходят между чипами, платами и серверами.
Маршрут сокращают вычислениями у памяти, оптикой или моделью в кремнии. Reuters в марте передавал прогноз NVIDIA: потенциал выручки от ИИ-чипов к 2027 году — не менее $1 трлн; компания активнее развивает инференс в реальном времени.
Китай сокращает путь данных при дефиците передовых HBM
Ограничения на передовые техпроцессы, HBM, EDA и корпусирование не делают китайские решения лучше. Etched может взять N4P и строить всю систему; часть китайских стартапов идёт к зрелым нормам, 3D, памяти, RISC-V и фотонике.
| Компания | Раунд 2026 года | Технология |
|---|---|---|
| Цяньхэ Ибан (谦合益邦) | август, B, свыше 2 млрд юаней | 3D DRAM, вычисления в памяти |
| Вэйна Хэсинь (微纳核芯) | июнь, B3/B4; серия B свыше 1 млрд юаней | 3D-CIM: ближние/внутрипамятные вычисления, RISC-V |
| Дунфан Суаньсинь (东方算芯) | апрель, A+, сумма не раскрыта | программный чип, 3D DRAM/Logic на зрелом процессе |
| Цзютянь Жуйсинь (九天睿芯) | январь B+; апрель B++ почти 200 млн; май C свыше 100 млн юаней | аналого-цифровые вычисления в памяти |
| Ичжу Кэцзи (亿铸科技) | апрель, стратегический, сумма не раскрыта | ReRAM+3D DRAM, универсальные и ИИ-чипы |
| Ханьсюй Кэцзи (寒序科技) | март, несколько десятков млн юаней | SpinPU, потоковый инференс больших моделей |
| Гуанлянь Синькэ (光联芯科) | март Pre-A; июнь A почти 500 млн юаней | Optical I/O для AI Scale-up |
| Цисуань Гуанци (奇算光启) | август, Angel/Angel+, несколько сотен млн юаней | оптические интерференционные вычисления, чип 256×256 |
| CIX Technology (此芯科技) | март, B, почти 1 млрд юаней | гетерогенный Arm CPU |
| Ланьсинь Суаньли (蓝芯算力) | март, A/A+/A++, несколько сотен млн юаней | серверный CPU RISC-V+AI |
| Линжуй Чжисинь (灵睿智芯) | июль, Pre-A, несколько сотен млн юаней | производительный RISC-V CPU |
| Божуй Цзинсинь (博瑞晶芯) | январь, новый раунд свыше 1 млрд юаней | серверный CPU |
| Хунцзюнь Вэйдяньцзы (鸿钧微电子) | июнь, стратегический, сумма не раскрыта | серверный Arm CPU |
Гуанлянь Синькэ передаёт данные светом, а Lightelligence (曦智科技) и Цисуань Гуанци считают светом. CPU планирует и координирует работу агента. Память, фотоника и RISC-V отвечают на тот же дефицит данных, что зарубежные ASIC и Dataflow.
За рубежом универсальность меняют на эффективность
| Компания | Деньги и база сравнения | Ставка |
|---|---|---|
| Etched | 18 августа — $700 млн при оценке $21 млрд; 23 июля — C на $300 млн при $10,3 млрд | Frontier Inference Cluster: Prefill/Decode, низкое напряжение, HBM+SRAM и Scale-up; A0 на N4P проверяют заказчики |
| Velaura AI | 18 августа — A на $110 млн, оценка выше $1 млрд | предельно низкое энергопотребление |
| Cerebras | февраль — $1 млрд и оценка около $23 млрд против $8,1 млрд за четыре месяца до этого | Wafer Scale Engine; Cloud Service |
| Rebellions | в марте $400 млн, оценка около $2,34 млрд; около $165 млн дал Корейский национальный фонд роста | энергоэффективный инференс в стратегии K-Nvidia |
| Fractile | май — B на $220 млн | память рядом с вычислением: низкая задержка и высокая пропускная способность |
| Taalas | февраль — $169 млн, всего около $219 млн; 6 августа AMD объявила о покупке | The Model is The Computer: HC1 аппаратно отображает Llama 3.1 8B |
| Tensordyne | прогноз спроса выше $200 млн; D готовят позднее в 2026 году | энергоэффективный инференс |
Etched проектирует корпусирование, охлаждение, стойку и ПО; до заметной выручки получила контракты на $1 млрд и может вложиться в испытания класса 10 МВт. Инвесторы — Jane Street, Sequoia, a16z, Tiger Global; у Fractile — Accel и Founders Fund. Cerebras дошла до IPO, OpenAI ищет инференс вне NVIDIA.
Цена Taalas: триллионы запусков одной неизменной модели в день могут окупить специализацию, но HC1 менее гибок, чем GPU. AMD планирует включить технологию в AI Accelerator. В конце 2025 года NVIDIA крупно лицензировала технологию Groq и забрала часть руководителей; Qualcomm, по сообщениям, обсуждает покупку Tenstorrent за $8–10 млрд.
Что это значит
Cambricon (寒武纪), Biren Technology (壁仞), Moore Threads (摩尔线程), Iluvatar CoreX (天数智芯) и MetaX (沐曦) создавали мощный китайский ИИ-чип. Новая волна атакует перенос из DRAM, обмен в Scale-up или CPU агента. За Цяньхэ Ибан стоят государственный фонд реформ и China Mobile (中国移动), за фотоникой и CPU — местный госкапитал.
Узкий ускоритель — ставка на неизменность нагрузки: новая модель может обесценить настройку. Специализация способна снизить цену токена, зато экосистема GPU страхует смену моделей.
Стартапу необязательно победить NVIDIA: технологию памяти или архитектуру могут купить AMD, NVIDIA, Qualcomm либо облачный гигант. Как двадцать лет назад ПК породили рядом с CPU GPU, NIC, DSP и контроллеры памяти, так ИИ разделяет функции. GPU не заканчивается — может заканчиваться рынок, где для ИИ достаточно только GPU.