Groq получила $350 млн и расширяет облако инференса на GPU Nvidia

Groq привлекла $350 млн на развитие облачной инфраструктуры для ИИ-инференса. Раунд возглавила инвестиционная фирма Disruptive, Nvidia планирует участвовать, а оценка компании составила $3,5 млрд. Средства направят на предоставление средних и крупных кластеров ускоренных вычислений Nvidia для обучения и запуска моделей.
Сделка отражает смену бизнес-модели Groq. Компания начинала как разработчик собственных LPU — Language Processing Units, предназначенных для конкуренции с Nvidia в задачах инференса в реальном времени. После лицензионного соглашения с Nvidia, в рамках которого к производителю GPU перешли основатель и гендиректор Джонатан Росс и другие ключевые сотрудники, Groq переориентировалась на облако и дата-центры с системами Nvidia.
Новая оценка после смены модели
Нынешняя оценка в $3,5 млрд заметно ниже $6,9 млрд, которые Groq получила в сентябре прошлого года. Представитель компании не считает новый раунд понижением оценки: по его словам, он формирует стоимость Groq в версии после лицензионной сделки с Nvidia.
Это уже второй крупный раунд после разворота: в июне Groq привлекла $650 млн, чтобы начать расширение облачного направления. Контекст этого перехода задаёт ставка компании на облако инференса и новая ставка компании на инфраструктуру инференса.
Ставка на дата-центры и GPU-кластеры
Сейчас Groq управляет 13 дата-центрами в Северной Америке, Европе, на Ближнем Востоке и в Азиатско-Тихоокеанском регионе. Компания сообщает, что обслуживает более 6 млн разработчиков, предприятий и AI-native-компаний.
Groq намерена увеличить доступную мощность с 54 МВт до более чем 200 МВт к 2027 году. Председатель Groq и CEO Disruptive Алекс Дэвис заявил, что компания строит облако, ориентированное на инференс, который он называет наиболее крупным и критически важным слоем ИИ-инфраструктуры.
Конкуренция в сегменте neocloud
Groq выходит в сегмент, где GPU Nvidia уже используют CoreWeave, Lambda и Nebius. Nvidia не только поставляет им ускорители, но и инвестирует в часть таких компаний. При этом спрос на инференс растёт вместе с масштабированием корпоративных ИИ-нагрузок, а финансовая устойчивость neocloud-провайдеров остаётся открытым вопросом из-за крупных капитальных затрат, долговой нагрузки и быстрого обесценения оборудования.
Для бизнеса новость означает расширение числа поставщиков крупных кластеров Nvidia для обучения и инференса. При выборе такого сервиса важно сопоставлять доступную мощность, географию дата-центров и условия использования инфраструктуры с требованиями конкретных ИИ-нагрузок.

