Cerebras запускает CS-4, свою первую многослойную систему, хотя чип внутри не новый.
Cerebras впервые разместила три своих процессора размером с обеденную тарелку в одном стойке. CS-4, представленный во вторник на мероприятии Supernova компании и который начнет отгрузку в этом квартале, позиционируется как машина для вывода для передовых моделей, и Cerebras утверждает, что она работает до 30 раз быстрее, чем системы на базе GPU.
Запуск состоялся через пять дней после того, как режим Ultrafast от OpenAI, который запускает GPT-5.6 Sol примерно в 14 раз быстрее на кремнии Cerebras, стал доступен. Это также первое оборудование, которое компания отгрузила с момента своего дебюта на Nasdaq в мае за 5,55 миллиарда долларов, крупнейшего технологического листинга в США с момента Snowflake.
На бумаге система впечатляющая. Каждый CS-4 содержит три вафера WSE-3 Turbo с общими 750 петафлопсами разреженных вычислений FP16, 129,6 петабайтами в секунду пропускной способности памяти и поддержкой моделей свыше 50 триллионов параметров.
Задержка между вафлями снижается до двух микросекунд с пяти, и стойка использует вдвое меньше компонентов, чем ее предшественник. Cerebras переместила преобразование энергии, по собственным словам, на сто раз ближе к процессорам, установив его в съемном рюкзаке на задней панели шасси.
Менее ясно, является ли чип внутри действительно новым. WSE-3 Turbo содержит те же четыре триллиона транзисторов, те же 900 000 ядер, те же 44 ГБ встроенной SRAM и тот же узел TSMC 5 нм, что и WSE-3, который он заменяет.
The Register пришел к выводу, что это не новый кремний, а существующий кристалл, разогнанный с примерно 1,4 ГГц до 2,8 ГГц. Вычисления и пропускная способность на вафер оба точно удваиваются, что является признаком увеличения тактовой частоты, а не переработки, и у Cerebras все равно запланировано действительно новое поколение на 2027 год.
Заявление о 30-кратном увеличении измеряет токены в секунду на пользователя на одной модели, gpt-oss-120b, по сравнению с неназванными системами GPU, а 250 петафлопс на вафер — это разреженное FP16 число по сравнению с 25 петафлопсами плотного.
Где дизайн действительно выглядит дифференцированным, так это в потреблении энергии. The Register оценивает CS-4 на уровне 120-140 киловатт на стойку, что примерно вдвое меньше, чем потребляют сопоставимые системы на базе AMD и Nvidia, что дает заявленное десятикратное увеличение пропускной способности на ватт с чего-то правдоподобного.
Эндрю Фельдман, генеральный директор, акцентировал внимание на запуске в контексте задержки, а не сырой пропускной способности. «В ИИ скорость — это продуктивность», — сказал он в объявлении, и он сообщил Reuters, что компания ожидает увеличить скорость «в четыре раза с текущего момента до конца 2027 года и в 20 раз больше пропускной способности».
Шон Лай, главный технический директор, связал аргумент о скорости с агентами, а не чат-ботами. Будучи в 30 раз быстрее, сказал он, «это дает агентной системе возможность для более чем на порядок больше рассуждений, проверки или использования инструментов», что является частью предложения, ориентированного на корпоративных покупателей, а не на таблицы с результатами.
Cerebras назвала OpenAI, G42, MBZUAI и AWS наряду с запуском, хотя не раскрыла никаких соглашений с клиентами CS-4 и цен.
Стойка Helios от AMD, представленная в июле, находится в списке партнеров, что соответствует компании, которая заявила, что будет работать со всеми в области ИИ-аппаратного обеспечения, кроме Nvidia.
Финансовая ситуация смешанная. Выручка за второй квартал составила 180,1 миллиона долларов, что на 74% больше по сравнению с прошлым годом, при этом выручка от облачных услуг почти вчетверо увеличилась, но она упала по сравнению с 193,4 миллиона долларов в первом квартале, и давление на маржу, о котором Cerebras сообщила в июне, не ослабло.
Квартал принес чистый убыток по GAAP в размере 450,5 миллиона долларов, скорректированный убыток в размере 6,9 миллиона долларов и 25,4 миллиарда долларов в оставшихся обязательствах по производительности. Cerebras прогнозирует выручку за полный год в размере от 880 до 890 миллионов долларов и 600 мегаватт мощности дата-центров, доступных и по контракту к концу 2027 года.
Концентрация остается структурным вопросом. G42 и Университет искусственного интеллекта имени Мохаммеда бин Заеда вместе составили около 86% выручки в 2025 году, а контракт с OpenAI, подписанный в январе, стоимостью более 10 миллиардов долларов на момент подписания, является ответом компании на это, наряду с добавлениями второго квартала, включая Cognition, Lovable, CrowdStrike, Block и Figma.
Первые отгрузки CS-4 должны состояться до конца квартала. Более сложное испытание наступит в 2027 году, когда следующее поколение должно будет появиться на новом кремнии, а не с более высокой тактовой частотой.
Другие статьи
Cerebras запускает CS-4, свою первую многослойную систему, хотя чип внутри не новый.
Cerebras’ CS-4 объединяет три кристалла в одном стойке и утверждает, что скорость в 30 раз выше, чем у GPU. Однако внутри находится процессор WSE-3 с более высокой тактовой частотой.
