Видео недоступно для предпросмотра
Смотреть в Telegram
Компания Cerebras Systems представила следующее поколение своей специализированной вычислительной платформы — сервер CS-4, ориентированный на обучение и инференс крупнейших моделей искусственного интеллекта. Ключевым технологическим прорывом новой системы стало двукратное увеличение пропускной способности памяти и межузловых соединений по сравнению с предыдущей итерацией, что направлено на ликвидацию критических задержек при передаче данных в распределенных нагрузках.
В основе платформы лежит обновленный монолитный процессор пластинного масштаба (Wafer-Scale Engine), объединяющий миллионы специализированных ядер и рекордный объем встроенной сверхбыстрой памяти прямо на кремниевой пластине. Благодаря удвоению пропускной способности интерконнекта и локальных интерфейсов передачи данных, сервер обеспечивает кратный прирост скорости генерации токенов и ускоряет фазу обратного распространения ошибки при обучении нейросетей, эффективно устраняя узкие места классической архитектуры фон Неймана.
CS-4 полностью интегрируется в фирменную масштабируемую архитектуру Cerebras, работая в связке с внешними модулями хранения весов и технологиями кластеризации. Это позволяет объединять сотни серверов в единую вычислительную фабрику петафлопсного уровня, готовую к обработке мультимодальных архитектур с триллионами параметров и сверхдлинными контекстными окнами без необходимости сложного ручного разделения моделей на тензорные параллели.
В основе платформы лежит обновленный монолитный процессор пластинного масштаба (Wafer-Scale Engine), объединяющий миллионы специализированных ядер и рекордный объем встроенной сверхбыстрой памяти прямо на кремниевой пластине. Благодаря удвоению пропускной способности интерконнекта и локальных интерфейсов передачи данных, сервер обеспечивает кратный прирост скорости генерации токенов и ускоряет фазу обратного распространения ошибки при обучении нейросетей, эффективно устраняя узкие места классической архитектуры фон Неймана.
CS-4 полностью интегрируется в фирменную масштабируемую архитектуру Cerebras, работая в связке с внешними модулями хранения весов и технологиями кластеризации. Это позволяет объединять сотни серверов в единую вычислительную фабрику петафлопсного уровня, готовую к обработке мультимодальных архитектур с триллионами параметров и сверхдлинными контекстными окнами без необходимости сложного ручного разделения моделей на тензорные параллели.