В задаче вывода SWE-2 платформа показала почти пятикратный прирост пропускной способности токенов относительно системы GB200 NVL72. При обучении с подкреплением эффективность на один графический процессор выросла в 3,8 раза, что дает возможность ИИ-агенту Devin обрабатывать больше сессий параллельно. Особо показательны результаты в тесте DeepSeek-R1: новая архитектура обеспечивает в 10 раз больше токенов на каждый затраченный мегаватт энергии.
Технически решение состоит из 36 процессоров Vera и 72 GPU Rubin с жидкостным охлаждением. Модульный подход позволяет инженерам устанавливать лотки за пять минут вместо двух часов. Кроме того, CoreWeave позволяет арендовать процессоры Vera отдельно: в одной стойке можно развернуть до 128 чипов с 11 264 ядрами. Это ускоряет запуск агентских песочниц более чем в три раза по сравнению с традиционными x86-системами.

Комментарии (0)
Пока нет комментариев. Будьте первым!