GLM 5.2 на AMD MI355X: вдвое дешевле Blackwell при 2626 ток/с на узел

· Искусственный интеллект
Компания Wafer сообщила о запуске модели GLM 5.2 на ускорителях AMD Instinct MI355X, показавшем производительность 2626 токенов в секунду на узел при более чем двукратном снижении стоимости по сравнению с решениями на базе Nvidia Blackwell. Новость собрала заметный отклик на Hacker News.

cover.svg

Компания Wafer опубликовала результаты запуска модели GLM 5.2 на ускорителях AMD Instinct MI355X. По заявленным данным, конфигурация достигла производительности 2626 токенов в секунду на один вычислительный узел.

Особый интерес вызывает экономический аспект: по утверждению авторов публикации, итоговая стоимость обработки при такой конфигурации более чем в два раза ниже по сравнению с решениями на графических процессорах Nvidia Blackwell.

Реакция сообщества

Материал опубликован в блоге компании Wafer и уже привлёк внимание технического сообщества — на Hacker News новость набрала 114 баллов и вызвала 30 комментариев к моменту публикации этой заметки.

Публикация вписывается в более широкую тенденцию последних месяцев: инференс больших языковых моделей всё активнее рассматривается как область, где ускорители AMD способны составить прямую конкуренцию решениям Nvidia не только по производительности, но и по совокупной стоимости владения.

Подробности методологии тестирования, конфигурации кластера и особенностей самой модели GLM 5.2 в кратком описании не раскрываются — читателям, интересующимся техническими деталями, стоит обратиться к первоисточнику.


Источник: Hacker News

Комментарии

Войдите, чтобы комментировать.

  • Пока нет комментариев.