GLM 5.2 на AMD MI355X: вдвое дешевле Blackwell при 2626 ток/с на узел
Компания Wafer опубликовала результаты запуска модели GLM 5.2 на ускорителях AMD Instinct MI355X. По заявленным данным, конфигурация достигла производительности 2626 токенов в секунду на один вычислительный узел.
Особый интерес вызывает экономический аспект: по утверждению авторов публикации, итоговая стоимость обработки при такой конфигурации более чем в два раза ниже по сравнению с решениями на графических процессорах Nvidia Blackwell.
Реакция сообщества
Материал опубликован в блоге компании Wafer и уже привлёк внимание технического сообщества — на Hacker News новость набрала 114 баллов и вызвала 30 комментариев к моменту публикации этой заметки.
Публикация вписывается в более широкую тенденцию последних месяцев: инференс больших языковых моделей всё активнее рассматривается как область, где ускорители AMD способны составить прямую конкуренцию решениям Nvidia не только по производительности, но и по совокупной стоимости владения.
Подробности методологии тестирования, конфигурации кластера и особенностей самой модели GLM 5.2 в кратком описании не раскрываются — читателям, интересующимся техническими деталями, стоит обратиться к первоисточнику.
Источник: Hacker News
Комментарии
Войдите, чтобы комментировать.