Препринт — материал ещё не прошёл рецензирование
Модель предсказывает энергопотребление и задержку LLM на новых GPU
0
Кратко
Авторы представили WattGPU — модель, которая оценивает среднее энергопотребление графического процессора и задержку выдачи ответа у больших языковых моделей, используя только публичные характеристики модели и GPU. Её проверили на 42 открытых языковых моделях и 8 GPU NVIDIA; на незнакомых устройствах и моделях ошибки оставались невысокими.
Зачем это знать
Это может помочь заранее прикинуть, какая связка модели и GPU будет экономичнее, без долгого перебора на живом железе. Это ранние оценки, так что к цифрам стоит относиться как к предварительным.
Пересказано ИИ по научной статье. Как это устроено
Источник и детали
ЖурналarXiv (cs.LG)
Дата публикации у нас3 июля 2026 г.
Дата источника2 июля 2026 г.
ОригиналОткрыть
АвторыMauricio Fadel Argerich, Jonathan Fürst, Marta Patiño-Martínez