Запуск ИИ локально с меньшим нагревом GPU
Галера Морева
Как не сжечь видеокарту на локальных LLM: андервольтинг RTX 3090 за 5 минут (86°C → 70°C) Честно-честно короткий ролик про то, как беречь свою видеокарту. При монтаже предыдущего видео про запуск Qwen 3.8 я заметил страшную цифру — 86°C под нагрузкой. Для долгой работы это плохо, а мой сценарий использования как раз такой: включил агента и ушёл на пару часов. Сегодня решаем проблему без воды, без перепрошивок и почти без потери скорости — лимитами по питанию и частоте прямо в Linux. Что в ролике: 🔹 Почему 86°C на 3090 — это проблема, и что с этим делать 🔹 Два параметра, которыми можно управлять в Linux: лимит мощности и лимит частоты 🔹 Автоматический перебор всех адекватных комбинаций (скрипт + замеры на vLLM) — таблица результатов прилагается 🔹 Оптимальные значения: 300 Вт и 1500 МГц — температура 70°C, скорость стабильная 🔹 Нюанс: почему синтетические тесты врут, а реальная генерация кода проседает на ~20% 🔹 Systemd-сервис, который сам ставит лимиты при запуске и сбрасывает при выключении 🔹 Зачем мне водоблок и NVLink-мост на 3090 — и почему на воду переводить всё же есть смысл