Зарегистрироваться 8 (800) 350-01-20

Как запустить локальную LLM с RAG системой на своем сервере

Дмитрий
Автор:  Дмитрий Опубликовано:  27 августа, 2026
Как правильно оценить объем VRAM для запуска LLM Как правильно оценить объем VRAM для запуска LLM

Что именно определяет расход видеопамяти и почему подобрать GPU только по объему памяти для работы с LLM не всегда сработает. Разберем влияние длины контекста, KV-кэш, количество одновременно обрабатываемых запросов, batch size и другие параметры.

09 сентября, 2026
Июльский дайджест обновлений - добавили больше GPU и обновили 152-ФЗ Июльский дайджест обновлений - добавили больше GPU и обновили 152-ФЗ

Вот что у нас нового в июле: добавили еще больше видеокарт в облаке -  NVIDIA L40S и A16, завершили аттестацию всей платформы по 152-ФЗ, попали на карту ИТ-лидеров CNewsMarket и, конечно, продолжили публиковать статьи на Хабре и в нашем блоге. Заходите, чтобы узнать о процессорах EPYC Venice Zen6 и других новинках рынка. 

04 августа, 2026
Специальные цены на серверы с GPU NVIDIA L40S со скидкой до 25% Специальные цены на серверы с GPU NVIDIA L40S со скидкой до 25%

Специальные цены на облачные GPU серверы с видеокартой NVIDIA L40S 48Gb со скидкой до 25%.  NVIDIA L40S одна из самых мощных GPU с памятью 48GB для обучения и инференса нейросетей. 

24 июля, 2026
Продолжая использовать сайт, вы соглашаетесь с использованием файлов cookie, а также подтверждаете, что ознакомлены и принимаете условия Политики конфиденциальности.
Принимаю