Зарегистрироваться 8 (800) 350-01-20

Как развернуть DeepSeek на своем сервере

Александр
Автор:  Александр Опубликовано:  21 апреля, 2025
Как правильно оценить объем VRAM для запуска LLM Как правильно оценить объем VRAM для запуска LLM

Что именно определяет расход видеопамяти и почему подобрать GPU только по объему памяти для работы с LLM не всегда сработает. Разберем влияние длины контекста, KV-кэш, количество одновременно обрабатываемых запросов, batch size и другие параметры.

09 сентября, 2026
Как запустить локальную LLM с RAG системой на своем сервере Как запустить локальную LLM с RAG системой на своем сервере

Пошагово разбираем, как развернуть локальную RAG-систему на своем GPU-сервере, для примера будем использовать наши облачные GPU-серверы с NVIDIA L4 24GB. Для запуска моделей локально, будем использовать vLLM, для работы с базой знаний и запросами — Open WebUI.

27 августа, 2026
Выбираем видеокарту для ИИ до 24GB: обзор и сравнение NVIDIA L4 и T4 Выбираем видеокарту для ИИ до 24GB: обзор и сравнение NVIDIA L4 и T4

Сравниваем видеокарты для работы с нейросетями NVIDIA T4 16GB и её обновление в виде NVIDIA L4 24Gb. Детально про технические характеристики, проверим реальную производительность в задачах машинного обучения и разберемся, какая из них лучше справляется с инференсом больших языковых моделей и другими ML-задачами. Это поможет понять, стоит ли в 2026 году выбирать устаревшую T4 или лучше присмотреться к L4.

03 декабря, 2025
Продолжая использовать сайт, вы соглашаетесь с использованием файлов cookie, а также подтверждаете, что ознакомлены и принимаете условия Политики конфиденциальности.
Принимаю