Город МОСКОВСКИЙ
00:14:36

От локальной GPT к облачной: LLM в облаке с Nvidia H200

Аватар
ikryukovs
Просмотры:
14
Дата загрузки:
29.11.2025 19:24
Длительность:
00:14:36
Категория:
Обучение

Описание

Регистрируйся в облачной платформе immers.cloud по моей ссылке https://immers.cloud/signup/r/20251029-1739806-227/ и получи 20% бонусов при первом пополнении!

Реклама. ООО «ДТЛ». ИНН 9717073792. erid: 2W5zFJ8vFfN

🚀 Переносим LLM из локалки в облако: полный гайд по vLLM + OpenWebUI

В этом видео показываю, как развернуть собственную языковую модель в облаке. Разворачиваем GPT-oss-20B на облачном GPU H100 с помощью vLLM и создаем удобный веб-интерфейс через OpenWebUI.

⏱️ ТАЙМКОДЫ:
00:00 Введение: почему локальной LLM недостаточно
01:23 Архитектура облачного решения
01:48 Выбор облачного провайдера
02:49 Создание облачного сервера с GPU H100
04:00 Что такое vLLM и почему он быстрее
06:16 Подключение по SSH к серверу и настройка
09:02 Тестирование vLLM через API
09:42 Установка OpenWebUI
10:18 Первый запуск и регистрация
11:21 Обзор интерфейса OpenWebUI
13:01 Monitoring: проверка загрузки GPU
13:13 Итоги и возможности масштабирования
13:58 Бонус: публичный доступ для подписчиков

💬 ОБСУДИМ В КОММЕНТАРИЯХ:
1. Используете ли вы LLM в своих проектах?
2. Какие модели хотели бы развернуть в облаке?
3. Интересна ли тема RAG-модели на базе OpenWebUI?
4. Какие кейсы автоматизации хотите увидеть?

Рекомендуемые видео