AI и LLM · AGPL-3.0

text-generation-webui на VPS

text-generation-webui на VPS: UI для LLM-inference, character chat, exllama, GGUF.

Официальный сайт: https://github.com/oobabooga/text-generation-webui

vCPU от
4
рекомендуется
RAM от
16 GB
минимум
Диск от
80 GB
SSD/NVMe
План
VPS-GPU
оптимальный

Что такое text-generation-webui

oobabooga's text-generation-webui — швейцарский нож для LLM-inference. Chat UI, notebook, character AI, поддерживает GGUF, GPTQ, EXL2, AWQ форматы.

Ставим через клонирование repo + start_linux.sh installer. GPU (CUDA) для скорости, но CPU тоже работает. Модели скачиваются из HuggingFace.

Требования и совместимость

CPU
4 vCPU
рекомендуется
RAM
16 GB
минимум
Disk
80 GB
SSD/NVMe
License
AGPL-3.0
официально
Поддерживаемые ОС: Ubuntu 22.04

Установка text-generation-webui

Быстрый снапшот команд для установки на чистом VPS. У нас доступен готовый snapshot для клика в панели — эти команды выполняются автоматически.

git clone https://github.com/oobabooga/text-generation-webui
cd text-generation-webui
./start_linux.sh --listen

Возможности text-generation-webui

Ключевые фичи и характеристики, которые получаете из нашего snapshot text-generation-webui на VPS.

  • GGUF, GPTQ, EXL2, AWQ форматы
  • Chat + notebook + character mode
  • OpenAI API extension
  • Character.AI-style роли
  • Обучение LoRA

Для каких задач подходит

  • Character AI-style роли
  • Development / prompt engineering
  • Обучение LoRA на своих данных

Частые вопросы

vs Ollama?
Ollama — CLI-focused, простой. TGW — UI-focused, больше фич, поддержка большего числа форматов.
EXL2 быстрее GGUF?
На GPU — да, EXL2 (exllama2) быстрее в 2-3 раза. GGUF — универсал (CPU+GPU).
LoRA обучение — как?
Training tab в UI, готовые presets. GPU 24+ GB VRAM для 7B моделей.

Развернуть text-generation-webui за 60 секунд

Готовый снапшот с автобэкапом, TLS и systemd. От €3/мес.