text-generation-webui на VPS
text-generation-webui на VPS: UI для LLM-inference, character chat, exllama, GGUF.
Официальный сайт: https://github.com/oobabooga/text-generation-webui
Что такое text-generation-webui
oobabooga's text-generation-webui — швейцарский нож для LLM-inference. Chat UI, notebook, character AI, поддерживает GGUF, GPTQ, EXL2, AWQ форматы.
Ставим через клонирование repo + start_linux.sh installer. GPU (CUDA) для скорости, но CPU тоже работает. Модели скачиваются из HuggingFace.
Требования и совместимость
Установка text-generation-webui
Быстрый снапшот команд для установки на чистом VPS. У нас доступен готовый snapshot для клика в панели — эти команды выполняются автоматически.
git clone https://github.com/oobabooga/text-generation-webui
cd text-generation-webui
./start_linux.sh --listenВозможности text-generation-webui
Ключевые фичи и характеристики, которые получаете из нашего snapshot text-generation-webui на VPS.
- • GGUF, GPTQ, EXL2, AWQ форматы
- • Chat + notebook + character mode
- • OpenAI API extension
- • Character.AI-style роли
- • Обучение LoRA
Для каких задач подходит
- Character AI-style роли
- Development / prompt engineering
- Обучение LoRA на своих данных
Частые вопросы
- vs Ollama?
- Ollama — CLI-focused, простой. TGW — UI-focused, больше фич, поддержка большего числа форматов.
- EXL2 быстрее GGUF?
- На GPU — да, EXL2 (exllama2) быстрее в 2-3 раза. GGUF — универсал (CPU+GPU).
- LoRA обучение — как?
- Training tab в UI, готовые presets. GPU 24+ GB VRAM для 7B моделей.
Смотрите также
Ollama на VPS: локальный LLM-runner, Llama/Mistral/Qwen, REST API, CPU/GPU.
Open WebUI на VPS: ChatGPT-like UI для Ollama, RAG, multi-user, plugins.
KoboldCpp на VPS: LLM inference на llama.cpp, роль-play, story writing, GGUF.
Смотреть
Категория целиком.
Подобрать план.
Развернуть text-generation-webui за 60 секунд
Готовый снапшот с автобэкапом, TLS и systemd. От €3/мес.