KoboldCpp на VPS
KoboldCpp на VPS: LLM inference на llama.cpp, роль-play, story writing, GGUF.
Официальный сайт: https://github.com/LostRuins/koboldcpp
Что такое KoboldCpp
KoboldCpp — форк llama.cpp с UI для creative writing (novels, roleplay). Легковесный (single binary), поддерживает GGUF, работает на CPU/GPU.
Ставим single-binary, скачиваем GGUF модель, запускаем. UI на 5001. Fаст inference через llama.cpp backend, отдельные фичи для character-mode.
Требования и совместимость
Установка KoboldCpp
Быстрый снапшот команд для установки на чистом VPS. У нас доступен готовый snapshot для клика в панели — эти команды выполняются автоматически.
wget https://github.com/LostRuins/koboldcpp/releases/latest/download/koboldcpp-linux-x64
chmod +x koboldcpp-linux-x64
./koboldcpp-linux-x64 --model llama-3-8b.gguf --host 0.0.0.0Возможности KoboldCpp
Ключевые фичи и характеристики, которые получаете из нашего snapshot KoboldCpp на VPS.
- • llama.cpp backend
- • GGUF формат (широкая совместимость)
- • Story/adventure/chat modes
- • OpenAI-compatible API
- • GPU (CUDA, ROCm) + CPU
Для каких задач подходит
- Creative writing / novels
- Roleplay / character-driven chat
- Замена SillyTavern backend
Частые вопросы
- vs Ollama?
- Ollama — general-purpose. KoboldCpp — creative writing / roleplay focus.
- Character.AI-подобно?
- Да, с SillyTavern-frontend + KoboldCpp-backend — полноценная замена character.ai.
- SillyTavern — что это?
- Web UI поверх LLM-backend (Kobold, Ollama, OpenAI) для character-роли. Часто в связке.
Смотрите также
text-generation-webui на VPS: UI для LLM-inference, character chat, exllama, GGUF.
Ollama на VPS: локальный LLM-runner, Llama/Mistral/Qwen, REST API, CPU/GPU.
LM Studio на VPS: desktop LLM app с server-mode, простой запуск моделей.
Смотреть
Категория целиком.
Подобрать план.
Развернуть KoboldCpp за 60 секунд
Готовый снапшот с автобэкапом, TLS и systemd. От €3/мес.