AI и LLM · AGPL-3.0

KoboldCpp на VPS

KoboldCpp на VPS: LLM inference на llama.cpp, роль-play, story writing, GGUF.

Официальный сайт: https://github.com/LostRuins/koboldcpp

vCPU от
4
рекомендуется
RAM от
8 GB
минимум
Диск от
40 GB
SSD/NVMe
План
VPS-L
оптимальный

Что такое KoboldCpp

KoboldCpp — форк llama.cpp с UI для creative writing (novels, roleplay). Легковесный (single binary), поддерживает GGUF, работает на CPU/GPU.

Ставим single-binary, скачиваем GGUF модель, запускаем. UI на 5001. Fаст inference через llama.cpp backend, отдельные фичи для character-mode.

Требования и совместимость

CPU
4 vCPU
рекомендуется
RAM
8 GB
минимум
Disk
40 GB
SSD/NVMe
License
AGPL-3.0
официально
Поддерживаемые ОС: Ubuntu 22.04

Установка KoboldCpp

Быстрый снапшот команд для установки на чистом VPS. У нас доступен готовый snapshot для клика в панели — эти команды выполняются автоматически.

wget https://github.com/LostRuins/koboldcpp/releases/latest/download/koboldcpp-linux-x64
chmod +x koboldcpp-linux-x64
./koboldcpp-linux-x64 --model llama-3-8b.gguf --host 0.0.0.0

Возможности KoboldCpp

Ключевые фичи и характеристики, которые получаете из нашего snapshot KoboldCpp на VPS.

  • llama.cpp backend
  • GGUF формат (широкая совместимость)
  • Story/adventure/chat modes
  • OpenAI-compatible API
  • GPU (CUDA, ROCm) + CPU

Для каких задач подходит

  • Creative writing / novels
  • Roleplay / character-driven chat
  • Замена SillyTavern backend

Частые вопросы

vs Ollama?
Ollama — general-purpose. KoboldCpp — creative writing / roleplay focus.
Character.AI-подобно?
Да, с SillyTavern-frontend + KoboldCpp-backend — полноценная замена character.ai.
SillyTavern — что это?
Web UI поверх LLM-backend (Kobold, Ollama, OpenAI) для character-роли. Часто в связке.

Развернуть KoboldCpp за 60 секунд

Готовый снапшот с автобэкапом, TLS и systemd. От €3/мес.