Files
mission-control-v2/deploy/lobechat/README.md
T
Hitonabi 689bf3eed3 Feat: LobeChat-Deployment-Artefakte (Hermes-Chat-Frontend) für Proxmox
deploy/lobechat/: docker-compose.yml (client-only, lobehub/lobe-chat),
.env.example, README. Spricht den MC2-Gateway (:9001/v1) der AI-Box an,
fixierte Modell-Liste + vorkonfigurierter Hermes-Assistent. Läuft auf dem
Proxmox-MiniPC, nicht auf der AI-Box (hält die Box schlank). Ersetzt nesquena/
hermes-webui.

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
2026-06-26 19:31:10 +02:00

1.8 KiB

LobeChat — Hermes-Chat-Frontend (ersetzt nesquena/hermes-webui)

Läuft auf dem Proxmox-MiniPC (nicht auf der AI-Box). Schlanke client-only Edition: kein Postgres/Auth/S3, Verlauf liegt im Browser. Spricht über LAN den OpenAI-kompatiblen MC2-Gateway der AI-Box an (:9001/v1, liefert model:auto + alle llama-swap-Modelle).

Installation (auf dem Proxmox-Host bzw. einem LXC/VM mit Docker)

# In einem LXC/VM mit Docker + compose-Plugin:
mkdir -p ~/lobechat && cd ~/lobechat
# docker-compose.yml + .env.example aus diesem Ordner herkopieren
cp .env.example .env
nano .env                     # ACCESS_CODE setzen, AI_BOX_GATEWAY prüfen
docker compose up -d

Öffnen: http://<proxmox-ip>:3210 → Zugangscode = ACCESS_CODE.

Was ist vorkonfiguriert

  • Modell-Liste auf Hermes-4-14B, Qwen3.6-35B-A3B (fast), Qwen3-Coder-Next, Qwen3.5-122B-A10B (heavy) und auto fixiert (OPENAI_MODEL_LIST).
  • Hermes-Standardassistent (Modell Hermes-4-14B + System-Prompt) via DEFAULT_AGENT_CONFIG.

Endpoint-Wahl (in .env)

  • MC2-Gateway :9001/v1 (Default, empfohlen) — OpenAI-kompatibel, model:auto, Token-Tracking, alle Modelle.
  • llama-swap :8080/v1 — direkt, ohne Routing/Token-Tracking.
  • hermes-agent :8642/v1 — nur falls die Chat-UI den Agenten (Tools/MCP/Memory) nutzen soll; API-Kompatibilität vorher prüfen.

Cutover (alte hermes-webui ablösen)

Auf der AI-Box:

systemctl --user disable --now hermes-webui

In MC2 den „Hermes öffnen"-Link auf LobeChat zeigen lassen: HERMES_WEBUI_URL=http://<proxmox-ip>:3210 (env der mission-control-2.service).

Hinweis

Tool-/Function-Calls streamt llama.cpp nicht nativ — für reine Chat-Nutzung irrelevant. Bei Bedarf an persistenter History/RAG später auf die DB-Edition (Postgres+pgvector) umstellen.