9c3dd9be82
Statt das Bild an die fast-MoE (schwaechere Vision) zu geben: das VL-Modell beschreibt den Screenshot, die Beschreibung geht als Text-Kontext an Hermes. -> bessere Bilderkennung UND Lucy behaelt ihr volles Hirn/Gedaechtnis. MC_VISION_MODEL (default 'vision') steuerbar. Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>