diff --git a/deploy/fremdblick.sh b/deploy/fremdblick.sh index 345d675..c83f1c6 100644 --- a/deploy/fremdblick.sh +++ b/deploy/fremdblick.sh @@ -39,7 +39,11 @@ if [ "$MODE" = "code" ]; then SYS="${FREMDBLICK_SYS:-$CODE_SYS}" else MODEL="${FREMDBLICK_MODEL:-GLM-4.7-Flash}" - MAXTOK="${FREMDBLICK_MAXTOK:-2200}" + # 4000 (war 2200): GLM-4.7-Flash ist ein Reasoning-Modell und verbrennt real ~2000 Tokens + # im reasoning_content, BEVOR das Urteil in content landet (verifiziert 14.07.). Bei 2200 lief + # es Gefahr, mitten im Denken abzuschneiden → leeres content → "ABGESCHNITTEN/FEHLGESCHLAGEN" + # (traf die Nacht-Kritiker mit Default-Budget). Wer explizit knapper braucht, setzt FREMDBLICK_MAXTOK. + MAXTOK="${FREMDBLICK_MAXTOK:-4000}" SYS="${FREMDBLICK_SYS:-$PROSE_SYS}" fi