fix: change sysadmin report LLM endpoint to 9001 and truncate event texts
Ampel / ampel (push) Failing after 22s
Ampel / ampel (push) Failing after 22s
This commit is contained in:
@@ -37,7 +37,10 @@ async def generate_and_send_report() -> bool:
|
||||
event_lines = []
|
||||
for e in events:
|
||||
ts_str = datetime.fromtimestamp(e["ts"]).strftime("%d.%m. %H:%M")
|
||||
event_lines.append(f"- [{ts_str}] {e.get('subject', '')}: {e.get('text', '')}")
|
||||
text = e.get('text', '')
|
||||
if len(text) > 100:
|
||||
text = text[:100] + "..."
|
||||
event_lines.append(f"- [{ts_str}] {e.get('subject', '')}: {text}")
|
||||
|
||||
events_str = "\n".join(event_lines) if event_lines else "Keine besonderen Vorkommnisse."
|
||||
|
||||
@@ -65,7 +68,8 @@ Rohe Systemdaten:
|
||||
{evidence}
|
||||
"""
|
||||
|
||||
endpoint = "http://127.0.0.1:8080/v1/chat/completions" # Direktes Engine-Fallback
|
||||
endpoint = "http://127.0.0.1:9001/v1/chat/completions" # Internes Gateway für model: auto
|
||||
|
||||
# Da das Gateway (Router) auf :9010 lauscht, können wir auch das nutzen,
|
||||
# aber Port 8080 (llama-swap engine) ist der direkteste Weg für den internen LLM-Call.
|
||||
model = "gpt-oss-120b" # Fallback, falls auto nicht geht, llama-swap routet das meist passend
|
||||
|
||||
Reference in New Issue
Block a user