feat(sprachen): Rippy fragt vor dem Rip, welche Sprachen du willst
Ampel / ampel (push) Successful in 29s

Commander-Anforderung: "Die Disc hat Material in X Sprachen und X Untertiteln -
Rippy muss VOR dem Rip fragen: Was genau willst du haben? In der Automatik muss
das ebenfalls einstellbar sein."

Die Auskunft lag laengst vor und wurde weggeworfen: Derselbe Titel-Scan, der die
Titel-Tabelle fuellt, liefert in derselben makemkvcon-Ausgabe die Streams mit.
Ein zweiter Info-Lauf haette eine Minute Wartezeit gekostet - jetzt kommt beides
aus einem Aufruf.

Format an der Akira-Blu-ray im Laufwerk gemessen (AGENTS Regel D):

  SINFO:<titel>,<stream>,<attribut>,<code>,"<wert>"
  1 = Typ ("Audio"/"Subtitles"), 3 = Sprachcode, 4 = Sprachname,
  6 = Codec, 14 = Kanaele, 30 = Beschreibung

DIE FALLE dabei: Die Sprache steht in 3/4, NICHT in 28/29. Die tragen auf JEDEM
Stream "eng"/"English" - auch auf einer deutschen Tonspur und auf dem
Videostream; das ist MakeMKVs eigene Anzeigesprache. Wer 28 nimmt, haelt jede
Disc fuer englisch. Ein Test haelt das fest.

Angewendet wird die Wahl bei der KOMPRESSION, nicht beim Rippen - drei Gruende:
der Rip bleibt vollstaendig und verlustfrei (Muss-Feature laut KONZEPT); HandBrake
hat dafuer dokumentierte Schalter (--audio-lang-list / --subtitle-lang-list, die
genau die ISO-639-2-Codes nehmen, die MakeMKV liefert - beides gegengeprueft);
und wer spaeter andere Sprachen will, komprimiert neu statt die Disc wieder
einzulegen. Genau das sagt der Dialog auch, sonst glaubt man, es werde
unvollstaendig gerippt.

Nichts angeklickt heisst "alles behalten" - das Verhalten von vorher. Auch die
Einstellung ist bewusst LEER vorbelegt: Ein stilles "deu" wuerde bei einem
japanischen Original die Originaltonspur wegwerfen, ohne dass jemand gefragt hat.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
This commit is contained in:
Hitonabi
2026-07-26 15:10:21 +02:00
parent 58f4991d92
commit 148ac494c2
7 changed files with 522 additions and 13 deletions
+162 -9
View File
@@ -209,13 +209,118 @@ def parse_titel_info(ausgabe: str) -> list:
return [titel[nr] for nr in sorted(titel)]
def lies_titel_info(device_path: str, timeout: int = 300) -> list:
"""Volle Titel-Liste der eingelegten Disc (makemkvcon info, Robot-Mode)."""
# Attribut-IDs der SINFO-Zeilen. Am 26.07.2026 an der Akira-Blu-ray im Laufwerk
# der Rippy-VM abgenommen (AGENTS Regel D):
#
# SINFO:0,1,1,6202,"Audio"
# SINFO:0,1,3,0,"deu"
# SINFO:0,1,4,0,"German"
# SINFO:0,1,6,0,"DTS-HD MA"
# SINFO:0,1,14,0,"2"
# SINFO:0,1,30,0,"DTS-HD MA Stereo German"
#
# ⚠️ Die Sprache steht in 3/4 — NICHT in 28/29. Die tragen auf JEDEM Stream
# „eng"/„English", auch auf dem Videostream einer deutschen Tonspur; das ist
# MakeMKVs eigene Anzeigesprache und nicht die des Tracks. Wer 28 nimmt, hält
# jede Disc für englisch.
SINFO_TYP = 1
SINFO_SPRACHE_CODE = 3
SINFO_SPRACHE_NAME = 4
SINFO_CODEC = 6
SINFO_KANAELE = 14
SINFO_BESCHREIBUNG = 30
SINFO_ZEILE = re.compile(r'SINFO:(\d+),(\d+),(\d+),\d+,"(.*)"\s*$')
def parse_stream_info(ausgabe: str) -> dict:
"""SINFO-Zeilen → Tonspuren und Untertitel je Titel (pure Funktion).
Commander-Anforderung 26.07.2026: *„Es muss verfügbar sein, dass man die
Sprache von Medien auswählen kann … Rippy muss VOR dem Rip fragen: Was genau
willst du haben?"* Die Auskunft liegt längst vor — der Titel-Scan liest sie
mit und hat sie bisher weggeworfen.
Rückgabe: {titel_nr: {"audio": [...], "untertitel": [...]}}, jeder Eintrag
{"nr", "lang", "sprache", "codec", "kanaele", "beschreibung"}.
"""
titel: dict = {}
for zeile in (ausgabe or "").splitlines():
treffer = SINFO_ZEILE.match(zeile.strip())
if not treffer:
continue
t_nr, s_nr, attr = (int(treffer.group(i)) for i in (1, 2, 3))
wert = treffer.group(4)
streams = titel.setdefault(t_nr, {})
eintrag = streams.setdefault(s_nr, {"nr": s_nr, "typ": "", "lang": "",
"sprache": "", "codec": "",
"kanaele": "", "beschreibung": ""})
if attr == SINFO_TYP:
eintrag["typ"] = wert
elif attr == SINFO_SPRACHE_CODE:
eintrag["lang"] = wert
elif attr == SINFO_SPRACHE_NAME:
eintrag["sprache"] = wert
elif attr == SINFO_CODEC:
eintrag["codec"] = wert
elif attr == SINFO_KANAELE:
eintrag["kanaele"] = wert
elif attr == SINFO_BESCHREIBUNG:
eintrag["beschreibung"] = wert
ergebnis = {}
for t_nr, streams in titel.items():
audio, untertitel = [], []
for s_nr in sorted(streams):
s = streams[s_nr]
# MakeMKV schreibt „Subtitles" (englisch, Plural) — gemessen.
if s["typ"] == "Audio":
audio.append(s)
elif s["typ"].startswith("Subtitle"):
untertitel.append(s)
ergebnis[t_nr] = {"audio": audio, "untertitel": untertitel}
return ergebnis
def sprachen_zusammenfassen(streams_je_titel: dict) -> dict:
"""Welche Sprachen hat die DISC insgesamt? (pure Funktion)
Für die Frage vor dem Rip zählt nicht Titel 3 Stream 7, sondern: „Diese Disc
hat Ton auf Deutsch, Englisch und Japanisch, Untertitel auf Deutsch und
Englisch." Deshalb über alle Titel vereinigt, Reihenfolge stabil (so wie sie
auf der Disc stehen).
Rückgabe: {"audio": [{"lang","sprache","spuren"}], "untertitel": [...]}
"""
def sammeln(schluessel):
gefunden = {}
for streams in (streams_je_titel or {}).values():
for s in streams.get(schluessel) or []:
code = s.get("lang") or ""
if not code:
continue
eintrag = gefunden.setdefault(
code, {"lang": code, "sprache": s.get("sprache") or code,
"spuren": 0})
eintrag["spuren"] += 1
return list(gefunden.values())
return {"audio": sammeln("audio"), "untertitel": sammeln("untertitel")}
def lies_titel_info(device_path: str, timeout: int = 300) -> tuple:
"""(Titel-Liste, Streams je Titel) der eingelegten Disc — EIN Info-Lauf.
Beides aus demselben Aufruf: Ein `makemkvcon info` dauert je Disc 20120 s,
und die Sprach-Auskunft steht in derselben Ausgabe. Sie zweimal zu holen
wäre eine Minute Wartezeit für nichts.
"""
ergebnis = subprocess.run(
["makemkvcon", "-r", "--noscan", "info", f"dev:{device_path}"],
capture_output=True, text=True, timeout=timeout,
)
return parse_titel_info(ergebnis.stdout or "")
ausgabe = ergebnis.stdout or ""
return parse_titel_info(ausgabe), parse_stream_info(ausgabe)
def rip_titel_auswahl(device_path: str, output_dir: str, titel_liste: list,
@@ -393,22 +498,49 @@ def preset_fuer(disc_type: str, einstellungen: dict) -> str:
return (einstellungen.get("transcodePreset") or "").strip() or DEFAULT_HB_PRESET
def build_handbrake_cmd(input_path: str, output_path: str, preset: str = DEFAULT_HB_PRESET) -> list:
def build_handbrake_cmd(input_path: str, output_path: str,
preset: str = DEFAULT_HB_PRESET,
audio_sprachen=None, untertitel_sprachen=None) -> list:
"""Baut das HandBrake-Kommando für die Kompressions-Stufe (pure Funktion).
Arbeitet auf der MKV-DATEI aus dem MakeMKV-Rip — nie auf dem Laufwerk:
HandBrake kann AACS-verschlüsselte Blu-rays nicht lesen, MakeMKV bleibt
deshalb zwingend die erste Stufe. --all-audio/--all-subtitles behalten
alle Sprachen (Preset-Default wäre nur die erste Tonspur).
## Die Sprachauswahl greift HIER, nicht beim Rippen
Commander-Anforderung 26.07.2026. Bewusst in der KOMPRESSION und nicht im
Rip, aus drei Gründen:
1. Der Rip bleibt vollständig und verlustfrei — das ist ein Muss-Feature
(KONZEPT). Wer später eine andere Sprachwahl will, komprimiert neu, statt
die Disc wieder einzulegen.
2. MakeMKV kann Tracks nur über eine Auswahl-Profildatei filtern; HandBrake
hat dafür dokumentierte Schalter, die genau die Codes nehmen, die MakeMKV
liefert (ISO 639-2, „deu"/„eng" — beides am 26.07.2026 gegengeprüft).
3. Wird ein Disc-Typ NICHT komprimiert (4K verlustfrei), bleiben ohnehin alle
Sprachen drin — und das ist bei einer verlustfreien Ablage richtig.
`--audio-lang-list` zusammen mit `--all-audio` heißt laut HandBrake-Hilfe:
alle Tonspuren, die zu einer der Sprachen passen. Leere Liste = alles, wie
bisher.
"""
return [
befehl = [
"HandBrakeCLI",
"--input", input_path,
"--output", output_path,
"--preset", preset,
"--all-audio",
"--all-subtitles",
]
audio = [s for s in (audio_sprachen or []) if s]
if audio:
befehl += ["--audio-lang-list", ",".join(audio)]
befehl.append("--all-audio")
untertitel = [s for s in (untertitel_sprachen or []) if s]
if untertitel:
befehl += ["--subtitle-lang-list", ",".join(untertitel)]
befehl.append("--all-subtitles")
return befehl
HB_ENCODE_RE = re.compile(
@@ -449,8 +581,28 @@ def get_progress_from_line(line: str) -> int:
return int(((aktuell - 1) * 100 + prozent) / gesamt)
def sprachliste(wert) -> list:
"""„deu, eng , ,DEU" → ["deu", "eng"] (pure Funktion).
Nimmt Komma-Text aus den Einstellungen oder eine fertige Liste. Doppelte und
Leeres fliegen raus, Kleinschreibung wird erzwungen — HandBrake will
ISO-639-2 in Kleinbuchstaben, und ein „DEU" aus einem Eingabefeld soll nicht
still die ganze Auswahl unwirksam machen.
"""
if not wert:
return []
teile = wert.split(",") if isinstance(wert, str) else list(wert)
sauber = []
for t in teile:
code = str(t).strip().lower()
if code and code not in sauber:
sauber.append(code)
return sauber
def run_handbrake(input_path: str, output_path: str, preset: str = DEFAULT_HB_PRESET,
progress_cb=None, abbruch_cb=None) -> dict:
progress_cb=None, abbruch_cb=None,
audio_sprachen=None, untertitel_sprachen=None) -> dict:
"""Komprimiert eine MKV-Datei mit HandBrakeCLI; meldet Fortschritt.
`abbruch_cb` wird bei JEDER Ausgabezeile aufgerufen und soll RipAbbruch
@@ -467,7 +619,8 @@ def run_handbrake(input_path: str, output_path: str, preset: str = DEFAULT_HB_PR
try:
process = subprocess.Popen(
build_handbrake_cmd(input_path, output_path, preset),
build_handbrake_cmd(input_path, output_path, preset,
audio_sprachen, untertitel_sprachen),
stdout=subprocess.PIPE,
stderr=subprocess.STDOUT,
text=True,
+34 -4
View File
@@ -47,6 +47,8 @@ from ripping import (
rip_cd,
rip_video,
run_handbrake,
sprachen_zusammenfassen,
sprachliste,
wirf_disc_aus,
)
@@ -690,9 +692,20 @@ def scan_tracks(device_path: str):
key = f"tracks:{device_path}"
db.save_settings({"status": "running"}, key)
try:
titel = lies_titel_info(device_path)
db.save_settings({"status": "done", "tracks": titel}, key)
db.add_log("info", "worker", f"Titel-Scan {device_path}: {len(titel)} Titel gefunden")
# Ein Info-Lauf liefert BEIDES: Titel-Liste und die Sprachen. Die
# Sprach-Auskunft stand schon immer in derselben Ausgabe und wurde nur
# weggeworfen (Commander-Anforderung 26.07.2026: vor dem Rip fragen,
# was man haben will).
titel, streams = lies_titel_info(device_path)
sprachen = sprachen_zusammenfassen(streams)
db.save_settings(
{"status": "done", "tracks": titel, "sprachen": sprachen}, key)
db.add_log(
"info", "worker",
f"Titel-Scan {device_path}: {len(titel)} Titel, "
f"{len(sprachen['audio'])} Tonsprache(n), "
f"{len(sprachen['untertitel'])} Untertitelsprache(n)",
)
return {"status": "done", "anzahl": len(titel)}
except Exception as e:
db.save_settings({"status": "error", "error": str(e)[:300]}, key)
@@ -817,12 +830,27 @@ def transcode_files(self, job_id: str, raw_dir: str, final_dir: str):
preset = preset_fuer(disc_type, einstellungen)
original_behalten = einstellungen.get("keepOriginal", False)
# Sprachauswahl: Wahl für DIESEN Rip (aus meta) schlägt die Einstellung.
# Leer heißt „alles behalten" — genau das Verhalten von vorher.
try:
job_meta = json.loads(job.get("meta") or "{}")
except ValueError:
job_meta = {}
audio_sprachen = sprachliste(
job_meta.get("audio_sprachen") or einstellungen.get("audioSprachen"))
untertitel_sprachen = sprachliste(
job_meta.get("untertitel_sprachen") or einstellungen.get("untertitelSprachen"))
os.makedirs(final_dir, exist_ok=True)
db.update_job(job_id, status="transcoding", progress=0, error=None)
db.add_log(
"info", "worker",
f"Job {job_id}: Kompression gestartet ({len(quellen)} Datei(en), "
f"Disc-Typ '{disc_type or 'unbekannt'}', Preset '{preset}')",
f"Disc-Typ '{disc_type or 'unbekannt'}', Preset '{preset}'"
+ (f", Ton: {','.join(audio_sprachen)}" if audio_sprachen else ", Ton: alle")
+ (f", Untertitel: {','.join(untertitel_sprachen)}"
if untertitel_sprachen else ", Untertitel: alle")
+ ")",
)
anzahl = len(quellen)
@@ -865,6 +893,8 @@ def transcode_files(self, job_id: str, raw_dir: str, final_dir: str):
quelle, ziel, preset=preset,
progress_cb=datei_fortschritt,
abbruch_cb=abbruch_pruefen,
audio_sprachen=audio_sprachen,
untertitel_sprachen=untertitel_sprachen,
)
if hb.get("status") == "cancelled":
_job_abschliessen(job_id, hb)
+128
View File
@@ -464,3 +464,131 @@ def test_auswurf_ohne_laufwerk_wirft_nicht():
assert ripping.wirf_disc_aus(
"/dev/sr9", ioctl_fn=lambda *a: 0, oeffnen=oeffnen_kaputt,
schliessen=lambda fd: None, warten=lambda s: None) is False
# --- Sprachen der Disc: gemessen an der Akira-Blu-ray (26.07.2026) -----------
#
# Woertlich aus `makemkvcon -r --noscan info dev:/dev/sr0` im Worker-Container
# der Rippy-VM, gekuerzt auf die Attribute, die Rippy liest (AGENTS Regel D).
SINFO_ECHT = """SINFO:0,0,1,6201,"Video"
SINFO:0,0,19,0,"1920x1080"
SINFO:0,0,28,0,"eng"
SINFO:0,0,29,0,"English"
SINFO:0,1,1,6202,"Audio"
SINFO:0,1,3,0,"deu"
SINFO:0,1,4,0,"German"
SINFO:0,1,6,0,"DTS-HD MA"
SINFO:0,1,14,0,"2"
SINFO:0,1,28,0,"eng"
SINFO:0,1,29,0,"English"
SINFO:0,1,30,0,"DTS-HD MA Stereo German"
SINFO:0,2,1,6202,"Audio"
SINFO:0,2,3,0,"jpn"
SINFO:0,2,4,0,"Japanese"
SINFO:0,2,6,0,"DTS-HD MA"
SINFO:0,2,14,0,"6"
SINFO:0,2,30,0,"DTS-HD MA 5.1 Japanese"
SINFO:0,3,1,6203,"Subtitles"
SINFO:0,3,3,0,"deu"
SINFO:0,3,4,0,"German"
SINFO:0,3,6,0,"PGS"
SINFO:1,0,1,6202,"Audio"
SINFO:1,0,3,0,"eng"
SINFO:1,0,4,0,"English"
SINFO:1,0,6,0,"AC3"
"""
def test_streams_werden_nach_typ_getrennt():
from ripping import parse_stream_info
je_titel = parse_stream_info(SINFO_ECHT)
assert set(je_titel) == {0, 1}
assert [a["lang"] for a in je_titel[0]["audio"]] == ["deu", "jpn"]
assert [u["lang"] for u in je_titel[0]["untertitel"]] == ["deu"]
assert je_titel[0]["audio"][1]["kanaele"] == "6"
assert je_titel[0]["audio"][0]["codec"] == "DTS-HD MA"
def test_die_sprache_steht_in_attribut_3_nicht_28():
"""DIE Falle: 28/29 tragen auf JEDEM Stream "eng"/"English" - auch auf einer
deutschen Tonspur und auf dem Videostream. Das ist MakeMKVs Anzeigesprache.
Wer 28 nimmt, haelt jede Disc fuer englisch."""
from ripping import parse_stream_info
deutsche_spur = parse_stream_info(SINFO_ECHT)[0]["audio"][0]
assert deutsche_spur["lang"] == "deu"
assert deutsche_spur["sprache"] == "German"
def test_video_taucht_nicht_als_tonspur_auf():
from ripping import parse_stream_info
je_titel = parse_stream_info(SINFO_ECHT)
assert all(a["typ"] == "Audio" for a in je_titel[0]["audio"])
def test_sprachen_werden_ueber_alle_titel_vereinigt():
"""Vor dem Rip zaehlt nicht "Titel 3 Stream 7", sondern was die DISC hat."""
from ripping import parse_stream_info, sprachen_zusammenfassen
s = sprachen_zusammenfassen(parse_stream_info(SINFO_ECHT))
assert [a["lang"] for a in s["audio"]] == ["deu", "jpn", "eng"]
assert [a["sprache"] for a in s["audio"]] == ["German", "Japanese", "English"]
assert [u["lang"] for u in s["untertitel"]] == ["deu"]
# deu kommt in Titel 0 einmal vor
assert s["audio"][0]["spuren"] == 1
def test_leere_ausgabe_gibt_leere_sprachen():
from ripping import parse_stream_info, sprachen_zusammenfassen
assert parse_stream_info("") == {}
assert sprachen_zusammenfassen({}) == {"audio": [], "untertitel": []}
assert sprachen_zusammenfassen(None) == {"audio": [], "untertitel": []}
# --- Sprachliste aus den Einstellungen --------------------------------------
def test_sprachliste_raeumt_auf():
from ripping import sprachliste
assert sprachliste("deu, eng , ,DEU") == ["deu", "eng"]
assert sprachliste(["deu", "deu", "jpn"]) == ["deu", "jpn"]
assert sprachliste("") == []
assert sprachliste(None) == []
def test_grossschreibung_macht_die_auswahl_nicht_unwirksam():
"""HandBrake will ISO-639-2 klein. Ein "DEU" aus einem Eingabefeld darf nicht
still die ganze Auswahl aushebeln."""
from ripping import sprachliste
assert sprachliste("DEU,ENG") == ["deu", "eng"]
# --- Das HandBrake-Kommando -------------------------------------------------
def test_handbrake_kommando_ohne_auswahl_bleibt_wie_bisher():
from ripping import build_handbrake_cmd
cmd = build_handbrake_cmd("/a.mkv", "/b.mkv", "H.265 MKV 1080p30")
assert "--audio-lang-list" not in cmd
assert "--subtitle-lang-list" not in cmd
assert "--all-audio" in cmd and "--all-subtitles" in cmd
def test_handbrake_kommando_mit_sprachauswahl():
"""--audio-lang-list zusammen mit --all-audio heisst laut HandBrake-Hilfe:
alle Tonspuren, die zu einer der Sprachen passen."""
from ripping import build_handbrake_cmd
cmd = build_handbrake_cmd("/a.mkv", "/b.mkv", "H.265 MKV 1080p30",
audio_sprachen=["deu", "jpn"],
untertitel_sprachen=["deu"])
assert cmd[cmd.index("--audio-lang-list") + 1] == "deu,jpn"
assert cmd[cmd.index("--subtitle-lang-list") + 1] == "deu"
assert "--all-audio" in cmd and "--all-subtitles" in cmd