Ich hab's verkackt. SUBLI 1.1 ist trotzdem da — und richtig gut.
SUBLI transkribiert Schweizerdeutsch automatisch per KI — Audio oder Video hochladen, fertig sind Text und Untertitel, ganz ohne Mundart-Rätselraten.

Ich hab's fast verkackt. Mitten im Deploy hat mein eigenes Modell plötzlich angefangen, Schweizerdeutsch nicht mehr zu transkribieren, sondern einfach... ins Englische zu übersetzen. Live, für echte Requests, echte User. Gemerkt hab ich's erst, als ich die Ergebnisse selber gegengecheckt hab — sonst wäre das noch länger unbemerkt geblieben. Ziemlich abgef***e Nacht.
Der Bug war zum Glück kein Modell-Problem — mein Training war gut, sauber, gesund. Der Fehler steckte tiefer, in der Pipeline, die das Modell fürs Servieren vorbereitet: ein einzelnes fehlendes Detail hat dazu geführt, dass die KI beim Transkribieren still auf «Übersetzen» umgeschaltet hat, ohne dass ich das je angewiesen hätte. Sch**** Detail, riesiger Effekt. Ein paar Stunden Fehlersuche später: gefunden, gefixt, neu deployed, diesmal wirklich verifiziert.
Und das Ergebnis kann sich sehen lassen:
- Mein eigenes, auf Schweizerdeutsch fine-getuntes Modell schlägt jetzt das Standard-Modell messbar — 12.36% Fehlerquote statt 16.63%, direkt verglichen auf denselben 200 echten Testsätzen.
- Das ist keine homöopathische Verbesserung — die Fehlerquote ist um über ein Viertel gesunken.
- Weil das der erste komplett durchgezogene, sauber verifizierte Trainingslauf ist (nicht nur ein Versuch, der halb kaputt live ging), nenn ich das ab jetzt offiziell SUBLI Version 1.1.
Kein Marketing-Bullsh** — echte Zahlen, echt nachgemessen, echt live getestet. Der nächste Trainingslauf hat jetzt eine Referenz, die er schlagen muss.