Zum Inhalt springen

Howzer v2.5.4-DE: eine neue Modell-Generation, trainiert an dem Feedback, das Menschen wirklich schreiben

Echte Kundennachrichten sind unordentlich: wütende Großbuchstaben, höfliche Kündigungen, Lob, das in einer Beschwerde endet. Genau daran wurden drei Kernmodelle neu trainiert. Die Erkennung gemischten Feedbacks klettert von 40 auf 91 Prozent (an diesem Tag auf 400 Fällen gemessen, seither auf 1.078 gemischten Fällen neu erhoben), überschwängliches Lob wird nicht mehr als Krise bewertet, und ein kritischer Satz mitten in einer langen Nachricht geht nicht mehr unter.

Von Howzer Team, Produkt ·

Man kann ewig an den Schwellwerten rund um ein schwaches Modell drehen. Irgendwann muss man hingehen und das Modell reparieren.

Modellteam von Howzer

Eine Zeit lang hatten drei der Modelle, die jede eingehende Nachricht lesen, bekannte Schwachstellen, und das System hat sie mit zusätzlichen Regeln obendrauf ausgeglichen. Dieses Release nimmt den Ausgleich weg, indem es die Schwäche wegnimmt: Die drei Modelle wurden an echten Kundennachrichten gemessen, an dem nachtrainiert, was die Messung gezeigt hat, und die Behelfe wurden gelöscht.

Gemischte Gefühle, endlich gehört

Am schwersten zu lesen sind die Nachrichten, die zwei Dinge auf einmal tragen. Danke für die schnelle Hilfe, aber das ist dieses Jahr schon das dritte Mal. Das bisherige Modell neigte dazu, nur die höfliche Hälfte zu hören und die Nachricht als positiv abzulegen. Das nachtrainierte hört beides.

Gemischtes Feedback richtig erkannt
Bisheriges Modell40 %
Modell aus v2.5.491 %

Der größte einzelne Qualitätssprung in diesem Release. Wütende Nachrichten in Großbuchstaben und höflich formulierte Kündigungen fallen unter dieselbe Verbesserung. Gemessen am 24. Juli 2026 auf 400 Fällen; seither wurde dieselbe Erkennung auf 1.078 gemischten Fällen neu erhoben und liegt niedriger. Die Zahlen hier sind der Stand dieses Release-Tages, die aktuellen stehen auf der Messseite.

Lob ist keine Krise

Ein herzliches Dankeschön konnte bisher als kritischer Fall bewertet werden, und damit musste jemand hinschauen. Das neue Modell bewertet Lob von sich aus als Lob, ohne Nachhilfe durch zusätzliche Regeln, während echte Notlagen ihre Vorfahrt behalten: rechtliche Drohungen, angekündigte Kündigungen, alles, was die Sicherheit berührt.

Lange Nachrichten behalten ihre Dringlichkeit

Eine lange Nachricht hat bisher ihren eigenen wichtigsten Satz verdünnt. Wer drei Wochen Hin und Her schildert und im letzten Absatz ein sicherheitsrelevantes Detail erwähnt, konnte als Routine eingestuft werden. Das nachtrainierte Modell nimmt jedes Signal auf, das es sehen kann, und schlägt bei langen Nachrichten, in denen gar nichts Dringendes steht, weiterhin keinen falschen Alarm.

Kein Modell ändert sich hinter Ihrem Rücken

Jedes Modell ist inzwischen auf genau eine veröffentlichte Version festgelegt. Neu herausgegebene Modelle erreichen eine laufende Installation nur über einen bewussten, geprüften Umstieg. Ergebnisse können sich also nicht von einer Woche auf die andere unter Ihnen verschieben.

Antwortvorschläge, von vorne bis hinten geprüft

Der Antwortteil wurde in einem vollständigen Produktivlauf an echten Fällen durchgespielt: kein Zurückfallen auf Textbausteine, keine erfundenen Namen oder Tatsachen, und ein Vorschlag steht nach rund zweieinhalb Sekunden bereit. Installationen ohne Grafikkarte behalten den festgelegten Antwortweg, der ehrlich darüber bleibt, was er entwerfen kann und was nicht.

Nichts zu migrieren und nichts an Ihrer Anbindung zu ändern. Die neuen Modelle kommen über den gewohnten Weg herein.