Ich habe ein Forschungsprojekt abgeschlossen: MouthMind – ein Seq2Seq-Modell für visuelle Spracherkennung, das komplett ohne Pixel auskommt. Statt Bildern verwendet es Gesichts-Marker – reine Geometrie. Keine Hautfarbe, kein Licht, keine Kleidung. Nur Bewegung. Das Modell wurde ohne Teacher Forcing trainiert. Es muss Buchstaben selbstständig generieren – und zeigt dabei emergente Generalisierung: Es erkennt Wörter, die es nie gesehen hat. Die Ergebnisse sind…
Ein kleines Forschungs- und Experimentierprojekt, das größer wurde als gedacht Wie alles begann Es begann mit einer einfachen Frage: Wie bringt man KI-Neulingen bei, was eigentlich hinter den ganzen Schlagworten wie „Neuronales Netz“ oder „Machine Learning“ steckt? Die meisten Tutorials setzen entweder Programmierkenntnisse voraus, erfordern teure Cloud-Infrastruktur oder sind einfach zu abstrakt. Also habe ich mich…