NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·KI-FORSCHUNG

Gebärdensprache diktieren statt tippen – erstmals auf dem Handy

Google DeepMind hat SL2T vorgestellt: ein Modell, das Gebärdensprache direkt in Text übersetzt. Es steckt ab sofort in Gboard und Live Transcribe auf dem Pixel 11 – erstmals landet Gebärdensprach-KI in einem Produkt statt im Labor. Vorerst nur für ASL, die Schweizer Gebärdensprachen fehlen noch.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
14. AUGUST 2026
4 MIN. LESEZEIT
Illustration zweier gebärdender Hände vor einem Smartphone auf einem Ministativ, kinewsletter.ch Stil
Illustration zweier gebärdender Hände vor einem Smartphone auf einem Ministativ, kinewsletter.ch Stil
INHALT
01Nicht «Englisch mit den Händen»02100'000 Stunden aus 50 Gebärdensprachen03Die Kamera schickt nur Punkte04Entwickelt mit, nicht für05DSGS steht noch nicht auf der Liste
INHALT
01Nicht «Englisch mit den Händen»02100'000 Stunden aus 50 Gebärdensprachen03Die Kamera schickt nur Punkte04Entwickelt mit, nicht für05DSGS steht noch nicht auf der Liste
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Gebärdensprach-KI verlässt zum ersten Mal das Forschungslabor – trainiert auf 100'000 Stunden aus über 50 Gebärdensprachen, entwickelt gemeinsam mit Gehörlosenorganisationen. Für die Schweiz heisst das vorerst: zuschauen.

Google DeepMind hat am 12. August 2026 SL2T vorgestellt – ein massiv mehrsprachiges Modell, das Gebärdensprache direkt in Text übersetzt. Es steckt ab sofort in der Tastatur-App Gboard und in der App Live Transcribe auf dem Pixel 11, zunächst für Amerikanische Gebärdensprache (ASL) ins Englische und ohne Aufpreis. Damit verlässt Gebärdensprach-KI zum ersten Mal das Forschungslabor und landet in einem Produkt, das man im Laden kaufen kann.

Konkret heisst das: Wer gebärdet, kann das überall dort tun, wo sonst getippt wird – im Web suchen, Nachrichten schreiben, Gemini eine Aufgabe geben. In Live Transcribe lassen sich Antworten in einem Gespräch gebärden, statt sie zurückzutippen. Laut den Testpersonen von DeepMind ist Gebärden in ASL dabei schneller und natürlicher als Tippen in Englisch. Wenig überraschend: Für viele ist ASL die Erstsprache, Englisch die zweite.

Nicht «Englisch mit den Händen»

Gebärdensprachen sind eigenständige, natürliche Sprachen mit eigener Grammatik und eigenem Wortschatz – keine Handzeichen-Version einer Lautsprache. Genau dieses Missverständnis liess frühere Ansätze wie die viel beworbenen Gebärdensprach-Handschuhe scheitern: Sie lasen Handformen ab, wo es eine echte Übersetzung gebraucht hätte.

Dazu kommt ein zweites Problem. Bedeutung entsteht in Gebärdensprachen durch gleichzeitige Bewegungen von Händen, Armen, Oberkörper, Kopf und Gesicht. Das sauber und in hoher Bildrate zu erfassen, ist für die Bilderkennung eine anspruchsvolle und rechenintensive Aufgabe. SL2T muss beides leisten – sehen und übersetzen.

100'000 Stunden aus 50 Gebärdensprachen

Trainiert wurde das Modell laut Google DeepMind auf über 100'000 Stunden Gebärdendaten aus mehr als 50 Gebärdensprachen, rund ein Viertel davon in ASL. Der aufschlussreiche Befund: Gemeinsames Training über verschiedene Sprachen, Dialekte und Kompetenzstufen hinweg schlug in den Experimenten Modelle, die nur eine einzige Sprache lernen. Das Modell findet offenbar gemeinsame Strukturen, die alle Gebärdensprachen teilen.

Auf dem Benchmark FLEURS-ASL (sd-test), der die Übersetzungsqualität von ASL nach Englisch misst, erreicht SL2T 70 BLEURT – und zwar zero-shot, also ohne Feintuning auf die Testdaten. Das liegt gemäss Google deutlich über allen bisher veröffentlichten Werten. Fast interessanter als die Zahl ist die Kleinarbeit daneben: kurze Verzögerung beim laufenden Übersetzen, keine erfundenen Sätze, wenn jemand gerade gar nicht gebärdet, faire Erkennung für die rund 10 Prozent linkshändigen Gebärdenden – und einhändiges Gebärden, weil die andere Hand ja das Handy hält.

Die Kamera schickt nur Punkte

Bemerkenswert ist die Datenschutz-Architektur. SL2T bekommt gar kein Kamerabild zu sehen. Ein Modell auf dem Gerät selbst (MediaPipe Holistic) verfolgt Punkte am Körper der gebärdenden Person, und nur diese geometrischen Koordinaten gehen an den Server. Das Originalvideo wird sofort verworfen.

Aus dieser Punktfolge übersetzt SL2T direkt in Text – ohne den Umweg über sogenannte Glossen, also Zwischenannotationen, die in der bisherigen Forschung Standard waren. Glossen bilden räumliche Konstruktionen und Mimik nur unzureichend ab. Der Verzicht darauf hebt laut DeepMind künstliche Vokabulargrenzen auf und lässt die Qualität direkt mit der Datenmenge wachsen.

Entwickelt mit, nicht für

Die Idee zum Projekt stammt von Sam Sepah, einem gehörlosen Google-Mitarbeiter. Für den Einsatz in der Praxis hat Google das AI Sign Language Advisory Committee (AISLAC) gegründet, in dem Gehörlosenorganisationen aus verschiedenen Ländern und Fachleute sitzen. Zum Release von SL2T 1.0 hat das Gremium zusammen mit Google einen gemeinsamen Impact-Report verfasst, der Fähigkeiten und Grenzen offenlegt. Google nennt die Schwächen selbst: seltene Gebärden, schnelles Fingerbuchstabieren, Passivkonstruktionen und Zeitformen ohne Kontext gehen noch daneben.

DSGS steht noch nicht auf der Liste

Und die Schweiz? Hier gibt es drei Gebärdensprachen: die Deutschschweizerische Gebärdensprache (DSGS), die französische (LSF) und die italienische (LIS). Der Schweizerische Gehörlosenbund SGB-FSS beschreibt sie als eigenständige Sprachsysteme mit eigener Grammatik, die sich untereinander so stark unterscheiden wie die drei Landessprachen. Zwischen 20'000 und 30'000 gehörlose Menschen leben laut dem Verband in der Schweiz.

Für sie ändert sich vorerst nichts. SL2T startet mit ASL, weitere Sprachen und Geräte sollen folgen – einen Zeitplan nennt Google nicht. Weltweit gibt es über 200 Gebärdensprachen und rund 70 Millionen gehörlose und schwerhörige Menschen. ASL ist ein Anfang, mehr nicht.

Der Rückstand ist hierzulande ohnehin nicht nur technischer Natur: Rechtlich anerkannt sind die Gebärdensprachen bisher nur in den Kantonen Zürich, Genf, Tessin und Neuenburg, auf Bundesebene fehlt die Anerkennung, und der Gehörlosenbund fordert seit Jahren ein Gebärdensprachgesetz. Ein Diktier-Feature ersetzt das nicht. Aber es zeigt ziemlich genau, wie selbstverständlich Zugang aussehen kann, wenn man diese Sprachen als das behandelt, was sie sind: Sprachen.

Quellen

Putting sign language AI into users' hands – Google DeepMind (Primärquelle)↗ EXTERNER LINKAISLAC Joint Impact Report for SL2T 1.0 (PDF)↗ EXTERNER LINKDeepMind's newest model allows Pixel 11 devices to transcribe sign language into text – Engadget↗ EXTERNER LINKGoogle debuts SL2T, an AI model designed to understand sign language – SiliconANGLE↗ EXTERNER LINKGoogle DeepMind Brings Sign Language Translation to Phones With SL2T – Unite.AI↗ EXTERNER LINKFLEURS-ASL Benchmark-Datensatz (Kaggle)↗ EXTERNER LINKGehörlos sein – Schweizerischer Gehörlosenbund SGB-FSS↗ EXTERNER LINKAnerkennung der Gebärdensprache – SGB-FSS↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
Google
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Illustration zum Artikel «arXiv erlaubt dir nur noch zwei Paper pro Monat», kinewsletter.ch Stil
Handgezeichnete Illustration zum Artikel «arXiv erlaubt dir nur noch zwei Paper pro Monat», kinewsletter.ch Stil
KI-FORSCHUNG·3. OKTOBER 2026

arXiv erlaubt dir nur noch zwei Paper pro Monat

Die wichtigste Preprint-Plattform der Wissenschaft führt ein Einreichungslimit ein: zwei Paper pro Person und Monat. Grund ist die KI-getriebene Flut, die freiwillige Moderatoren überlastet.

Tuschskizze eines elektroblauen Proteinbands neben Lupe und DNA-Doppelhelix
Tuschskizze eines elektroblauen Proteinbands neben Lupe und DNA-Doppelhelix
KI-FORSCHUNG·2. OKTOBER 2026

DeepMind markiert KI-Proteine: 100 % Detektion, Funktion bleibt

Google DeepMind hat in Nature SynthID Bio vorgestellt, ein Wasserzeichen für KI-designte Proteine. Laut Paper erkennt es Sequenzen mit 100 % Trefferquote bei 0,1 % Fehlalarm, ohne die Funktion zu stören. Entfernbar ist es aber trotzdem.

Tuschskizze eines Schweissroboters in Elektroblau neben Stahlträger und Werkzeugtisch
Tuschskizze eines Schweissroboters in Elektroblau neben Stahlträger und Werkzeugtisch
KI-FORSCHUNG·2. OKTOBER 2026

Roboter können 74 % der körperlichen Aufgaben, rentabel sind 0.3 %

Anthropic hat gemessen, welche körperlichen Aufgaben Roboter heute übernehmen könnten: 74 %, das sind 34 % der Arbeitszeit. Kostengünstiger als Menschen sind sie aber nur bei 0.3 %. Bei heutigen Preistrends dauert es rund 40 Jahre bis 10 %.

Tuschskizze einer Wendeltreppe aus Zahnrädern und Platinen mit einem blau gefüllten Zahnrad im Zentrum
Tuschskizze einer Wendeltreppe aus Zahnrädern und Platinen mit einem blau gefüllten Zahnrad im Zentrum
KI-FORSCHUNG·29. SEPTEMBER 2026

22 KI-Forschende warnen vor einer «Intelligenzexplosion»

Geoffrey Hinton, Yoshua Bengio und OpenAI-Forschungschef Jakub Pachocki warnen in einem Papier vor einer Intelligenzexplosion. Automatisierte KI-Forschung könnte Jahre an Fortschritt in Monate pressen, die Politik brauche Einblick. Kritiker sehen auch Eigeninteresse der Labors.

Tusche-Skizze einer Küchenzeile: ein grosser elektroblauer Roboterarm greift nach einer Tasse, darunter eine offene Besteckschublade, dahinter Wasserkocher und Kartons.
Tusche-Skizze einer Küchenzeile: ein grosser elektroblauer Roboterarm greift nach einer Tasse, darunter eine offene Besteckschublade, dahinter Wasserkocher und Kartons. (Dark Mode)
KI-FORSCHUNG·28. SEPTEMBER 2026

Stanford steckt GPT-6 Astra direkt in einen Haushaltsroboter

Forschende aus Stanford und Caltech streichen bei ihrem Roboter die gelernte Steuerungsschicht und lassen ein Sprachmodell direkt die Bewegungsbefehle aussuchen. Was das taugt – und was die Demo verschweigt.

Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
KI-FORSCHUNG·27. SEPTEMBER 2026

GPT-6 Astra knackt Enigma-Funkspruch von 1941 – in zwei Tagen

OpenAIs GPT-6 Astra hat einen deutschen Heeres-Funkspruch vom 10. Juli 1941 entschlüsselt, der seit 2005 als ungelöst galt. Das Modell suchte sich das Ziel selbst aus und schrieb Enigma-Simulator und Enigma-Bombe eigenständig in Python und C++. Dieselbe Autonomie ist der Grund, weshalb OpenAI seine leistungsfähigsten Modelle gerade gestoppt hat.

Mehr aus KI-Forschung →