NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

OpenAIs neue Sprachmodelle antworten schneller – und eines wird günstiger

OpenAI hat zwei neue Realtime-Sprachmodelle veröffentlicht: gpt-realtime-2.1 und die günstigere Mini-Variante. Beide reagieren dank besserem Caching mindestens 25 Prozent schneller – die Technik hinter Sprachassistenten und Telefon-Bots wird flüssiger und billiger.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
7. JULI 2026
2 MIN. LESEZEIT
Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent
Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent (Dark Mode)
INHALT
01Ein Viertel weniger Wartezeit02Das grosse Modell hört genauer zu03Die Sparvariante für den Massenbetrieb04So kommst du dran
INHALT
01Ein Viertel weniger Wartezeit02Das grosse Modell hört genauer zu03Die Sparvariante für den Massenbetrieb04So kommst du dran
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

OpenAIs neue Realtime-Modelle senken die Antwortzeit von Sprach-KI um mindestens ein Viertel – und die Mini-Variante kostet nur rund ein Drittel des grossen Modells.

OpenAI hat zwei neue Sprachmodelle für seine Realtime-API veröffentlicht: gpt-realtime-2.1 und gpt-realtime-2.1-mini. Beide sind dafür gemacht, dass Anwendungen in Echtzeit zuhören und antworten – also die Technik hinter Sprachassistenten, Telefon-Bots und Voice-Agenten.

Ein Viertel weniger Wartezeit

Der wichtigste Fortschritt ist Tempo. Laut OpenAI sinkt die sogenannte p95-Latenz – die Wartezeit, die 95 Prozent der Anfragen nicht überschreiten – über alle Realtime-Sprachmodelle hinweg um mindestens 25 Prozent. Möglich macht das ein verbessertes Caching, bei dem wiederkehrende Teile einer Anfrage zwischengespeichert statt jedes Mal neu berechnet werden. Für dich als Nutzer heisst das: Ein Sprach-Bot, der auf dieser Technik läuft, reagiert flüssiger und stockt seltener.

Das grosse Modell hört genauer zu

gpt-realtime-2.1 baut auf dem Vorgänger GPT-Realtime-2 auf und verbessert vor allem drei Dinge: Es erkennt Buchstaben- und Zahlenfolgen zuverlässiger – etwa wenn du eine Kundennummer oder ein Autokennzeichen diktierst –, geht besser mit Sprechpausen und Hintergrundgeräuschen um und lässt sich sauberer unterbrechen. Dazu kommt ein einstellbarer «Reasoning-Aufwand», also wie viel das Modell nachdenkt, bevor es antwortet, plus die Fähigkeit, externe Werkzeuge für komplexere Abläufe zu nutzen.

Die Sparvariante für den Massenbetrieb

Daneben steht gpt-realtime-2.1-mini: ein kleineres, schnelleres Modell für alle, die vor allem auf die Kosten achten. Der Preisunterschied ist deutlich. Während die grosse Version pro einer Million Audio-Token 32 Dollar für Eingaben und 64 Dollar für Ausgaben kostet, sind es bei der Mini-Variante nur 10 respektive 20 Dollar – also rund ein Drittel. Wer einen Voice-Agenten für viele gleichzeitige Gespräche baut, kann mit dem Mini-Modell kräftig sparen und die grosse Version für die kniffligen Fälle reservieren.

So kommst du dran

Beide Modelle sind ab sofort über die Realtime-API und den Playground von OpenAI verfügbar. Wer bereits eine Sprachanwendung auf GPT-Realtime-2 betreibt, kann in vielen Fällen einfach den Modellnamen austauschen – und profitiert sofort von der kürzeren Wartezeit.

Quellen

OpenAI Developer Community – New Realtime models: gpt-realtime-2.1 and gpt-realtime-2.1-mini↗ EXTERNER LINKMarkTechPost – OpenAI Releases GPT-Realtime-2.1 and GPT-Realtime-2.1-mini for Low-Latency Voice Agents↗ EXTERNER LINKOpenAI Developers – gpt-realtime-2.1 model documentation↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAI
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
NEUE MODELLE·6. OKTOBER 2026

Reflection AI zeigt Beam, offenes Modell gegen China

Das US-Start-up Reflection AI stellt Beam vor, ein Modell mit offenen Gewichten und 501 Milliarden Parametern. Es soll chinesischen Modellen mit deutlich weniger Rechenaufwand Konkurrenz machen. Alle Zahlen sind Herstellerangaben, die Gewichte folgen im Oktober.

Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt; die Maske ist leuchtend blau.
Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt
NEUE MODELLE·3. OKTOBER 2026

Tavus: Fast jeder Zweite hält KI-Avatar Griffin für echt

Das US-Startup Tavus meldet, dass 48 Prozent der Testpersonen seinen KI-Videoavatar Griffin nach einer Minute für einen Menschen hielten. Die Zahl stammt vom Hersteller, die Stichprobe war mit 54 Personen klein. Für die Schweiz ist sie trotzdem ein Warnsignal, weil Betrüger Video-Fälschungen bisher selten, Stimmklone dafür umso öfter einsetzen.

Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
NEUE MODELLE·1. OKTOBER 2026

Gemini 4 Argon: Google startet bei den Cyber-Verteidigern

Google stellt Gemini 4 Argon vor, zunächst nur für ausgewählte Cybersecurity-Organisationen im Fairwind-Programm. Laut Google findet und patcht das Modell kritische Schwachstellen selbstständig. Wir ordnen Zahlen, Bloomberg-Zweifel und den Schweiz-Bezug ein.

Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
NEUE MODELLE·30. SEPTEMBER 2026

GPT-6.1 Sol: fast Astra-Niveau zu einem Fünftel des Preises

OpenAI hat am DevDay GPT-6.1 Sol vorgestellt: laut Hersteller fast auf Astra-Niveau, aber für 2 statt 10 Dollar pro Million Eingabe-Tokens. Die Fehlerrate sinkt gegenüber GPT-6 Sol von 11,4 auf 7,7 Prozent. Verfügbar in ChatGPT Work, Codex und API, nicht im normalen Chat.

Handgezeichnete Skizze einer grossen blauen Stoppuhr neben einem Münzstapel und Zahnrädern, dahinter Tempo-Linien
Handgezeichnete Skizze einer grossen blauen Stoppuhr neben einem Münzstapel und Zahnrädern, dahinter Tempo-Linien
NEUE MODELLE·29. SEPTEMBER 2026

Sonnet 5.5: 30 % schneller zum gleichen Preis wie Sonnet 5

Anthropic bringt Claude Sonnet 5.5: mehr als 30 % schneller und laut Anthropic bis zu 30 % günstiger pro Aufgabe, bei unverändertem Token-Preis. Auf mehreren Benchmarks liegt es nur knapp hinter Opus 5.5. Wir zeigen, wo der Haken liegt und wann sich der Wechsel lohnt.

Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
KI-FORSCHUNG·27. SEPTEMBER 2026

GPT-6 Astra knackt Enigma-Funkspruch von 1941 – in zwei Tagen

OpenAIs GPT-6 Astra hat einen deutschen Heeres-Funkspruch vom 10. Juli 1941 entschlüsselt, der seit 2005 als ungelöst galt. Das Modell suchte sich das Ziel selbst aus und schrieb Enigma-Simulator und Enigma-Bombe eigenständig in Python und C++. Dieselbe Autonomie ist der Grund, weshalb OpenAI seine leistungsfähigsten Modelle gerade gestoppt hat.

Mehr aus Neue Modelle →