NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·KI-TOOLS & APPS

OpenAIs schnellster Modus macht aus Wartezeit ein Gespräch

OpenAI hat mit Ultrafast einen neuen API-Tarif vorgestellt, der das Spitzenmodell GPT-5.6 Sol auf Cerebras-Hardware bis zu 14-mal schneller laufen lässt. Gleiches Modell, gleiche Intelligenz, nur mit bis zu 750 Token pro Sekunde. Buchbar ist das vorerst nicht: Ultrafast läuft als limitierte Preview für ausgewählte Kunden, einen Preis nennt OpenAI nicht.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
14. AUGUST 2026
3 MIN. LESEZEIT
Illustration einer Stoppuhr mit blauem Gehäusering neben einem Silizium-Wafer auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Stoppuhr mit blauem Gehäusering neben einem Silizium-Wafer auf einer Werkbank, kinewsletter.ch Stil
INHALT
01Tempo ohne Rabatt auf Intelligenz0244 Gigabyte SRAM auf einem Wafer03Wenn der Nachtlauf zur Sitzung wird04Für Schweizer Firmen noch nicht buchbar
INHALT
01Tempo ohne Rabatt auf Intelligenz0244 Gigabyte SRAM auf einem Wafer03Wenn der Nachtlauf zur Sitzung wird04Für Schweizer Firmen noch nicht buchbar
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Schnell hiess bisher fast immer: kleineres Modell. Ultrafast entkoppelt Tempo von Intelligenz – und verwandelt Aufgaben, die als Nachtlauf gestartet wurden, in interaktive Arbeit.

OpenAI hat am 13. August 2026 Ultrafast vorgestellt: einen neuen Service-Tier in der OpenAI-API, der das Spitzenmodell GPT-5.6 Sol nach Angaben des Unternehmens bis zu 14-mal schneller laufen lässt als Standard Processing — bei bis zu 750 Output-Token pro Sekunde. Es ist dasselbe Modell mit derselben Intelligenz, nur auf anderer Hardware: Die Rechenleistung liefert der US-Chiphersteller Cerebras. Verfügbar ist Ultrafast vorerst nur als limitierte Preview für eine kleine Gruppe ausgewählter Kunden.

Tempo ohne Rabatt auf Intelligenz

Bisher hiess «schnell» in der Praxis fast immer «kleineres Modell». Wer Antworten in Echtzeit brauchte, nahm ein abgespecktes System und damit schwächere Ergebnisse in Kauf. Genau diesen Handel will OpenAI beenden. Bis jetzt habe Echtzeit-Tempo meist bedeutet, ein kleineres oder spezialisierteres Modell zu wählen, schreibt das Unternehmen in seiner Ankündigung — Ultrafast zeige in eine andere Richtung: mehr nützliche Arbeit pro Sekunde.

44 Gigabyte SRAM auf einem Wafer

Der Trick steckt in der Hardware. Cerebras baut keine klassischen Prozessoren, sondern Wafer-Scale Engines — Chips so gross wie eine ganze Halbleiterscheibe. Auf jedem davon sitzen 44 Gigabyte sehr schneller Speicher (SRAM). Die Modellgewichte bleiben dadurch direkt auf dem Chip, statt für jedes einzelne Token zwischen Chip und externem Speicher hin- und hergeschoben zu werden. Dieser Datentransport ist bei herkömmlichen GPUs der eigentliche Flaschenhals.

Cerebras selbst beziffert den Vorsprung: fünfmal schneller als Claude Opus 4.8 im Fast Mode, elfmal schneller als Claude Fable 5. Beim Test «Humanity's Last Exam» (2500 Fragen auf Doktoratsniveau) habe GPT-5.6 Sol Ultrafast den kompletten Fragensatz in gut 11 Stunden abgearbeitet, Claude Fable 5 habe dafür über drei Tage gebraucht. Wichtig zur Einordnung: Diese Vergleichszahlen stammen vom Hardware-Lieferanten selbst und sind keine unabhängige Messung.

Wenn der Nachtlauf zur Sitzung wird

Spannender als die Multiplikatoren ist, was sich im Arbeitsalltag verschiebt. OpenAI nennt als Einsatzfelder die Störungsanalyse (Logs, Code-Änderungen und Berichte auswerten, während der Ausfall noch läuft), Finanzresearch und Betrugserkennung, Kundenservice per Sprache sowie den Onlinehandel — Produktfragen und Checkout-Probleme lösen, bevor der Warenkorb abbricht. Intern beobachte man laut OpenAI, dass Experimente, die bislang über Nacht liefen, zu mehreren Durchgängen pro Arbeitstag werden.

Für Schweizer Firmen noch nicht buchbar

Der Haken: Ultrafast ist eine limitierte Preview, und einen Preis nennt OpenAI bisher nicht. Nutzt du die OpenAI-API produktiv, ändert sich heute also noch nichts — bleibt die Warteliste. Interessant wird das Angebot überall dort, wo Latenz direkt Geld kostet: Voice-Support, trading-nahe Analyse, Echtzeit-Betrugserkennung. Konkurrenz gibt es bereits: Anthropic bietet für Claude einen eigenen Fast Mode an, laut TechCrunch allerdings nicht in dieser Grössenordnung.

Quellen

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed – OpenAI (Primärquelle)↗ EXTERNER LINKAccelerating GPT-5.6 Sol Ultrafast with OpenAI – Cerebras (Primärquelle)↗ EXTERNER LINKCerebras Powers Ultrafast Mode for OpenAI's GPT-5.6 Sol – GlobeNewswire↗ EXTERNER LINKOpenAI introduces Ultrafast, a new mode that makes GPT-5.6 Sol work at 14x the speed – TechCrunch↗ EXTERNER LINKOpenAI previews 'Ultrafast' GPT-5.6 Sol running up to 14 times faster – 9to5Mac↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAIAnthropic
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Illustration zum Artikel «Nvidia DGX Spark: 64 GB für 4'999 Dollar», kinewsletter.ch Stil
Handgezeichnete Illustration zum Artikel «Nvidia DGX Spark: 64 GB für 4'999 Dollar», kinewsletter.ch Stil
KI-TOOLS & APPS·3. OKTOBER 2026

Nvidia DGX Spark: 64 GB für 4'999 Dollar

Nvidia bringt den KI-Minicomputer DGX Spark am 23. Oktober 2026 mit 64 statt 128 GB Speicher ab 4'999 US-Dollar. Der Grund: Die Speicherpreise explodieren, die 128-GB-Variante kostet inzwischen 6'950 Dollar.

Handgezeichnete Illustration zum Artikel «Microsoft-Report 2026: KI gibt Angreifern einen Vorsprung», kinewsletter.ch Stil
Handgezeichnete Illustration zum Artikel «Microsoft-Report 2026: KI gibt Angreifern einen Vorsprung», kinewsletter.ch Stil
KI-TOOLS & APPS·3. OKTOBER 2026

Microsoft-Report 2026: KI gibt Angreifern einen Vorsprung

Microsoft zeigt im Digital Defense Report 2026, dass Angreifer KI für Aufklärung, Social Engineering und Malware nutzen. Behörden sind mit 27 Prozent (Vorjahr: 17 Prozent) der meistbetroffene Sektor. Auch das Schweizer BACS beobachtet KI-personalisierte Phishing-Angriffe.

Handgezeichnete Illustration zum Artikel «Apple macht «Full Disk Access» schwerer zugänglich – wegen KI-Agenten», kinewsletter.ch Stil
Handgezeichnete Illustration zum Artikel «Apple macht «Full Disk Access» schwerer zugänglich – wegen KI-Agenten», kinewsletter.ch Stil
KI-TOOLS & APPS·3. OKTOBER 2026

Apple macht «Full Disk Access» schwerer zugänglich – wegen KI-Agenten

Apple will den macOS-Vollzugriff auf alle Dateien künftig nur noch nach «sehr expliziter Nutzeraktion» freigeben und nennt KI-Agenten als Grund. Auslöser ist laut TechCrunch der Streit um Metas Muse, das laut Kolumnist Jason Aten über 187'000 Nachrichtenzeilen synchronisiert haben soll, obwohl er die Freigabe abgelehnt habe. Meta widerspricht.

Tuschskizze einer blauen Sprechblase mit drei Punkten, die über einem Schreibtisch mit Laptop und Wecker schwebt
Tuschskizze einer blauen Sprechblase mit drei Punkten, die über einem Schreibtisch mit Laptop und Wecker schwebt
KI-TOOLS & APPS·30. SEPTEMBER 2026

OpenAI Dots: Agenten für Pro-Kunden, aber nicht in der Schweiz

OpenAI lanciert mit «Dots» always-on Agenten mit Avatar, die auf eigenen Cloud-Computern für dich weiterarbeiten. Im Hintergrund lesen sie standardmässig nur, aktive Aufgaben steuerst du über Custom Rules. Pro-Abos in der Schweiz sind vom Start ausgeschlossen, Business Premium ist dabei.

Tuschskizze eines offenen Aktenschranks, dessen Schublade voller elektroblauer Dokumente ist, daneben Stempel und Büroklammern
Tuschskizze eines offenen Aktenschranks, dessen Schublade voller elektroblauer Dokumente ist, daneben Stempel und Büroklammern
KI-TOOLS & APPS·30. SEPTEMBER 2026

ChatGPT wird zum Büro: Space, Pages und Pro 500 für 500 Dollar

OpenAI baut ChatGPT am DevDay zur Arbeitsumgebung um: Space, Pages, Plug-ins mit Seitenleisten-Panels und Automationen. Laut OpenAI nutzen 1,2 Milliarden Menschen ChatGPT pro Woche. Für die Schweiz zählt: Die Agenten «Dots» starten für Pro-Nutzer nicht hier.

Illustration eines geöffneten Getriebegehäuses auf einer Werkbank mit einem elektroblau hervorgehobenen Zahnrad, Schraubenschlüssel und Ölkännchen, kinewsletter.ch Stil
Illustration eines geöffneten Getriebegehäuses auf einer Werkbank mit einem elektroblau hervorgehobenen Zahnrad, Schraubenschlüssel und Ölkännchen, kinewsletter.ch Stil
KI-FORSCHUNG·27. SEPTEMBER 2026

Nvidias SoL-Pi senkt den Token-Verbrauch von Coding-Agenten fast um die Hälfte

Forschende von Nvidia, NTU und MIT senken den Token-Verbrauch von Coding-Agenten um 44,7 bis 49 Prozent – ohne ein besseres Modell. Optimiert wird der Harness, die Steuerungsschicht zwischen KI und Arbeitsumgebung. Auf Terminal-Bench 4 löst das System dafür weniger Aufgaben als zuvor.

Mehr aus KI-Tools & Apps →