NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·KI-TOOLS & APPS

OpenAIs schnellster Modus macht aus Wartezeit ein Gespräch

OpenAI hat mit Ultrafast einen neuen API-Tarif vorgestellt, der das Spitzenmodell GPT-5.6 Sol auf Cerebras-Hardware bis zu 14-mal schneller laufen lässt. Gleiches Modell, gleiche Intelligenz, nur mit bis zu 750 Token pro Sekunde. Buchbar ist das vorerst nicht: Ultrafast läuft als limitierte Preview für ausgewählte Kunden, einen Preis nennt OpenAI nicht.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
14. AUGUST 2026
3 MIN. LESEZEIT
Illustration einer Stoppuhr mit blauem Gehäusering neben einem Silizium-Wafer auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Stoppuhr mit blauem Gehäusering neben einem Silizium-Wafer auf einer Werkbank, kinewsletter.ch Stil
INHALT
01Tempo ohne Rabatt auf Intelligenz0244 Gigabyte SRAM auf einem Wafer03Wenn der Nachtlauf zur Sitzung wird04Für Schweizer Firmen noch nicht buchbar
INHALT
01Tempo ohne Rabatt auf Intelligenz0244 Gigabyte SRAM auf einem Wafer03Wenn der Nachtlauf zur Sitzung wird04Für Schweizer Firmen noch nicht buchbar
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Schnell hiess bisher fast immer: kleineres Modell. Ultrafast entkoppelt Tempo von Intelligenz – und verwandelt Aufgaben, die als Nachtlauf gestartet wurden, in interaktive Arbeit.

OpenAI hat am 13. August 2026 Ultrafast vorgestellt: einen neuen Service-Tier in der OpenAI-API, der das Spitzenmodell GPT-5.6 Sol nach Angaben des Unternehmens bis zu 14-mal schneller laufen lässt als Standard Processing — bei bis zu 750 Output-Token pro Sekunde. Es ist dasselbe Modell mit derselben Intelligenz, nur auf anderer Hardware: Die Rechenleistung liefert der US-Chiphersteller Cerebras. Verfügbar ist Ultrafast vorerst nur als limitierte Preview für eine kleine Gruppe ausgewählter Kunden.

Tempo ohne Rabatt auf Intelligenz

Bisher hiess «schnell» in der Praxis fast immer «kleineres Modell». Wer Antworten in Echtzeit brauchte, nahm ein abgespecktes System und damit schwächere Ergebnisse in Kauf. Genau diesen Handel will OpenAI beenden. Bis jetzt habe Echtzeit-Tempo meist bedeutet, ein kleineres oder spezialisierteres Modell zu wählen, schreibt das Unternehmen in seiner Ankündigung — Ultrafast zeige in eine andere Richtung: mehr nützliche Arbeit pro Sekunde.

44 Gigabyte SRAM auf einem Wafer

Der Trick steckt in der Hardware. Cerebras baut keine klassischen Prozessoren, sondern Wafer-Scale Engines — Chips so gross wie eine ganze Halbleiterscheibe. Auf jedem davon sitzen 44 Gigabyte sehr schneller Speicher (SRAM). Die Modellgewichte bleiben dadurch direkt auf dem Chip, statt für jedes einzelne Token zwischen Chip und externem Speicher hin- und hergeschoben zu werden. Dieser Datentransport ist bei herkömmlichen GPUs der eigentliche Flaschenhals.

Cerebras selbst beziffert den Vorsprung: fünfmal schneller als Claude Opus 4.8 im Fast Mode, elfmal schneller als Claude Fable 5. Beim Test «Humanity's Last Exam» (2500 Fragen auf Doktoratsniveau) habe GPT-5.6 Sol Ultrafast den kompletten Fragensatz in gut 11 Stunden abgearbeitet, Claude Fable 5 habe dafür über drei Tage gebraucht. Wichtig zur Einordnung: Diese Vergleichszahlen stammen vom Hardware-Lieferanten selbst und sind keine unabhängige Messung.

Wenn der Nachtlauf zur Sitzung wird

Spannender als die Multiplikatoren ist, was sich im Arbeitsalltag verschiebt. OpenAI nennt als Einsatzfelder die Störungsanalyse (Logs, Code-Änderungen und Berichte auswerten, während der Ausfall noch läuft), Finanzresearch und Betrugserkennung, Kundenservice per Sprache sowie den Onlinehandel — Produktfragen und Checkout-Probleme lösen, bevor der Warenkorb abbricht. Intern beobachte man laut OpenAI, dass Experimente, die bislang über Nacht liefen, zu mehreren Durchgängen pro Arbeitstag werden.

Für Schweizer Firmen noch nicht buchbar

Der Haken: Ultrafast ist eine limitierte Preview, und einen Preis nennt OpenAI bisher nicht. Nutzt du die OpenAI-API produktiv, ändert sich heute also noch nichts — bleibt die Warteliste. Interessant wird das Angebot überall dort, wo Latenz direkt Geld kostet: Voice-Support, trading-nahe Analyse, Echtzeit-Betrugserkennung. Konkurrenz gibt es bereits: Anthropic bietet für Claude einen eigenen Fast Mode an, laut TechCrunch allerdings nicht in dieser Grössenordnung.

Quellen

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed – OpenAI (Primärquelle)↗ EXTERNER LINKAccelerating GPT-5.6 Sol Ultrafast with OpenAI – Cerebras (Primärquelle)↗ EXTERNER LINKCerebras Powers Ultrafast Mode for OpenAI's GPT-5.6 Sol – GlobeNewswire↗ EXTERNER LINKOpenAI introduces Ultrafast, a new mode that makes GPT-5.6 Sol work at 14x the speed – TechCrunch↗ EXTERNER LINKOpenAI previews 'Ultrafast' GPT-5.6 Sol running up to 14 times faster – 9to5Mac↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
OpenAIAnthropic
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze einer angelehnten blauen Stahl-Tresortür in einer Betonwand mit Prüflampe daneben, kinewsletter.ch Stil
Handgezeichnete Skizze einer angelehnten blauen Stahl-Tresortür in einer Betonwand mit Prüflampe daneben, kinewsletter.ch Stil
KI-TOOLS & APPS·22. AUGUST 2026

Anthropics stärkstes Modell scannt jetzt Firmencode nach Lücken

Anthropic lässt seinen Sicherheits-Scanner Claude Security ab sofort auf Claude Mythos 5 laufen – dem stärksten Modell des Hauses, das wegen seiner Cyber-Fähigkeiten nie breit freigegeben wurde. Enterprise-Kunden prüfen damit ihre Codebasis auf Schwachstellen und bekommen pro Fund eine CWE-Kategorie, eine Severity-Einstufung und einen Fix-Vorschlag; freigeben muss jeden Patch ein Mensch. Dazu kommen ein 35-Millionen-Dollar-Fonds für Open-Source-Sicherheit und Mythos-Integrationen in Partnerprodukte, die Spitäler, Versorger und Banken schützen.

Handgezeichnete Skizze eines überdimensionierten runden elektroblauen Druckknopfs auf einem Holztresen, dahinter ein Stapel gefalteter Zeitungen und eine kleine Messingklingel, kinewsletter.ch Stil
Handgezeichnete Skizze eines überdimensionierten runden elektroblauen Druckknopfs auf einem Holztresen, dahinter ein Stapel gefalteter Zeitungen und eine kleine Messingklingel, kinewsletter.ch Stil
KI-TOOLS & APPS·22. AUGUST 2026

Google gibt Verlagen einen Knopf gegen den Traffic-Schwund

Google hat am 20. August einen einbettbaren Knopf für Verlage vorgestellt: Ein Klick macht die Website zur bevorzugten Quelle in Suche, AI Overviews und KI-Modus – und schickt die Lesenden sofort dorthin zurück, wo sie waren. Über 600'000 Quellen sind laut Google bereits markiert. Die Funktion ist global verfügbar, also auch in der Schweiz.

Handgezeichnete Skizze eines Basteltisches mit einem elektroblauen Stanzbogen, aus dem mehrere Formen herausgelöst sind, daneben ein Skalpell auf einer Schneidematte und eine schlichte Glasflasche, kinewsletter.ch Stil
Handgezeichnete Skizze eines Basteltisches mit einem elektroblauen Stanzbogen, aus dem mehrere Formen herausgelöst sind, daneben ein Skalpell auf einer Schneidematte und eine schlichte Glasflasche, kinewsletter.ch Stil
KI-TOOLS & APPS·22. AUGUST 2026

GPT-Image-2 liefert Bilder ohne Hintergrund – ein Parameter genügt

OpenAI hat für sein Bildmodell GPT-Image-2 transparente Hintergründe als Preview freigegeben. Ein einziger Parameter genügt, damit statt eines weissen Kastens ein PNG mit echtem Alphakanal herauskommt. Wo das sofort Arbeit spart – und wo du trotzdem nachkontrollieren musst.

Handgezeichnete Skizze einer Wand aus schlichten Metall-Briefkastentüren, von denen drei elektroblau gestrichen und weit geöffnet sind, davor eine Rollleiter und ein leerer Holzhocker, kinewsletter.ch Stil
Handgezeichnete Skizze einer Wand aus schlichten Metall-Briefkastentüren, von denen drei elektroblau gestrichen und weit geöffnet sind, davor eine Rollleiter und ein leerer Holzhocker, kinewsletter.ch Stil
KI-TOOLS & APPS·22. AUGUST 2026

Grok Bot: KI-Agenten jetzt auch im 60-Dollar-Abo

Zehn Tage nach dem Beta-Start weitet SpaceXAI den Zugang zu seinen KI-Agenten Grok Bot aus. Bei Cursor ist der Bot neu schon im Pro+-Abo für 60 Dollar im Monat enthalten statt erst im Ultra-Abo für 200. Alle übrigen Nutzer bekommen einen Gratis-Test – der allerdings nach Verbrauch endet, nicht nach Tagen.

Illustration von offener Karteikasten-Schublade, Lupe auf aufgeschlagenem Tabellenbuch und Archivregal mit Leiter, kinewsletter.ch Stil
Illustration von offener Karteikasten-Schublade, Lupe auf aufgeschlagenem Tabellenbuch und Archivregal mit Leiter, kinewsletter.ch Stil (Dark Mode)
KI-TOOLS & APPS·21. AUGUST 2026

Mistral Agentic Search: KI blättert selbst durch Dokumente

Mistral hat Agentic Search vorgestellt: eine Retrieval-Schicht, mit der KI-Modelle in Firmendokumenten nicht nur suchen, sondern auch blättern, lesen und Fundstellen prüfen. Laut Mistral steigt die Quote korrekter Antworten auf dem Benchmark FinanceBench von 26,7 auf 86 Prozent. Für Schweizer Firmen interessant ist vor allem, dass die Dokumente dabei im eigenen Index bleiben können.

Illustration eines blauen Aktenvernichters vor einem Aktenschrank mit offenen Schubladen und verstreuten Mappen, kinewsletter.ch Stil
Illustration eines blauen Aktenvernichters vor einem Aktenschrank mit offenen Schubladen und verstreuten Mappen, kinewsletter.ch Stil (Dark Mode)
KI-TOOLS & APPS·21. AUGUST 2026

OpenAI patcht Codex, nachdem es echte Nutzerdateien löschte

OpenAI hat für seinen Coding-Agenten Codex mehrere Schutzmassnahmen ausgeliefert, nachdem das Modell GPT-5.6 Sol in einzelnen Fällen echte Nutzerdateien gelöscht hatte. Ein Aufräum-Befehl, der nur temporäre Ordner treffen sollte, zeigte stattdessen auf das echte Home-Verzeichnis. Codex prüft Löschziele jetzt vorab, und der Full-Access-Modus lässt sich nicht mehr aus Versehen aktivieren.

Mehr aus KI-Tools & Apps →