NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·KI-FORSCHUNG

12 Mio. Token in einem Prompt: Subquadratic startet mit 29 Mio. Dollar – und ein paar mahnenden Stimmen

Das Miami-Startup Subquadratic ist mit einer 29-Mio.-Dollar-Seed-Runde gestartet und stellt SubQ 1M-Preview vor – ein Sprachmodell mit 12 Mio. Token Kontext und einer neuen Aufmerksamkeits-Architektur (SSA), die Compute linear statt quadratisch skaliert. CEO ist Justin Dangel, CTO Alex Whedon (Ex-Meta).

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
6. MAI 2026
4 MIN. LESEZEIT
Illustration einer Bibliothek mit Bücherregalen, Leiter und Lupe auf Lesetisch, kinewsletter.ch Stil
Illustration einer Bibliothek mit Bücherregalen, Leiter und Lupe auf Lesetisch, kinewsletter.ch Stil
INHALT
01Was bei Transformern nicht skaliert02Was an Zahlen kommuniziert wurde03Wer dahintersteckt – und woher das Geld kommt04Der Kleingedruckte: Skepsis aus der Forschungs-Community05Schweiz-Bezug06Einordnung
INHALT
01Was bei Transformern nicht skaliert02Was an Zahlen kommuniziert wurde03Wer dahintersteckt – und woher das Geld kommt04Der Kleingedruckte: Skepsis aus der Forschungs-Community05Schweiz-Bezug06Einordnung
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Wenn die Sparse-Attention-Architektur unabhängig verifiziert wird, ist das der grösste Architektur-Sprung seit dem Transformer – aber bisher fehlen Weights, Peer-Review und API-Pricing.

Ein Startup aus Miami namens Subquadratic ist heute mit einer 29-Mio.-Dollar-Seed-Runde aus dem Stealth-Modus getreten und behauptet, das gelöst zu haben, woran Transformer-Modelle seit Jahren scheitern: ein Sprachmodell, dessen Aufmerksamkeits-Compute nicht quadratisch, sondern linear mit der Eingabe wächst. Das Resultat heisst SubQ 1M-Preview, hat ein 12-Millionen-Token-Kontextfenster und kostet laut Hersteller ein Fünftel von Frontier-Modellen wie Claude Opus oder GPT-5.5. Die Forschung-Community ist gespalten – zwischen «grösster Architektur-Durchbruch seit dem Transformer» und «AI Theranos».

Was bei Transformern nicht skaliert

Die Aufmerksamkeit (engl. attention) – das Herzstück jedes modernen Sprachmodells – wächst bei Transformern quadratisch mit der Tokenzahl: Wer den Kontext von 1 auf 2 Mio. Tokens verdoppelt, vervierfacht den Compute-Bedarf. Bei 12 Mio. Tokens ist das schlicht zu teuer für die Praxis. Genau hier setzt Subquadratics neue Architektur an: Subquadratic Sparse Attention (SSA). Statt jeden Token mit jedem zu vergleichen, wählt SSA für jede Anfrage nur eine kleine Untermenge relevanter Positionen aus und rechnet exakte Aufmerksamkeit nur dort. Bei 12 Mio. Tokens reduziert das den Attention-Compute laut Subquadratic um fast das Tausendfache. Komplexitätstheoretisch verschiebt sich die Skalierung von O(n²) auf O(n).

Was an Zahlen kommuniziert wurde

Die Hersteller-Benchmarks vergleichen SubQ 1M-Preview gegen Claude Opus 4.6 / 4.7, Gemini 3.1 Pro und GPT-5.4 / 5.5:

  • SWE-Bench Verified (Coding-Aufgaben): 81,8% bei SubQ, 87,6% bei Opus 4.7
  • RULER @ 128K (Long-Context): 95,0% bei SubQ, 94,8% bei Opus 4.6 (intern evaluiert)
  • MRCR v2 8-needle, 1M (Multi-round Coreference): 65,9% bei SubQ, 78,3% bei Opus 4.6, 74,0% bei GPT-5.5

Subquadratic spricht zusätzlich von 52× schneller als FlashAttention bei 1 Mio. Tokens und einem Output von 150 Tokens pro Sekunde. Die Architektur ist auf zwei Produkte gemappt: SubQ API (OpenAI-kompatible Endpoints, Streaming, Tool-Use) und SubQ Code – ein CLI-Coding-Agent, der ganze Repositories in einen Kontext lädt und mit Claude Code, OpenAI Codex und Cursor zusammenarbeitet.

Wer dahintersteckt – und woher das Geld kommt

CEO ist Justin Dangel, fünffacher Gründer mit Exits in Health-Tech, Insurtech und Consumer-Goods. CTO ist Alex Whedon, früher Software-Engineer bei Meta und Head of Generative AI bei TribeAI. Die Forscher kommen laut eigener Angabe aus Meta, Google, Oxford, Cambridge und der Brigham Young University.

Die 29-Mio.-Seed-Runde bewertet das Unternehmen laut The New Stack mit 500 Mio. Dollar. Mit dabei: Justin Mateen (Tinder-Mitgründer, JAM Fund), Javier Villamizar (ehemaliger Partner SoftBank Vision Fund) und Frühinvestoren von Anthropic, OpenAI, Stripe und Brex. Parallel hat SubQ am 4. Mai einen 24-monatigen GPU-Mietvertrag über 19,6 Mio. Dollar mit dem Compute-Anbieter Digi Power X geschlossen – Inbetriebnahme am 15. Mai 2026.

Der Kleingedruckte: Skepsis aus der Forschungs-Community

VentureBeat fasst die Reaktionen pointiert zusammen: «SubQ ist entweder der grösste Durchbruch seit dem Transformer – oder AI Theranos.» Drei Punkte stehen im Raum:

  • Benchmark-Methodik: Jedes Modell wurde nur einmal durchlaufen wegen hoher Inferenzkosten. Ohne Konfidenzintervalle bleibt Raum für Varianz.
  • Lab-zu-Produktion-Lücke: Im internen Labor-Run schaffte SubQ auf MRCR v2 stolze 83 Punkte – die per Drittanbieter verifizierte Produktionsversion 65,9. Die 17-Punkte-Differenz ist nicht erklärt.
  • Keine Weights, kein vollständiger Technical Report: Bisher nur ein Blogpost zur Architektur. Pricing-Details für die API sind ebenfalls nicht öffentlich – das macht den «50× günstiger»-Claim aktuell unprüfbar.

Schweiz-Bezug

Lange Kontextfenster sind genau die Eigenschaft, die Schweizer Banken, Pharma-Unternehmen und Treuhand-Häuser interessiert. Wer einen kompletten Kreditakte-Stack, eine ganze klinische Studie oder mehrere Jahre Buchhaltungsdaten in einen Prompt packen kann, spart die ganze Komplexität von Retrieval-Augmented-Generation-Pipelines (RAG) und vermeidet die typischen Fehlerquellen beim Chunking. Für Coding-Teams bei Swisscom, Logitech, Postfinance oder ETH-Spin-offs ist SubQ Code interessant, weil es die ständige Verschiebung zwischen Repository-Kontext und Modell-Antwort eliminiert. Dass Schweizer Forschung an dem Thema arbeitet, ist bekannt: Apertus aus dem ETH-EPFL-Verbund und State-Space-Modelle wie Mamba haben verwandte Ideen verfolgt. SubQ ist das US-Pendant, das jetzt zuerst ein Produkt am Markt hat – wenn die Behauptungen halten.

Einordnung

Wenn die SSA-Architektur in unabhängigen Reproduktionen bestätigt wird, ist das tatsächlich der grösste Architektur-Sprung seit dem Transformer von 2017. Die Frage ist, wie schnell. Bisher hat Subquadratic einen Blog-Post, einen Investorenkreis und einen Compute-Vertrag – aber keine Weights und keinen Peer-Review. Wer im Enterprise-Umfeld auf SubQ setzt, sollte kurzfristig Pilot-Workloads laufen lassen und längerfristig auf das Technical-Paper warten. Der Underdog-Trade ist klar: Eine kleine Wette, dass die Branche sich in zwei Jahren nicht mehr nur über Modellgrössen, sondern über Aufmerksamkeits-Sparsamkeit unterhält.

Quellen

Subquadratic launches with $29M to bring 12M-token context windows to AI – SiliconANGLE↗ EXTERNER LINKThe context window has been shattered: Subquadratic debuts a 12-million-token window – The New Stack↗ EXTERNER LINKMiami startup Subquadratic claims 1,000x AI efficiency gain – VentureBeat↗ EXTERNER LINKIntroducing SubQ: The First Fully Subquadratic LLM – subq.ai↗ EXTERNER LINKHow SSA Makes Long Context Practical – subq.ai↗ EXTERNER LINKDigi Power X Signs First AI Revenue Contract – $19.6M, 24-Month SubQ AI Agreement – StockTitan↗ EXTERNER LINKSubQ Review: The First Subquadratic LLM – FelloAI↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
MetaAnthropicGoogleOpenAISwisscom
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Google schickt vier KI-Chips ins All
Google schickt vier KI-Chips ins All
KI-FORSCHUNG·25. SEPTEMBER 2026

Google schickt vier KI-Chips ins All

Am 1. Oktober startet Google mit dem Testsatelliten MVP den ersten realen Hardwaretest für Project Suncatcher: vier TPUs im All statt nur eine Vision auf Papier. Kritiker wie Gartner-Analyst Bill Ray und Jeff Bezos bleiben skeptisch.

Illustration einer Laborwerkbank mit Reagenzglasgestell, Mikroskop und Petrischalen, kinewsletter.ch Stil
Illustration einer Laborwerkbank mit Reagenzglasgestell, Mikroskop und Petrischalen, kinewsletter.ch Stil
KI-FORSCHUNG·24. SEPTEMBER 2026

Claude findet ein neues Enzymsystem – in 21 Stunden

Anthropic hat ein eigenes Biologie-Labor in der Bay Area – und Claude-Agenten fanden darin ein unbeschriebenes Enzymsystem, das an CRISPR erinnert. Laut Anthropic in 21 Stunden, mit rund 950 Agenten.

Illustration eines langen Sitzungstisches in einem alten Seminarraum mit einer Reihe leerer Stühle und einer Wasserkaraffe, kinewsletter.ch Stil
Illustration eines langen Sitzungstisches in einem alten Seminarraum mit einer Reihe leerer Stühle und einer Wasserkaraffe, kinewsletter.ch Stil
Nur für Abonnenten·KI-FORSCHUNG·22. SEPTEMBER 2026

OpenAIs Mathe-Beirat darf alles – nur nicht bremsen

OpenAI setzt ein unabhängiges Mathematik-Gremium am Institute for Advanced Study ein – ausgelöst vom eigenen Modell, das neben Navier–Stokes über 100 weitere offene Probleme gelöst haben will. Der Beirat darf ungefragt beraten und öffentlich widersprechen, nur das Tempo nicht bremsen. Mit Martin Hairer sitzt ein EPFL-Professor darin, der die kritische Fields-Medaillen-Erklärung mitunterzeichnet hat.

Skizze eines humanoiden Roboters neben einer offenen Schutzabsperrung in Elektroblau, kinewsletter.ch Stil
Skizze eines humanoiden Roboters neben einer offenen Schutzabsperrung in Elektroblau, kinewsletter.ch Stil
KI-FORSCHUNG·16. SEPTEMBER 2026

Humanoider Roboter Digit 5 soll ohne Schutzzaun arbeiten

Agility Robotics hat am 15. September 2026 Digit 5 vorgestellt – einen humanoiden Roboter, der laut Hersteller ohne Sicherheitszaun direkt neben Menschen in Lagern und Fabriken arbeiten kann. Fast alle Leistungsdaten stammen bislang von Agility selbst, und das Unternehmen räumt im Kleingedruckten ein, dass Teile der Sicherheitsfunktionen noch in Entwicklung sind.

Illustration eines Studiertisches mit blauer Kugel, gepackten Kugeln, Zirkel und Lineal, kinewsletter.ch Stil
Illustration eines Studiertisches mit blauer Kugel, gepackten Kugeln, Zirkel und Lineal, kinewsletter.ch Stil
KI-FORSCHUNG·13. SEPTEMBER 2026

25 Fields-Medaillen-Träger: KI-Labore beschädigen die Mathematik

25 Träger der Fields-Medaille werfen den KI-Firmen in einer gemeinsamen Deklaration vor, mathematische Probleme als Benchmark zu missbrauchen und dabei die Wissenschaft selbst zu beschädigen. Vier der 25 lehren an Schweizer Hochschulen – darunter Alessio Figalli an der ETH Zürich und Maryna Viazovska an der EPFL. Und die Warnung endet nicht bei der Mathematik.

Illustration eines DNA-Doppelhelix-Modells auf einer Laborbank neben Mikroskop und Glasröhrchen, kinewsletter.ch Stil
Illustration eines DNA-Doppelhelix-Modells auf einer Laborbank neben Mikroskop und Glasröhrchen, kinewsletter.ch Stil
Nur für Abonnenten·KI-FORSCHUNG·10. SEPTEMBER 2026

DeepMind kartiert alle 9 Milliarden DNA-Mutationen

Rund 1 Petabyte vorberechnete Wirkungs-Vorhersagen für jede mögliche Punktmutation im menschlichen Genom — 30-mal grösser als die AlphaFold-Datenbank und gratis für die Forschung.

Mehr aus KI-Forschung →