NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·KI-BUSINESS

AMD kauft Taalas – KI-Modelle direkt ins Silizium gebrannt

AMD übernimmt das Toronto-Startup Taalas, das KI-Modelle direkt ins Silizium brennt, statt sie auf flexibler Hardware laufen zu lassen. Ein Testchip lieferte Llama 3.1 8B mit 16'960 Token pro Sekunde und Nutzer aus – ein Vielfaches konkurrierender Hardware. Der Preis dafür: Jeder Chip kann nur genau ein Modell.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
9. AUGUST 2026
3 MIN. LESEZEIT
Illustration einer elektroblauen Silizium-Wafer-Scheibe auf einer Werkbank unter einer Lupenlampe, kinewsletter.ch Stil
Illustration einer elektroblauen Silizium-Wafer-Scheibe auf einer Werkbank unter einer Lupenlampe, kinewsletter.ch Stil
INHALT
0116'960 Token pro Sekunde aus einem Chip02Ein neues Modell heisst neuer Chip03Gegenentwurf zur Alleskönner-GPU
INHALT
0116'960 Token pro Sekunde aus einem Chip02Ein neues Modell heisst neuer Chip03Gegenentwurf zur Alleskönner-GPU
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Spezialsilizium macht KI-Inferenz um Grössenordnungen schneller und stromsparender – bezahlt wird das mit dem Verlust jeder Flexibilität.

AMD hat am 6. August 2026 die Übernahme des kanadischen Chip-Startups Taalas angekündigt – einer Firma, die KI-Modelle nicht auf Chips laufen lässt, sondern in sie hineinbrennt. Architektur und trainierte Parameter eines Modells werden fest ins Silizium geätzt. Das macht die Inferenz – also das Ausführen eines fertig trainierten Modells – extrem schnell und stromsparend, legt jeden Chip aber unwiderruflich auf ein einziges Modell fest. Einen Kaufpreis nannte AMD nicht; die Übernahme steht laut Mitteilung unter dem üblichen regulatorischen Vorbehalt.

16'960 Token pro Sekunde aus einem Chip

Taalas wurde 2023 in Toronto gegründet und kam erst im Februar 2026 aus dem Stealth-Modus. Der erste Testchip HC1, bei TSMC im 6-Nanometer-Verfahren gefertigt, lieferte Metas Llama 3.1 8B mit 16'960 Token pro Sekunde und Nutzer aus – laut The Register das 48-Fache der damaligen Nvidia-GPUs und das 8,5-Fache eines Cerebras-Beschleunigers. Taalas selbst rechnet vor, die eigenen Chips seien 20-mal günstiger im Bau als bisherige Beschleuniger und brauchten zehnmal weniger Strom.

Der Kniff steckt in der Architektur: Speicher und Rechenwerk sitzen auf demselben Chip. Der ständige Weg zum externen Speicher entfällt – und mit ihm HBM-Stapel, aufwendiges Packaging und Flüssigkühlung.

Ein neues Modell heisst neuer Chip

Genau hier liegt der Haken. Wer ein Modell einmal in Silizium gegossen hat, sitzt darauf fest. Alles, was über einen kleinen Feinschliff per LoRA-Adapter hinausgeht, verlangt einen neuen Fertigungsdurchlauf – laut Taalas immerhin nur mit zwei geänderten Metalllagen statt einem Neustart bei null. Bei Modellgenerationen im Monatsrhythmus bleibt das eine Wette auf Beständigkeit. Die zweite Chip-Generation HC2 soll bis zu 20 Milliarden Parameter fassen.

Gegenentwurf zur Alleskönner-GPU

AMD will die Technologie in seine Beschleuniger-Roadmap aufnehmen und neben den Instinct-GPUs als Systemlösung anbieten.

«AMD baut eine Full-Stack-KI-Plattform, die Kunden die Flexibilität gibt, für jede KI-Aufgabe die passende Rechenlösung einzusetzen», sagt Vamsi Boppana, Senior Vice President der KI-Sparte von AMD.

Eine GPU ist ein Universalwerkzeug: Sie rechnet jedes Modell, holt dessen Gewichte aber bei jedem einzelnen Token neu aus dem Speicher. Taalas dreht das um – das Modell ist die Hardware. Für dich heisst das mittelfristig vor allem eines: Antworten kommen schneller, und Anbieter können sich längeres «Nachdenken» ihrer Modelle eher leisten, weil das einzelne Token billiger wird. AMD ist mit der Idee nicht allein – Google soll laut Berichten von The Information an einem Chip namens «Frozen v2» arbeiten, der Teile der Gemini-Architektur fest verdrahtet und sechs- bis zehnmal effizienter als heutige TPUs sein soll. Bestätigt ist das nicht.

Quellen

AMD: AMD acquires Taalas to advance compute solutions for AI inference↗ EXTERNER LINKThe Register: AMD acquires AI chip startup Taalas↗ EXTERNER LINKTaalas: The path to ubiquitous AI↗ EXTERNER LINKCNX Software: Taalas HC1 hardwired Llama 3.1 8B accelerator↗ EXTERNER LINKThe Decoder: AMD acquires Taalas, a startup that bakes AI models directly into silicon↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
MetaNvidiaGoogle
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines halb leeren Elektronikregals mit wenigen Geräteschachteln, Trittleiter und Einkaufskorb, kinewsletter.ch Stil
Illustration eines halb leeren Elektronikregals mit wenigen Geräteschachteln, Trittleiter und Einkaufskorb, kinewsletter.ch Stil
KI-BUSINESS·3. SEPTEMBER 2026

Der KI-Boom landet jetzt auf deinem Preisschild

Chips und Speicher wandern in die KI-Rechenzentren – im Laden bleiben weniger Modelle und höhere Preise. NIQ zeigt zur IFA, was das für Käufer bedeutet.

Illustration einer Schaltwand mit drei Hebeln neben Aktenschränken, kinewsletter.ch Stil
Illustration einer Schaltwand mit drei Hebeln neben Aktenschränken, kinewsletter.ch Stil
KI-BUSINESS·2. SEPTEMBER 2026

Pentagon schaltet ChatGPT und Grok für 3 Millionen frei

Das US-Verteidigungsministerium hat ChatGPT Mil und Grok for Government auf GenAI.mil aufgeschaltet – neben Googles Gemini. 1,7 von 3 Millionen Beschäftigten nutzen es.

Illustration von Tresortür mit blauem Handrad, Aktenstapel und Schreibtischlampe, kinewsletter.ch Stil
Illustration von Tresortür mit blauem Handrad, Aktenstapel und Schreibtischlampe, kinewsletter.ch Stil
KI-BUSINESS·2. SEPTEMBER 2026

Nvidia steckt 3,5 Milliarden in MediaTek – ohne Aktienkauf

Nvidia hat 3,5 Milliarden US-Dollar in Wandelanleihen von MediaTek gesteckt – nicht in Aktien. Dafür baut der taiwanische Chipdesigner künftig Nvidias NVLink Fusion und den neuen Speicher NVHBM in kundenspezifische KI-Chips ein. Nvidia sichert sich so den Steckplatz, während Big Tech eigene Beschleuniger entwickelt.

Illustration eines Rooftop-Billboards mit Leiter und Farbkessel vor Skyline, kinewsletter.ch Stil
Illustration eines Rooftop-Billboards mit Leiter und Farbkessel vor Skyline, kinewsletter.ch Stil
KI-BUSINESS·1. SEPTEMBER 2026

ChatGPT-Werbung knackt die Milliarde – in unter 200 Tagen

OpenAI meldet für ChatGPT Ads eine annualisierte Run-Rate von 1 Milliarde Dollar – keine 200 Tage nach dem Start. Zehntausende Werbetreibende, über 40 Länder, und der Self-Service-Kauf öffnet sich für Europa. Die Schweiz sieht die Anzeigen seit dem 24. August, beim Ads Manager steht sie aber noch auf «Coming Soon».

Illustration einer Giesserei mit Schmelztiegel und Gasturbinenschaufeln auf einem Stahlregal, kinewsletter.ch Stil
Illustration einer Giesserei mit Schmelztiegel und Gasturbinenschaufeln auf einem Stahlregal, kinewsletter.ch Stil
KI-BUSINESS·31. AUGUST 2026

Musk giesst Turbinenschaufeln selbst – KI-Strom 18 Monate früher

Elon Musk hat bestätigt, dass eine geheime SpaceX-Giesserei in Texas Gasturbinen-Schaufeln produzieren soll – damit Kraftwerke für KI-Rechenzentren bis zu 18 Monate früher ans Netz gehen. Genau solche Turbinen haben in den USA bereits eine Klage der NAACP und mehrere Gesundheitsstudien ausgelöst.

Illustration eines leeren Filmstudios mit verwaistem Regiestuhl und vertikalem Smartphone auf einem Stativ, kinewsletter.ch Stil
Illustration eines leeren Filmstudios mit verwaistem Regiestuhl und vertikalem Smartphone auf einem Stativ, kinewsletter.ch Stil
KI-BUSINESS·31. AUGUST 2026

95 Prozent KI: Chinas Schauspieler verlieren ihre Rollen

In China waren über 95 Prozent der rund 128'000 Kurzdramen aus dem ersten Quartal 2026 KI-generiert – Schauspieler, Crews und Livestreamer verlieren reihenweise Aufträge. Die Zahl ist ein Spitzenwert direkt nach dem Start von ByteDances Seedance 2.0: Im zweiten Quartal sank der KI-Anteil bereits wieder auf 64 Prozent.

Mehr aus KI-Business →