NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·KI-BUSINESS

AMD kauft Taalas – KI-Modelle direkt ins Silizium gebrannt

AMD übernimmt das Toronto-Startup Taalas, das KI-Modelle direkt ins Silizium brennt, statt sie auf flexibler Hardware laufen zu lassen. Ein Testchip lieferte Llama 3.1 8B mit 16'960 Token pro Sekunde und Nutzer aus – ein Vielfaches konkurrierender Hardware. Der Preis dafür: Jeder Chip kann nur genau ein Modell.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
9. AUGUST 2026
3 MIN. LESEZEIT
Illustration einer elektroblauen Silizium-Wafer-Scheibe auf einer Werkbank unter einer Lupenlampe, kinewsletter.ch Stil
Illustration einer elektroblauen Silizium-Wafer-Scheibe auf einer Werkbank unter einer Lupenlampe, kinewsletter.ch Stil
INHALT
0116'960 Token pro Sekunde aus einem Chip02Ein neues Modell heisst neuer Chip03Gegenentwurf zur Alleskönner-GPU
INHALT
0116'960 Token pro Sekunde aus einem Chip02Ein neues Modell heisst neuer Chip03Gegenentwurf zur Alleskönner-GPU
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Spezialsilizium macht KI-Inferenz um Grössenordnungen schneller und stromsparender – bezahlt wird das mit dem Verlust jeder Flexibilität.

AMD hat am 6. August 2026 die Übernahme des kanadischen Chip-Startups Taalas angekündigt – einer Firma, die KI-Modelle nicht auf Chips laufen lässt, sondern in sie hineinbrennt. Architektur und trainierte Parameter eines Modells werden fest ins Silizium geätzt. Das macht die Inferenz – also das Ausführen eines fertig trainierten Modells – extrem schnell und stromsparend, legt jeden Chip aber unwiderruflich auf ein einziges Modell fest. Einen Kaufpreis nannte AMD nicht; die Übernahme steht laut Mitteilung unter dem üblichen regulatorischen Vorbehalt.

16'960 Token pro Sekunde aus einem Chip

Taalas wurde 2023 in Toronto gegründet und kam erst im Februar 2026 aus dem Stealth-Modus. Der erste Testchip HC1, bei TSMC im 6-Nanometer-Verfahren gefertigt, lieferte Metas Llama 3.1 8B mit 16'960 Token pro Sekunde und Nutzer aus – laut The Register das 48-Fache der damaligen Nvidia-GPUs und das 8,5-Fache eines Cerebras-Beschleunigers. Taalas selbst rechnet vor, die eigenen Chips seien 20-mal günstiger im Bau als bisherige Beschleuniger und brauchten zehnmal weniger Strom.

Der Kniff steckt in der Architektur: Speicher und Rechenwerk sitzen auf demselben Chip. Der ständige Weg zum externen Speicher entfällt – und mit ihm HBM-Stapel, aufwendiges Packaging und Flüssigkühlung.

Ein neues Modell heisst neuer Chip

Genau hier liegt der Haken. Wer ein Modell einmal in Silizium gegossen hat, sitzt darauf fest. Alles, was über einen kleinen Feinschliff per LoRA-Adapter hinausgeht, verlangt einen neuen Fertigungsdurchlauf – laut Taalas immerhin nur mit zwei geänderten Metalllagen statt einem Neustart bei null. Bei Modellgenerationen im Monatsrhythmus bleibt das eine Wette auf Beständigkeit. Die zweite Chip-Generation HC2 soll bis zu 20 Milliarden Parameter fassen.

Gegenentwurf zur Alleskönner-GPU

AMD will die Technologie in seine Beschleuniger-Roadmap aufnehmen und neben den Instinct-GPUs als Systemlösung anbieten.

«AMD baut eine Full-Stack-KI-Plattform, die Kunden die Flexibilität gibt, für jede KI-Aufgabe die passende Rechenlösung einzusetzen», sagt Vamsi Boppana, Senior Vice President der KI-Sparte von AMD.

Eine GPU ist ein Universalwerkzeug: Sie rechnet jedes Modell, holt dessen Gewichte aber bei jedem einzelnen Token neu aus dem Speicher. Taalas dreht das um – das Modell ist die Hardware. Für dich heisst das mittelfristig vor allem eines: Antworten kommen schneller, und Anbieter können sich längeres «Nachdenken» ihrer Modelle eher leisten, weil das einzelne Token billiger wird. AMD ist mit der Idee nicht allein – Google soll laut Berichten von The Information an einem Chip namens «Frozen v2» arbeiten, der Teile der Gemini-Architektur fest verdrahtet und sechs- bis zehnmal effizienter als heutige TPUs sein soll. Bestätigt ist das nicht.

Quellen

AMD: AMD acquires Taalas to advance compute solutions for AI inference↗ EXTERNER LINKThe Register: AMD acquires AI chip startup Taalas↗ EXTERNER LINKTaalas: The path to ubiquitous AI↗ EXTERNER LINKCNX Software: Taalas HC1 hardwired Llama 3.1 8B accelerator↗ EXTERNER LINKThe Decoder: AMD acquires Taalas, a startup that bakes AI models directly into silicon↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
MetaNvidiaGoogle
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Der KI-Ausbau verschlingt 3,6 Prozent des US-BIP
Der KI-Ausbau verschlingt 3,6 Prozent des US-BIP
Nur für Abonnenten·KI-BUSINESS·25. SEPTEMBER 2026

Der KI-Ausbau verschlingt 3,6 Prozent des US-BIP

Eine neue Brookings-Studie beziffert den US-KI-Infrastrukturausbau auf 3,63 Prozent des jährlichen Bruttoinlandsprodukts – mehr als Eisenbahn, Highways und Telekomausbau je erreichten. Damit sich das refinanziert, müsste die Branche ihren Umsatz bis 2032 um rund 80 Prozent pro Jahr steigern. Ein Columbia-Ökonom zieht dabei einen Vergleich, der aufhorchen lässt.

Oracle ruft höhere Gewalt aus – wegen einer Pipeline
Oracle ruft höhere Gewalt aus – wegen einer Pipeline
KI-BUSINESS·25. SEPTEMBER 2026

Oracle ruft höhere Gewalt aus – wegen einer Pipeline

Oracle hat für sein 165-Milliarden-Dollar-Rechenzentrum "Project Jupiter" in New Mexico eine Force-Majeure-Mitteilung verschickt. Grund ist keine Naturkatastrophe, sondern eine blockierte Erdgas-Pipeline, deren Wegerechte eine Landkommissarin zweimal ablehnte. Oracle und Geldgeber Blue Owl sehen kein Problem, der Markt handelt die Finanzierung skeptischer.

Illustration eines Industrieroboterarms in einer halbleeren Montagehalle mit abgedeckten Maschinen, Werkzeugkasten und Kabeltrommel, kinewsletter.ch Stil
Illustration eines Industrieroboterarms in einer halbleeren Montagehalle mit abgedeckten Maschinen, Werkzeugkasten und Kabeltrommel, kinewsletter.ch Stil
KI-BUSINESS·22. SEPTEMBER 2026

Nur 7'000 humanoide Roboter – die Zahl hinter dem Hype

Die International Federation of Robotics hat humanoide Roboter erstmals als eigene Kategorie gezählt: rund 7'000 Stück wurden 2025 weltweit für Industrie und professionelle Dienstleistungen verkauft. Klassische Industrieroboter kamen 2024 auf 542'000 Installationen. Die Bank of America erwartet für 2026 trotzdem 90'000 Auslieferungen und 1,2 Millionen bis 2030.

Illustration von Silizium-Wafer im Prüfständer mit RAM-Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration von Silizium-Wafer im Pruefstaender mit RAM-Modulen auf einer Werkbank, kinewsletter.ch Stil
KI-BUSINESS·21. SEPTEMBER 2026

Chinas CXMT startet G5-Speicher – und rückt auf Rang vier

ChangXin Memory Technologies startet die fünfte DRAM-Generation. Chinas Speicher rückt auf, während KI-Rechenzentren den weltweiten RAM-Markt leerkaufen.

Skizze einer Wolke mit Zahnrad und Chip, die zu einem eigenen Modell zusammengebaut werden, in Elektroblau, kinewsletter.ch Stil
Skizze einer Wolke mit Zahnrad und Chip, die zu einem eigenen Modell zusammengebaut werden, in Elektroblau, kinewsletter.ch Stil
KI-BUSINESS·16. SEPTEMBER 2026

Salesforce baut sein eigenes KI-Modell – mit Nvidia

Salesforce hat an seiner Hauskonferenz Dreamforce «Koa» vorgestellt, das erste eigene Reasoning-Modell des CRM-Konzerns. Es basiert auf Nvidias offenem Modell Nemotron und ist auf Aufgaben in Vertrieb, Marketing und Kundendienst trainiert. Damit kauft ein Anwendungsanbieter die Denkleistung nicht mehr nur bei OpenAI oder Anthropic ein – er baut sie selbst.

Illustration eines zerlegten Kameraobjektivs mit Linsenelementen auf einer Werkbank, kinewsletter.ch Stil
Illustration eines zerlegten Kameraobjektivs mit Linsenelementen auf einer Werkbank, kinewsletter.ch Stil
KI-BUSINESS·15. SEPTEMBER 2026

OpenAI kauft laut Bericht einen Kamera-Spezialisten

OpenAI übernimmt laut einem Bericht des Wall Street Journal das Kamera-Startup Glass Imaging für über 300 Millionen Dollar. Gegründet wurde es von zwei ehemaligen Apple-Ingenieuren, die einst den Porträtmodus entwickelten. Bestätigt hat den Kauf bisher keines der beiden Unternehmen.

Mehr aus KI-Business →