NewsKategorienWissenNewsletter-ArchivEvents
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarKI-Events SchweizEvent einreichenLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Tencent bringt Hy3: offenes 295-Milliarden-Modell, das über seiner Klasse boxt

Nur 21 Mrd. aktive Parameter, Apache-2.0-Lizenz und Self-Hosting: Tencents neues MoE-Modell zielt auf Effizienz statt Grösse.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
7. JULI 2026
2 MIN. LESEZEIT
Illustration eines offenen Serverschranks an einer Werkbank, kinewsletter.ch Stil
Illustration offener Serverschrank, kinewsletter.ch Stil Dark
INHALT
01Klein gerechnet, gross gedacht02Was Tencent selbst misst03Warum das für Schweizer KMU zählt
INHALT
01Klein gerechnet, gross gedacht02Was Tencent selbst misst03Warum das für Schweizer KMU zählt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Mit Apache-2.0-Lizenz und nur 21 Mrd. aktiven Parametern zielt Tencents Hy3 auf effizientes Self-Hosting – die Benchmark-Zahlen bleiben aber Herstellerangaben.

Tencent hat am 6. Juli 2026 sein KI-Modell Hy3 offiziell veröffentlicht – und zwar mit offenen Gewichten unter der freizügigen Apache-2.0-Lizenz. Das Besondere: Hy3 ist bewusst kein Riese, sondern soll mit vergleichsweise wenig aktiver Rechenlast an deutlich grössere Spitzenmodelle heranreichen.

Klein gerechnet, gross gedacht

Technisch setzt Hy3 auf eine Mixture-of-Experts-Architektur (MoE) – vereinfacht gesagt sind je nach Aufgabe nur einzelne Spezialisten im Netzwerk aktiv, statt immer das gesamte Modell zu rechnen. Von den 295 Milliarden Parametern insgesamt sind pro Anfrage nur 21 Milliarden aktiv (plus eine 3,8-Milliarden-Zusatzschicht). Dazu kommt ein Kontextfenster von bis zu 256'000 Token und ein hybrider «fast/slow thinking»-Modus, bei dem sich die Tiefe des Nachdenkens je nach Aufgabe umschalten lässt.

Genau diese Effizienz ist der Verkaufsgrund: Laut Tencent erreicht Hy3 eine «Intelligenz vergleichbar mit Flaggschiff-Modellen, die das Zwei- bis Fünffache an Parametern» mitbringen. Das sind Herstellerangaben – unabhängige Messungen stehen noch aus.

Was Tencent selbst misst

Die von Tencent genannten Zahlen sind einzuordnen, nicht als gesetzte Fakten zu lesen. In einem eigenen Blindtest mit 270 Fachleuten (312 gültige Vergleiche) kam Hy3 auf 2,67 von 4 Punkten und lag damit vor dem Konkurrenten GLM-5.1 (2,51). Die intern gemessene Halluzinationsrate sank nach Firmenangaben von 12,5 auf 5,4 Prozent. Fachmedien wie The Decoder und WinBuzzer bestätigen diese Werte – allerdings jeweils gestützt auf Tencents eigene Angaben.

Hy3 reiht sich ein in eine kräftige Welle offener chinesischer Modelle, die zuletzt mit LongCat-2 und der GLM-5-Reihe für Bewegung sorgte. Positioniert wird Hy3 klar gegen grössere offene Flaggschiffe – GLM-5.1 etwa bringt 744 Milliarden Parameter mit.

Warum das für Schweizer KMU zählt

Für dich als Entwickler oder KMU ist weniger der Benchmark-Wettlauf interessant als die Lizenz. Apache 2.0 heisst: herunterladen, anpassen, kommerziell einsetzen – ohne Nutzungshürden. Das Modell liegt auf Hugging Face, ModelScope und GitHub bereit, inklusive einer FP8-Variante und einer zweiwöchigen Gratis-API unter anderem über OpenRouter. Wer Daten im Haus behalten will, kann Hy3 selbst hosten statt sie in eine fremde Cloud zu schicken – und spart bei genügend Volumen gegenüber den grossen proprietären Anbietern. Der Haken bleibt die Hardware: 295 Milliarden Parameter brauchen ernsthafte GPU-Ausstattung, auch wenn nur ein Bruchteil aktiv rechnet.

Quellen

Tencent Hunyuan Officially Releases Hy3, Advancing Agent Capabilities and Deeper Product Integration (Tencent)↗ EXTERNER LINKtencent/Hy3 - Hugging Face (Modellkarte, Apache-2.0)↗ EXTERNER LINKTencent-Hunyuan/Hy3 - GitHub↗ EXTERNER LINKTencent releases Hy3 open-source model that allegedly matches models up to five times its active size (The Decoder)↗ EXTERNER LINKTencent Releases Hy3, a Smaller Model Approaching Larger Flagship Performance (WinBuzzer)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
Hugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
Handgezeichnete Skizze eines grossen aufgeschlagenen Buchs auf einem Lesepult mit blauem Akzent, daneben Kisten mit Ordnern
NEUE MODELLE·6. OKTOBER 2026

Reflection AI zeigt Beam, offenes Modell gegen China

Das US-Start-up Reflection AI stellt Beam vor, ein Modell mit offenen Gewichten und 501 Milliarden Parametern. Es soll chinesischen Modellen mit deutlich weniger Rechenaufwand Konkurrenz machen. Alle Zahlen sind Herstellerangaben, die Gewichte folgen im Oktober.

Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt; die Maske ist leuchtend blau.
Tuschezeichnung einer Marionettenbühne: Hinter einem leeren Bildschirmrahmen halten zwei Hände ein Spielkreuz, an dessen Fäden eine Maske hängt
NEUE MODELLE·3. OKTOBER 2026

Tavus: Fast jeder Zweite hält KI-Avatar Griffin für echt

Das US-Startup Tavus meldet, dass 48 Prozent der Testpersonen seinen KI-Videoavatar Griffin nach einer Minute für einen Menschen hielten. Die Zahl stammt vom Hersteller, die Stichprobe war mit 54 Personen klein. Für die Schweiz ist sie trotzdem ein Warnsignal, weil Betrüger Video-Fälschungen bisher selten, Stimmklone dafür umso öfter einsetzen.

Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
Handgezeichnete Skizze eines grossen blauen Schilds mit Schlüsselloch und Schaltkreisen vor Server-Racks, daneben eine Lupe über Code mit einem Käfer
NEUE MODELLE·1. OKTOBER 2026

Gemini 4 Argon: Google startet bei den Cyber-Verteidigern

Google stellt Gemini 4 Argon vor, zunächst nur für ausgewählte Cybersecurity-Organisationen im Fairwind-Programm. Laut Google findet und patcht das Modell kritische Schwachstellen selbstständig. Wir ordnen Zahlen, Bloomberg-Zweifel und den Schweiz-Bezug ein.

Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
Tuschezeichnung einer Balkenwaage: links fünf kleine Münzen, rechts ein grosses elektroblaues sonnenförmiges Gewicht
NEUE MODELLE·30. SEPTEMBER 2026

GPT-6.1 Sol: fast Astra-Niveau zu einem Fünftel des Preises

OpenAI hat am DevDay GPT-6.1 Sol vorgestellt: laut Hersteller fast auf Astra-Niveau, aber für 2 statt 10 Dollar pro Million Eingabe-Tokens. Die Fehlerrate sinkt gegenüber GPT-6 Sol von 11,4 auf 7,7 Prozent. Verfügbar in ChatGPT Work, Codex und API, nicht im normalen Chat.

Handgezeichnete Skizze einer grossen blauen Stoppuhr neben einem Münzstapel und Zahnrädern, dahinter Tempo-Linien
Handgezeichnete Skizze einer grossen blauen Stoppuhr neben einem Münzstapel und Zahnrädern, dahinter Tempo-Linien
NEUE MODELLE·29. SEPTEMBER 2026

Sonnet 5.5: 30 % schneller zum gleichen Preis wie Sonnet 5

Anthropic bringt Claude Sonnet 5.5: mehr als 30 % schneller und laut Anthropic bis zu 30 % günstiger pro Aufgabe, bei unverändertem Token-Preis. Auf mehreren Benchmarks liegt es nur knapp hinter Opus 5.5. Wir zeigen, wo der Haken liegt und wann sich der Wechsel lohnt.

Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
Illustration einer geöffneten Enigma-Chiffriermaschine auf einem Holzschreibtisch mit freiliegenden Rotoren, leeren Papierbögen und einer Schreibtischlampe, kinewsletter.ch Stil
KI-FORSCHUNG·27. SEPTEMBER 2026

GPT-6 Astra knackt Enigma-Funkspruch von 1941 – in zwei Tagen

OpenAIs GPT-6 Astra hat einen deutschen Heeres-Funkspruch vom 10. Juli 1941 entschlüsselt, der seit 2005 als ungelöst galt. Das Modell suchte sich das Ziel selbst aus und schrieb Enigma-Simulator und Enigma-Bombe eigenständig in Python und C++. Dieselbe Autonomie ist der Grund, weshalb OpenAI seine leistungsfähigsten Modelle gerade gestoppt hat.

Mehr aus Neue Modelle →