NewsKategorienNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Tencent bringt Hy3: offenes 295-Milliarden-Modell, das über seiner Klasse boxt

Nur 21 Mrd. aktive Parameter, Apache-2.0-Lizenz und Self-Hosting: Tencents neues MoE-Modell zielt auf Effizienz statt Grösse.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
7. JULI 2026
2 MIN. LESEZEIT
Illustration eines offenen Serverschranks an einer Werkbank, kinewsletter.ch Stil
Illustration offener Serverschrank, kinewsletter.ch Stil Dark
INHALT
01Klein gerechnet, gross gedacht02Was Tencent selbst misst03Warum das für Schweizer KMU zählt
INHALT
01Klein gerechnet, gross gedacht02Was Tencent selbst misst03Warum das für Schweizer KMU zählt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Mit Apache-2.0-Lizenz und nur 21 Mrd. aktiven Parametern zielt Tencents Hy3 auf effizientes Self-Hosting – die Benchmark-Zahlen bleiben aber Herstellerangaben.

Tencent hat am 6. Juli 2026 sein KI-Modell Hy3 offiziell veröffentlicht – und zwar mit offenen Gewichten unter der freizügigen Apache-2.0-Lizenz. Das Besondere: Hy3 ist bewusst kein Riese, sondern soll mit vergleichsweise wenig aktiver Rechenlast an deutlich grössere Spitzenmodelle heranreichen.

Klein gerechnet, gross gedacht

Technisch setzt Hy3 auf eine Mixture-of-Experts-Architektur (MoE) – vereinfacht gesagt sind je nach Aufgabe nur einzelne Spezialisten im Netzwerk aktiv, statt immer das gesamte Modell zu rechnen. Von den 295 Milliarden Parametern insgesamt sind pro Anfrage nur 21 Milliarden aktiv (plus eine 3,8-Milliarden-Zusatzschicht). Dazu kommt ein Kontextfenster von bis zu 256'000 Token und ein hybrider «fast/slow thinking»-Modus, bei dem sich die Tiefe des Nachdenkens je nach Aufgabe umschalten lässt.

Genau diese Effizienz ist der Verkaufsgrund: Laut Tencent erreicht Hy3 eine «Intelligenz vergleichbar mit Flaggschiff-Modellen, die das Zwei- bis Fünffache an Parametern» mitbringen. Das sind Herstellerangaben – unabhängige Messungen stehen noch aus.

Was Tencent selbst misst

Die von Tencent genannten Zahlen sind einzuordnen, nicht als gesetzte Fakten zu lesen. In einem eigenen Blindtest mit 270 Fachleuten (312 gültige Vergleiche) kam Hy3 auf 2,67 von 4 Punkten und lag damit vor dem Konkurrenten GLM-5.1 (2,51). Die intern gemessene Halluzinationsrate sank nach Firmenangaben von 12,5 auf 5,4 Prozent. Fachmedien wie The Decoder und WinBuzzer bestätigen diese Werte – allerdings jeweils gestützt auf Tencents eigene Angaben.

Hy3 reiht sich ein in eine kräftige Welle offener chinesischer Modelle, die zuletzt mit LongCat-2 und der GLM-5-Reihe für Bewegung sorgte. Positioniert wird Hy3 klar gegen grössere offene Flaggschiffe – GLM-5.1 etwa bringt 744 Milliarden Parameter mit.

Warum das für Schweizer KMU zählt

Für dich als Entwickler oder KMU ist weniger der Benchmark-Wettlauf interessant als die Lizenz. Apache 2.0 heisst: herunterladen, anpassen, kommerziell einsetzen – ohne Nutzungshürden. Das Modell liegt auf Hugging Face, ModelScope und GitHub bereit, inklusive einer FP8-Variante und einer zweiwöchigen Gratis-API unter anderem über OpenRouter. Wer Daten im Haus behalten will, kann Hy3 selbst hosten statt sie in eine fremde Cloud zu schicken – und spart bei genügend Volumen gegenüber den grossen proprietären Anbietern. Der Haken bleibt die Hardware: 295 Milliarden Parameter brauchen ernsthafte GPU-Ausstattung, auch wenn nur ein Bruchteil aktiv rechnet.

Quellen

Tencent Hunyuan Officially Releases Hy3, Advancing Agent Capabilities and Deeper Product Integration (Tencent)↗ EXTERNER LINKtencent/Hy3 - Hugging Face (Modellkarte, Apache-2.0)↗ EXTERNER LINKTencent-Hunyuan/Hy3 - GitHub↗ EXTERNER LINKTencent releases Hy3 open-source model that allegedly matches models up to five times its active size (The Decoder)↗ EXTERNER LINKTencent Releases Hy3, a Smaller Model Approaching Larger Flagship Performance (WinBuzzer)↗ EXTERNER LINK
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Freitag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
Illustration eines Tintenfasses mit Füllfederhalter, Bauplänen und Zirkel auf einem Zeichentisch, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Muratis erstes Modell ist offen – und bewusst nicht das beste

Thinking Machines Lab veröffentlicht Inkling: 975 Milliarden Parameter, offene Gewichte. Laut der Firma bewusst nicht das stärkste Modell – sondern ein Rohling zum Feintunen.

Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
Illustration einer riesigen kreisförmigen Maschine in einer Werkhalle, mit einer winzigen Person auf dem Laufsteg als Grössenvergleich, kinewsletter.ch Stil
NEUE MODELLE·17. JULI 2026

Kimi K3 erreicht Frontier-Niveau – und beendet die Billig-Ära

Moonshot AI hat Kimi K3 vorgestellt: 2,8 Billionen Parameter, eine Million Token Kontext, offene Gewichte ab dem 27. Juli. Das Modell spielt auf Augenhöhe mit den besten US-Systemen – und kostet dreimal so viel wie sein Vorgänger. Die Zeit der chinesischen Kampfpreise ist damit vorbei.

Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent
Handgezeichnete Skizze: drei Tueren zunehmender Groesse in einem Werkstattflur, jede mit einem leeren Preisschild am Griff, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·10. JULI 2026

GPT-5.6 für alle: OpenAI bringt drei Modelle zu drei Preisen

Seit dem 9. Juli ist OpenAIs neue Generation GPT-5.6 öffentlich verfügbar – in drei Stufen namens Sol, Terra und Luna, deren Preise von 1 bis 30 Dollar pro Million Token reichen. Zuvor hatte eine staatliche Sicherheitsprüfung die Freigabe wochenlang verzögert.

Skizze zu Grok 4.5 von SpaceXAI, kinewsletter.ch Stil
Skizze zu Grok 4.5 von SpaceXAI, kinewsletter.ch Stil (dark)
NEUE MODELLE·9. JULI 2026

Grok 4.5: SpaceXAIs günstiger Angriff auf Claude Opus

SpaceXAI hat Grok 4.5 veröffentlicht – ein «Opus-class model» für Coding und agentische Aufgaben, das beim Output rund viermal günstiger ist als Claude Opus 4.8. Die Leistungsvergleiche stammen allerdings aus xAI-eigenen Benchmarks, und selbst dort liegt Grok nicht an der Spitze.

Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent
Handgezeichnete Skizze eines Studiomikrofons mit Lautsprecher, Schallwellen und einer Stoppuhr, mit elektroblauem Akzent (Dark Mode)
NEUE MODELLE·7. JULI 2026

OpenAIs neue Sprachmodelle antworten schneller – und eines wird günstiger

OpenAI hat zwei neue Realtime-Sprachmodelle veröffentlicht: gpt-realtime-2.1 und die günstigere Mini-Variante. Beide reagieren dank besserem Caching mindestens 25 Prozent schneller – die Technik hinter Sprachassistenten und Telefon-Bots wird flüssiger und billiger.

Illustration: Person am Schreibtisch, der Monitor schaltet sich wieder ein und ein Papierflieger kehrt durchs Fenster zurück – kinewsletter.ch Stil
Illustration Dark Mode: Person am Schreibtisch, Monitor schaltet sich wieder ein – kinewsletter.ch Stil
KI-TOOLS & APPS·2. JULI 2026

Claude Fable 5 ist zurück – mit Gratis-Woche und Benchmark-Sieg

Nach drei Wochen Zwangspause ist Anthropics stärkstes Modell wieder online – bis zum 7. Juli sogar gratis. Und ein neuer Benchmark zeigt, warum das mehr ist als ein Software-Update.

Mehr aus Neue Modelle →