NewsKategorienWissenNewsletter-ArchivÜber uns
AnmeldenKostenlos abonnieren
JEDEN MONTAG
Die wichtigsten KI-News der Woche — in 5 Minuten.

Der wöchentliche KI-Newsletter für die Schweiz. Kompakt, relevant, zero Bullshit. 5 Minuten lesen, 1 Woche informiert.

FOLGE UNS
LIXIG
NAVIGATION
KI NewsArchivNewsletter-ArchivAutorenÜber unsKontakt
KATEGORIEN
KI-ForschungKI-BusinessRegulierung & EthikKI in der SchweizKI-Tools & AppsNeue Modelle
WISSEN & REFERENZ
KI-GlossarLLM-VergleichSchweizer KI-StartupsFirmen & OrganisationenKI-Regulierung SchweizKI-Rechenzentren SchweizKI in der VerwaltungApertus in der Praxis
RECHTLICHES
ImpressumDatenschutzAGB
© 2026 Inoo GmbH · Altstätten SG · Schweiz
Ein Produkt von InooSwiss Made Software
HOME·NEWS·NEUE MODELLE

Tencent bringt Hy3: offenes 295-Milliarden-Modell, das über seiner Klasse boxt

Nur 21 Mrd. aktive Parameter, Apache-2.0-Lizenz und Self-Hosting: Tencents neues MoE-Modell zielt auf Effizienz statt Grösse.

Pascal Eugster
Pascal Eugster
GRÜNDER & ENTWICKLER
7. JULI 2026
2 MIN. LESEZEIT
Illustration eines offenen Serverschranks an einer Werkbank, kinewsletter.ch Stil
Illustration offener Serverschrank, kinewsletter.ch Stil Dark
INHALT
01Klein gerechnet, gross gedacht02Was Tencent selbst misst03Warum das für Schweizer KMU zählt
INHALT
01Klein gerechnet, gross gedacht02Was Tencent selbst misst03Warum das für Schweizer KMU zählt
in
PARTNER · INOO GMBH
Wie viel KI verträgt dein Betrieb? In 30 Minuten Klartext.

Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.

Gespräch buchen →
DAS WICHTIGSTE IN KÜRZE

Mit Apache-2.0-Lizenz und nur 21 Mrd. aktiven Parametern zielt Tencents Hy3 auf effizientes Self-Hosting – die Benchmark-Zahlen bleiben aber Herstellerangaben.

Tencent hat am 6. Juli 2026 sein KI-Modell Hy3 offiziell veröffentlicht – und zwar mit offenen Gewichten unter der freizügigen Apache-2.0-Lizenz. Das Besondere: Hy3 ist bewusst kein Riese, sondern soll mit vergleichsweise wenig aktiver Rechenlast an deutlich grössere Spitzenmodelle heranreichen.

Klein gerechnet, gross gedacht

Technisch setzt Hy3 auf eine Mixture-of-Experts-Architektur (MoE) – vereinfacht gesagt sind je nach Aufgabe nur einzelne Spezialisten im Netzwerk aktiv, statt immer das gesamte Modell zu rechnen. Von den 295 Milliarden Parametern insgesamt sind pro Anfrage nur 21 Milliarden aktiv (plus eine 3,8-Milliarden-Zusatzschicht). Dazu kommt ein Kontextfenster von bis zu 256'000 Token und ein hybrider «fast/slow thinking»-Modus, bei dem sich die Tiefe des Nachdenkens je nach Aufgabe umschalten lässt.

Genau diese Effizienz ist der Verkaufsgrund: Laut Tencent erreicht Hy3 eine «Intelligenz vergleichbar mit Flaggschiff-Modellen, die das Zwei- bis Fünffache an Parametern» mitbringen. Das sind Herstellerangaben – unabhängige Messungen stehen noch aus.

Was Tencent selbst misst

Die von Tencent genannten Zahlen sind einzuordnen, nicht als gesetzte Fakten zu lesen. In einem eigenen Blindtest mit 270 Fachleuten (312 gültige Vergleiche) kam Hy3 auf 2,67 von 4 Punkten und lag damit vor dem Konkurrenten GLM-5.1 (2,51). Die intern gemessene Halluzinationsrate sank nach Firmenangaben von 12,5 auf 5,4 Prozent. Fachmedien wie The Decoder und WinBuzzer bestätigen diese Werte – allerdings jeweils gestützt auf Tencents eigene Angaben.

Hy3 reiht sich ein in eine kräftige Welle offener chinesischer Modelle, die zuletzt mit LongCat-2 und der GLM-5-Reihe für Bewegung sorgte. Positioniert wird Hy3 klar gegen grössere offene Flaggschiffe – GLM-5.1 etwa bringt 744 Milliarden Parameter mit.

Warum das für Schweizer KMU zählt

Für dich als Entwickler oder KMU ist weniger der Benchmark-Wettlauf interessant als die Lizenz. Apache 2.0 heisst: herunterladen, anpassen, kommerziell einsetzen – ohne Nutzungshürden. Das Modell liegt auf Hugging Face, ModelScope und GitHub bereit, inklusive einer FP8-Variante und einer zweiwöchigen Gratis-API unter anderem über OpenRouter. Wer Daten im Haus behalten will, kann Hy3 selbst hosten statt sie in eine fremde Cloud zu schicken – und spart bei genügend Volumen gegenüber den grossen proprietären Anbietern. Der Haken bleibt die Hardware: 295 Milliarden Parameter brauchen ernsthafte GPU-Ausstattung, auch wenn nur ein Bruchteil aktiv rechnet.

Quellen

Tencent Hunyuan Officially Releases Hy3, Advancing Agent Capabilities and Deeper Product Integration (Tencent)↗ EXTERNER LINKtencent/Hy3 - Hugging Face (Modellkarte, Apache-2.0)↗ EXTERNER LINKTencent-Hunyuan/Hy3 - GitHub↗ EXTERNER LINKTencent releases Hy3 open-source model that allegedly matches models up to five times its active size (The Decoder)↗ EXTERNER LINKTencent Releases Hy3, a Smaller Model Approaching Larger Flagship Performance (WinBuzzer)↗ EXTERNER LINK
FIRMEN IN DIESEM ARTIKEL
Hugging Face
TEILEN
LinkedIn→X / Twitter→E-Mail→
KOSTENLOS ABONNIEREN
Diese News jeden Montag in dein Postfach?

WEITERLESENDas könnte dich auch interessieren.

Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
Handgezeichnete Skizze einer grossen runden Glaslinse in Elektroblau auf einem Messingstativ auf einer Holzwerkbank, daneben ein kleiner Schrank mit Vorhängeschloss und drei lose Linsen in einer Metallschale, kinewsletter.ch Stil
NEUE MODELLE·22. AUGUST 2026

DeepSeek gibt Flash Augen – und behält diesmal die Gewichte

DeepSeek hat sein günstiges V4-Flash um Bildverständnis erweitert – zum identischen Preis, ohne Aufschlag. Laut DeepSeeks eigener Tabelle kommt das experimentelle Modell nahe an Claude Opus 4.8 heran und schlägt es auf drei von elf Benchmarks. Zwei Details fehlen in den Schlagzeilen: Jedes Bild wird auf 0,64 Megapixel eingedampft – und die Gewichte veröffentlicht DeepSeek diesmal nicht.

Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
Illustration einer geöffneten Tresortür mit Serverracks dahinter, kinewsletter.ch Stil
NEUE MODELLE·16. AUGUST 2026

Qwen3.8 ist offen – Apache 2.0 aber nur für das kleine Modell

Alibabas Qwen-Team hat die Gewichte von Qwen3.8 freigegeben. Apache 2.0 gilt aber nur fürs 27B-Modell – beim Max steht Kleingedrucktes im Lizenztext.

Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Schaltwand mit austauschbaren blauen Modulen auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

DeepSeek verschenkt seine Agenten-Software – und versechsfacht die Cache-Preise

DeepSeek hat gleich dreifach geliefert: Das Flaggschiff V4-Pro verlässt mit Build 0813 die Testphase, die hauseigene Agenten-Software Harness erscheint unter MIT-Lizenz – und ab Sonntagabend steigen die API-Preise. Am stärksten trifft es ausgerechnet die Cache-Hits, von denen Coding-Agenten leben.

Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
Illustration einer Stoppuhr mit blauem Gehäuse und einem Messschieber auf einer Werkbank, kinewsletter.ch Stil
NEUE MODELLE·14. AUGUST 2026

Gemini 3.7 Flash: drei Wochen nach 3.6, halber Preis

Google hat Gemini 3.7 Flash veröffentlicht – nur drei Wochen nach dem Vorgänger und zum halben Einführungspreis. Beim Programmieren legt das Modell deutlich zu, bei Agenten-Benchmarks bleibt GPT-5.6 Terra vorn. Und der Consumer-Agent Gemini Spark, der ab sofort auf 3.7 Flash läuft, ist in der Schweiz gar nicht verfügbar.

Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
Handgezeichnete Illustration: eine einzelne Grafikkarte auf einem Schreibtisch, aus der ein Blitz und schnelle Linien schiessen – kinewsletter.ch Stil
NEUE MODELLE·12. AUGUST 2026

Nvidias schnellstes offenes Modell läuft auf einer einzigen GPU

Nemotron 3.5 Lightning erreicht bei Artificial Analysis dieselbe Punktzahl wie OpenAIs gpt-oss-120b – mit einem Viertel der Parameter und dem höchsten gemessenen Tempo unter 134 Modellen. Laut Modellsteckbrief genügt eine einzige H100 oder ein DGX Spark. Für Schweizer Firmen, die Daten im Haus behalten müssen, ist genau das die interessante Zahl.

Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
Illustration einer offenen Tresortür mit Schlüsselbund am Haken, kinewsletter.ch Stil
NEUE MODELLE·11. AUGUST 2026

OpenAI gibt GPT-5.6-Cyber frei – nur für geprüfte Verteidiger

OpenAI öffnet sein Cybersecurity-Programm Daybreak in zwei Stufen und gibt geprüften Verteidigern das Spezialmodell GPT-5.6-Cyber. Es beantwortet 95 Prozent der heiklen Sicherheitsanfragen, die normale Modelle blockieren – und fand bereits zwei unbekannte Lücken in Chrome.

Mehr aus Neue Modelle →