Das US-Startup Tavus meldet, dass 48 Prozent der Testpersonen seinen KI-Videoavatar Griffin nach einer Minute für einen Menschen hielten. Die Zahl stammt vom Hersteller, die Stichprobe war mit 54 Personen klein. Für die Schweiz ist sie trotzdem ein Warnsignal, weil Betrüger Video-Fälschungen bisher selten, Stimmklone dafür umso öfter einsetzen.
Kostenloses Erstgespräch — herstellerneutral, direkt aus dem Rheintal.
Tavus behauptet, 26 von 54 Testpersonen hätten Griffin in einem einminütigen Videocall für einen Menschen gehalten (Vorgänger: 1 von 41). Die Studie stammt vom Hersteller und ist nicht unabhängig repliziert – als Warnung vor Echtzeit-Deepfakes taugt sie trotzdem.
Das US-Startup Tavus hat am 1. Oktober 2026 «Griffin» vorgestellt, ein KI-Modell, das in Videocalls Mimik, Stimme und Gestik live verarbeitet. Laut Tavus hielten 48 Prozent der Testpersonen den Avatar nach einer Minute für einen echten Menschen; beim Vorgänger Phoenix-4.5 war es nur einer von 41 (2,4 Prozent). Die Zahlen stammen vom Hersteller und wurden bisher nicht unabhängig überprüft.
Laut Runtime Wire und Tavus' eigener Produktseite lief der Test so: 54 Personen aus den USA und Europa, rekrutiert über eine Forschungsplattform, wurde gesagt, sie würden mit einem anderen Menschen über ihre Jahrespläne sprechen. Tatsächlich sprachen sie eine Minute lang mit Griffin-Lite, einer abgespeckten Version, und wurden erst danach gefragt, ob ihr Gegenüber echt war. 26 von 54 sagten Ja.
Drei Vorbehalte gehören dazu:
Dazu kommt Nvidias Benchmark für «Full-Duplex»-Video (die KI hört und spricht gleichzeitig und kann unterbrechen oder lachen): Griffin erreicht laut 3,83 von 5 Punkten, der Mensch als Referenz 3,92, das beste frühere KI-System 2,80.
Griffin-Lite ist eine Forschungsvorschau für ausgewählte Tester. Vor einer breiten Freigabe will Tavus Offenlegungsfunktionen und Sicherheitsverfahren einführen. Kritiker warnen laut Protos vor Betrug und Täuschung, etwa in Bewerbungsgesprächen.
Das Bundesamt für Cybersicherheit (BACS) zählte für 2025 971 Meldungen zu CEO-Betrug, nach 719 im Jahr davor. Meist kommen dabei geklonte Stimmen zum Einsatz; manipulierte Videokonferenzen sind laut BACS seltener. Laut Netzwoche basieren Video-Deepfakes heute oft noch auf Standbildern, Echtzeit-Fälschungen gelten als nächste Stufe. Wie so ein Fall aussieht, zeigt unser Bericht über die geklonte Stimme bei Fideuram. Auch Google baut sprechende Gesichter: Live Avatar.
Das BACS rät:
Einordnung: Wenn fast die Hälfte einen Avatar nicht erkennt, hilft Bauchgefühl allein nicht. Verlass dich auf Abläufe wie den Rückruf, nicht auf den Eindruck im Bild.
Google stellt Gemini 4 Argon vor, zunächst nur für ausgewählte Cybersecurity-Organisationen im Fairwind-Programm. Laut Google findet und patcht das Modell kritische Schwachstellen selbstständig. Wir ordnen Zahlen, Bloomberg-Zweifel und den Schweiz-Bezug ein.