Tavus' Griffin: Ett minutts samtale overbeviste nesten halvparten av deltakerne om at de snakket med et menneske
Det sanfransiskolaboratoriet Tavus lanserte 1. oktober 2026 videoavataren Griffin og hevdet at den er den første modellen som består en «video-Turingtest». Grunnlaget: en studie drevet av selskapet selv, der 26 av 54 deltakere (48 %) etter ett minutts videosamtale trodde de hadde snakket med et ekte menneske. Påstanden har fått stor oppmerksomhet – og umiddelbar motreaksjon fra forskere, enCommunity Note på X og kritikk fra tidligere kongressmedlem Tom Malinowski. Foreløpig er tilgangen begrenset til en Griffin-Lite forskningsforhåndsvisning, uten full offentlig utrulling.
Hva selskapet hevder
Tavus omtaler Griffin som «verdens første Human Interaction Model», en betegnelse som er selskapets egen. Bak kunngjøringen står administrerende direktør Hassaan Raza og forskningssjef Ioannis Patras, ifølge Cryptobriefing.
Tallet som har festet seg i dekningen, er 48 prosent: I Tavus' egen studie trodde 26 av 54 deltakere at Griffin-Lite var et menneske etter ett minutt. Til sammenligning klarte selskapets forrige system, Phoenix-4.5, under samme protokoll å overbevise bare 1 av 41 deltakere – 2,4 prosent, ifølge UkrMedia. Spranget er slående, men all dokumentasjonen stammer fra selskapet, og resultatet er ikke uavhengig verifisert.
Hvordan Griffin fungerer
Teknisk sett beskriver Tavus Griffin som en full-dupleks video-til-video-modell. Det betyr at modellen fortsetter å se og høre brukeren mens den selv svarer – i motsetning til turbaserte systemer som venter til motparten er ferdig. Dette muliggjør avbrytelser, pauser og umiddelbar reaksjon når den ene parten kutter den andre, noe som er sentralt i naturlig samtaleatferd.
Ifølge Cryptobriefing bygger Griffin på Tavus' eksisterende PAL-plattform, som angivelig er brukt av mer enn 150 000 utviklere og bedrifter – også det et selskapsutsagn. Selskapet sier videre at Griffin slår sammen Phoenix- og Raven-modellene, og at den slo det nest beste publiserte systemet med 37 prosent i sanntids reaksjonsmetrikker.
Benchmark-tallene
Utover studien viser Tavus til NVIDIAs VideoFDB-benchmark, som bygger på 237 klipp fra ekte videosamtaler og dekker 11 typer samtaleatferd. Resultatene slik de er rapportert:
- Persepsjon: Griffin fikk 3,73 av 5, mot et menneskelig referanseparen på 4,20.
- Audiovisuell responsgenerering: Griffin fikk 3,83, mot 3,92 for ekte mennesker – mens det nest beste systemet på listen scoret bare 2,80, ifølge Dainik Jagran/MSN.
Avstanden til mennesket i genereringstesten (0,09 poeng) og til det nest beste systemet (over ett poeng) er kjerneargumentet i Tavus' fremstilling av Griffin som et kvalitativt sprang. Men også disse tallene er rapportert gjennom selskapets egne utsagn og sekundær dekning – det finnes ingen offentlig teknisk rapport som kan kontrolleres.
Hvorfor dokumentasjonen er svak
PCMag, som dekket saken 8. oktober 2026, peker på flere problemer. Resultatet er «ennå ikke uavhengig verifisert», og videosamtalene var bare ett minutt lange – deltakerne fikk altså liten tid til å oppdage at de snakket med en AI-generert person. Det finnes dessuten ingen anerkjent standard for en «video-Turingtest»; definisjonen av hva det vil si å «bestå» er Tavus' egen. Demovideoen på X fikk en Community Note som sette spørsmål ved påstanden.
PCMag bemerker også demofunksjoner som puster og øye- og munnbevegelser, noe som peker mot artefakter – en forsiktigere beskrivelse enn de mer ukritiske gjenfortellingene som hevder demoen var uten feil.
Motreaksjonen: krav om obligatorisk avsløring
Utrullingen har utløst rask kritikk. Tidligere demokratisk kongressmedlem fra New Jersey, Tom Malinowski, skrev ifølge PCMag:
«Det burde være ulovlig – rent og enkelt – for enhver AI å utgi seg for å være et menneske uten en tydelig og synlig merknad om at det faktisk er AI.»
Forskere har på lignende måte argumentert for at teknologien er uetisk uten klar AI-avsløring, med henvisning til risiko for svindel og impersonering – risikoer som blir mer konkrete når en avatar i videosamtale oppfattes som menneske av nesten halvparten av deltakerne, selv i kort format.
Tavus' svar
I en uttalelse på X, gjengitt av PCMag og dermed merket som selskapets eget utsagn, skrev Raza: «Vi jobber med partnere om verner og systemer for avsløring, samt inviterer til diskusjoner med myndigheter rundt bredere regulering og trygg bruk.» Han la til at «folk vil alltid vite at de samhandler med AI», samtidig som systemet gir et grensesnitt som fjerner behovet for å «snakke data».
Tavus har ifølge PCMag planlagt bruksområder innen utdanning og helse, for arbeid med «lav tilgang eller høy kostnad». Selskapet har utsatt en full lansering til sikkerhetsarbeidet er ferdig.
Hva som forblir uavklart
Flere sentrale spørsmål står åpne. Det finnes ingen offentlig teknisk dokumentasjon eller studiepublikasjon som gjør det mulig å kontrollere studiedesign, deltakerrekruttering eller benchmark-resultater uavhengig. Tidslinjen for vern og avsløringssystemer er uspesifisert, og det samme er tidspunktet for en full offentlig utrulling – bare Griffin-Lite forskningsforhåndsvisning er tilgjengelig så langt.
Foreløpig er det dokumenterte: 48 prosent i en liten, selskapsdrevet studie med ett-minutts samtaler, benchmark-tall som ikke kan verifiseres uavhengig, og en pågående debatt om hvorvidt uavslørt AI-impersonering i videosamtaler bør være lov i det hele tatt.

