W skrócie

  • Tavus twierdzi, że 26 z 54 uczestników (48%) uznało Griffin-Lite za prawdziwą osobę po jednominutowej rozmowie wideo, w porównaniu z 1 z 41 w przypadku jego poprzedniego systemu.
  • Griffin-Lite zajmuje pierwsze miejsce w benchmarku VideoFDB firmy Nvidia, uzyskując 3,83 na 5 punktów w zakresie generowania w porównaniu z 2,80 dla drugiego najlepszego systemu i 3,92 dla odniesienia ludzkiego.
  • Wyniki pochodzą z własnej strony badawczej Tavus, uczestnikom powiedziano, że spotkają inną osobę, a Griffin-Lite jest ograniczony do wybranych zaufanych testerów, podczas gdy Tavus pracuje nad środkami bezpieczeństwa.

Startup AI Tavus twierdzi, że jego nowy model, Griffin, przekonał 48% osób, które rozmawiały z nim podczas rozmowy wideo na żywo, że rozmawiają z prawdziwym człowiekiem.

Firma zaprezentowała go 1 października i nazywa go pierwszym Modelem Interakcji Człowieka, AI zbudowaną do rozumienia i generowania rozmowy twarzą w twarz, zwracającą uwagę na wyraz twarzy i pauzy, a także słowa. Jej poprzedni system uzyskał 2,4% w tym samym teście.

Myriad: How high will Nvidia go? Click to make your prediction.
Myriad: Jak wysoko pójdzie Nvidia? Kliknij, aby dokonać prognozy.

Griffin-Lite, wersja testowana przez Tavus, stanęła przed 54 osobami, a 26 z nich powiedziało później, że wierzyło, iż ich rozmówca był prawdziwą osobą. Starszy system stanął przed 41 osobami i zdobył dokładnie jednego zwolennika.

Tavus wyjaśnia, że uczestnikom powiedziano, że zostaną dopasowani do innej osoby na jednominutową rozmowę wideo o tym, na co czekają w tym roku. Dopiero na końcu zapytano ich, czy przyszło im do głowy, że ich rozmówca może nie być prawdziwy.

To nie jest klasyczny test Turinga, zaproponowany w 1950 roku przez brytyjskiego matematyka Alana Turinga, w którym sędzia rozmawia z ukrytym człowiekiem i ukrytą maszyną i musi rozpoznać, który jest który. Nikomu podczas rozmowy nie powiedziano, że po drugiej stronie może być bot.

Wyniki pochodzą ze strony badawczej samego Tavus, a uczestnicy zostali zrekrutowani przez to, co nazywa niezależną platformą badawczą. Notatka społeczności na X już wskazała, że wyniki nie są niezależnie zweryfikowane i nie są zgodne ze standardowym protokołem. Tavus twierdzi, że osoby, które nabrały podejrzeń, zwykle robiły to w ciągu 20 sekund.

Firmy AI dążące do tego od jakiegoś czasu. Badanie UC San Diego wykazało, że GPT-4.5 od OpenAI przekonał sędziów, że jest człowiekiem w 73% rozmów, gdy poproszono go o odegranie introwertycznej, obytej z internetem młodej osoby. Ten test był tylko tekstowy.

Griffin dodaje twarz i głos w czasie rzeczywistym.

W benchmarku VideoFDB firmy NVIDIA, teście rozmowy na żywo z użyciem dźwięku i wideo, Tavus twierdzi, że Griffin-Lite zajmuje pierwsze miejsce. Jego ścieżka generacji, która ocenia, jak naturalne i ekspresyjne są odpowiedzi modelu, dała Griffin-Lite 3,83. Następny najlepszy system otrzymał 2,80, a referencja ludzka uzyskała 3,92.

Ścieżka percepcji, która sprawdza, czy model rozumie to, co widzi i słyszy, pokazuje, gdzie wciąż ustępuje ludziom. Griffin-Lite uzyskał 3,73 w porównaniu do 3,44 dla najsilniejszego baseline'u, podczas gdy referencja ludzka osiągnęła 4,20. Tavus twierdzi, że NVIDIA przeprowadziła ocenę niezależnie.

BitcoinBTC · USD

$84,141+0.14%

Sep 25Sep 27Sep 29Oct 1Oct 2

$86.8k$85.4k$84.0k$82.7k

24h HighHigh$87,086

24h LowLow$84,473

VolVol$2.2B

Prognozy rynkoweKursy według Myriad

W tym tygodniu$84,000 do $86,000$84k–$86k51% szansy

→

Kup Bitcoin za USDT

Obsługiwane przez Jupiter

Dane cenowe dostarcza CoinGeckoCoinGeckoWięcej Bitcoin wiadomości i prognoz →

Griffin jest również pełnodupleksowy, co oznacza, że słucha, obserwuje i mówi jednocześnie, jak w rozmowie telefonicznej, a nie przez krótkofalówkę. W demonstracji Tavus prowadzi mężczyznę przez układanie kostki Rubika na podstawie tego, co widzi w jego dłoniach, i czeka, gdy ten milknie, aby pomyśleć. Opóźnienie audio-wideo wynosi średnio 0,43 sekundy na chipach NVIDIA H100, takich jak te używane w centrach danych AI, co według Tavus jest o połowę krótsze niż w przypadku następnej najszybszej metody.

Dlaczego ktokolwiek spoza branży technologicznej miałby się tym przejmować? Cóż, po pierwsze dlatego, że oszuści już działają podczas rozmów wideo.

W styczniu hakerzy powiązani z Koreą Północną wykorzystali deepfake'i, czyli tworzone przez AI wideo imitujące prawdziwą osobę, podczas rozmów na Zoomie lub Teams, aby podszyć się pod zaufane kontakty. Badacze bezpieczeństwa przypisują to włamanie grupie BlueNoroff, będącej filią Lazarus Group. Ofiary dają się namówić na zainstalowanie złośliwego oprogramowania ukrytego jako poprawka dźwięku.

David Liberman, współtwórca Gonka, zdecentralizowanej sieci do obliczeń AI, powiedział w tym raporcie, że zdjęciom i nagraniom wideo nie można już ufać jako dowodowi, że coś jest prawdziwe. Tamte modele nie były tak zaawansowane jak ten.

Firmy już improwizują swoje zabezpieczenia. W 2025 roku Kraken oznaczył podejrzanego północnokoreańskiego kandydata do pracy, gdy jego zespół ds. bezpieczeństwa zadał spontaniczne pytania, takie jak prośba o dowód tożsamości i nazwy lokalnych restauracji. Kandydat sobie nie poradził.

Wypróbowaliśmy modele Tavus i wyniki były… rozczarowujące. Po pewnych badaniach okazuje się, że Griffin-Lite nie jest dostępny dla klientów, tylko dla wybranych zaufanych testerów jako podgląd badawczy, a firma twierdzi, że pracuje nad funkcjami ujawniania i współpracuje z organizacjami ds. bezpieczeństwa AI.

Dzieje się tak, ponieważ Tavus twierdzi, że Griffin potrzebuje środków bezpieczeństwa przed publicznym wydaniem.

Tavus pozyskał 40 milionów dolarów w rundzie Series B w listopadzie 2025 roku, prowadzonej przez CRV. System, który uzyskał 2,4%, połączył trzy oddzielne modele, po jednym dla obrazu, dialogu i percepcji.

Zaufani testerzy mogą poprosić o dostęp do Griffin-Lite, wysyłając formularz na stronie Tavus.