簡述
- Tavus 表示,在 54 名參與者中,有 26 人(48%)在進行一分鐘的視訊通話後,相信 Griffin-Lite 是真人,而其先前系統在 41 人中僅有 1 人如此認為。
- Griffin-Lite 在 Nvidia 的 VideoFDB 基準測試中排名第一,生成方面得分為 5 分中的 3.83 分,而次佳系統為 2.80 分,人類參考為 3.92 分。
- 這些結果來自 Tavus 自家的研究頁面,參與者被告知他們將會見到另一個人,而 Griffin-Lite 僅限於特定受信任的測試者使用,同時 Tavus 正在制定安全措施。
AI 新創公司 Tavus 表示,其新模型 Griffin 讓 48% 在即時視訊通話中與其交談的人相信,他們正在與真人對話。
該公司於 10 月 1 日發布此模型,並稱其為首個「人類互動模型」,這是一種旨在理解並生成面對面對話的 AI,除了詞語之外,還會關注表情和停頓。其先前的系統在同一測試中得分為 2.4%。

Tavus 測試的版本 Griffin-Lite 面對了 54 人,其中 26 人之後表示他們相信對話對象是真人。較舊的系統面對了 41 人,只有一人相信。
Tavus 解釋說,參與者被告知他們將與另一個人配對,進行一分鐘的視訊通話,談論他們今年期待的事情。直到最後,他們才被問到是否想過他們的夥伴可能不是真人。
這不是 1950 年由英國數學家艾倫·圖靈提出的經典圖靈測試,在該測試中,評審與一個隱藏的人和一個隱藏的機器交談,並且必須分辨出哪個是哪個。通話中沒有人被告知另一端可能有機器人。
這些結果來自 Tavus 自己的研究頁面,參與者是透過其所謂的獨立研究平台招募的。X 上的一則社群註記已經指出,這些結果未經獨立驗證,也不遵循標準協議。Tavus 表示,那些起疑的人通常在 20 秒內就會產生懷疑。
AI 公司朝這個方向發展已經有一段時間了。一項加州大學聖地牙哥分校的研究發現,當被提示扮演一個內向、精通網路的年輕人時,OpenAI 的 GPT-4.5 在 73% 的對話中讓評審相信它是人類。那項測試僅限文字。
Griffin 即時添加了一張臉和一個聲音。
在 NVIDIA 的 VideoFDB 基準測試(一項即時音訊和視訊對話測試)中,Tavus 表示 Griffin-Lite 排名第一。其生成軌道(評估模型回應的自然度和表達力)給 Griffin-Lite 打了 3.83 分。次佳的系統得到 2.80 分,而人類參考分數為 3.92 分。
感知軌道(檢查模型是否理解它所看到和聽到的內容)顯示了它仍然落後於人類的地方。Griffin-Lite 得分為 3.73,而最強基準為 3.44,人類參考則達到 4.20。Tavus 表示 NVIDIA 獨立進行了這項評估。
比特幣BTC · USD
$84,141+0.14%
9月25日9月27日9月29日10月1日10月2日
$86.8k$85.4k$84.0k$82.7k
24小時最高最高$87,086
24小時最低最低$84,473
成交量成交量$2.2B
市場預測賠率由 Myriad
使用 USDT 購買 比特幣
由 Jupiter 提供技術支援
Griffin 也是全雙工的,這意味著它會同時聆聽、觀看和說話,就像打電話而不是對講機。在一個 Tavus 演示中,它會根據手中看到的魔術方塊來指導一名男子,並在他安靜思考時等待。在 NVIDIA H100 晶片(AI 資料中心使用的那種)上,音訊到視訊的延遲平均為 0.43 秒,Tavus 稱這是第二快方法的一半。
為什麼科技圈以外的人該在意?嗯,其中一個原因是,詐騙者已經在用視訊通話行騙了。
早在今年一月,與北韓有關的駭客利用深偽技術——模仿真人、由 AI 製作的影片——在 Zoom 或 Teams 通話中冒充可信賴的聯絡人。安全研究人員將這起入侵歸因於 BlueNoroff,也就是 Lazarus Group 的子公司。受害者被說服安裝偽裝成音訊修復程式的惡意軟體。
Gonka 共同創辦人 David Liberman 在該報導中表示,照片和影片已不再能作為某事物為真的可信證據。Gonka 是一個用於 AI 運算的去中心化網路。那些模型並不如這個模型先進。
企業已經在臨時拼湊自己的防禦措施。2025 年,Kraken 在其安全團隊提出即興問題後,標記了一名疑似北韓求職者,這些問題包括要求提供政府身分證件以及當地餐廳的名稱。那名應徵者招架不住。
我們試用了 Tavus 的模型,結果……令人失望。經過一番研究後發現,Griffin-Lite 並未開放給客戶使用,僅提供給精選的可信任測試者作為研究預覽,而該公司表示正在開發揭露功能,並與 AI 安全組織合作。
這是因為 Tavus 表示 Griffin 在公開發布前需要安全措施。
Tavus 於 2025 年 11 月由 CRV 領投,籌得 4000 萬美元的 B 輪融資。這套獲得 2.4% 分數的系統,是將三個獨立模型拼接而成,分別負責視覺、對話和感知。
可信任測試者可透過在 Tavus 網站上提交表單,申請使用 Griffin-Lite。






