簡述

  • Tavus 表示,在 54 名參與者中,有 26 人(48%)在進行一分鐘的視訊通話後,相信 Griffin-Lite 是真人,而其先前系統在 41 人中僅有 1 人如此認為。
  • Griffin-Lite 在 Nvidia 的 VideoFDB 基準測試中排名第一,生成方面得分為 5 分中的 3.83 分,而次佳系統為 2.80 分,人類參考為 3.92 分。
  • 這些結果來自 Tavus 自家的研究頁面,參與者被告知他們將會見到另一個人,而 Griffin-Lite 僅限於特定受信任的測試者使用,同時 Tavus 正在制定安全措施。

AI 新創公司 Tavus 表示,其新模型 Griffin 讓 48% 在即時視訊通話中與其交談的人相信,他們正在與真人對話。

該公司於 10 月 1 日發布此模型,並稱其為首個「人類互動模型」,這是一種旨在理解並生成面對面對話的 AI,除了詞語之外,還會關注表情和停頓。其先前的系統在同一測試中得分為 2.4%。

Myriad: How high will Nvidia go? Click to make your prediction.
Myriad:Nvidia 會漲到多高?點擊做出你的預測。

Tavus 測試的版本 Griffin-Lite 面對了 54 人,其中 26 人之後表示他們相信對話對象是真人。較舊的系統面對了 41 人,只有一人相信。

Tavus 解釋說,參與者被告知他們將與另一個人配對,進行一分鐘的視訊通話,談論他們今年期待的事情。直到最後,他們才被問到是否想過他們的夥伴可能不是真人。

這不是 1950 年由英國數學家艾倫·圖靈提出的經典圖靈測試,在該測試中,評審與一個隱藏的人和一個隱藏的機器交談,並且必須分辨出哪個是哪個。通話中沒有人被告知另一端可能有機器人。

這些結果來自 Tavus 自己的研究頁面,參與者是透過其所謂的獨立研究平台招募的。X 上的一則社群註記已經指出,這些結果未經獨立驗證,也不遵循標準協議。Tavus 表示,那些起疑的人通常在 20 秒內就會產生懷疑。

AI 公司朝這個方向發展已經有一段時間了。一項加州大學聖地牙哥分校的研究發現,當被提示扮演一個內向、精通網路的年輕人時,OpenAI 的 GPT-4.5 在 73% 的對話中讓評審相信它是人類。那項測試僅限文字。

Griffin 即時添加了一張臉和一個聲音。

在 NVIDIA 的 VideoFDB 基準測試(一項即時音訊和視訊對話測試)中,Tavus 表示 Griffin-Lite 排名第一。其生成軌道(評估模型回應的自然度和表達力)給 Griffin-Lite 打了 3.83 分。次佳的系統得到 2.80 分,而人類參考分數為 3.92 分。

感知軌道(檢查模型是否理解它所看到和聽到的內容)顯示了它仍然落後於人類的地方。Griffin-Lite 得分為 3.73,而最強基準為 3.44,人類參考則達到 4.20。Tavus 表示 NVIDIA 獨立進行了這項評估。

比特幣BTC · USD

$84,141+0.14%

9月25日9月27日9月29日10月1日10月2日

$86.8k$85.4k$84.0k$82.7k

24小時最高最高$87,086

24小時最低最低$84,473

成交量成交量$2.2B

→

使用 USDT 購買 比特幣

由 Jupiter 提供技術支援

價格數據由 CoinGecko 提供CoinGecko更多 比特幣 新聞與預測 →

Griffin 也是全雙工的,這意味著它會同時聆聽、觀看和說話,就像打電話而不是對講機。在一個 Tavus 演示中,它會根據手中看到的魔術方塊來指導一名男子,並在他安靜思考時等待。在 NVIDIA H100 晶片(AI 資料中心使用的那種)上,音訊到視訊的延遲平均為 0.43 秒,Tavus 稱這是第二快方法的一半。

為什麼科技圈以外的人該在意?嗯,其中一個原因是,詐騙者已經在用視訊通話行騙了。

早在今年一月,與北韓有關的駭客利用深偽技術——模仿真人、由 AI 製作的影片——在 Zoom 或 Teams 通話中冒充可信賴的聯絡人。安全研究人員將這起入侵歸因於 BlueNoroff,也就是 Lazarus Group 的子公司。受害者被說服安裝偽裝成音訊修復程式的惡意軟體。

Gonka 共同創辦人 David Liberman 在該報導中表示,照片和影片已不再能作為某事物為真的可信證據。Gonka 是一個用於 AI 運算的去中心化網路。那些模型並不如這個模型先進。

企業已經在臨時拼湊自己的防禦措施。2025 年,Kraken 在其安全團隊提出即興問題後,標記了一名疑似北韓求職者,這些問題包括要求提供政府身分證件以及當地餐廳的名稱。那名應徵者招架不住。

我們試用了 Tavus 的模型,結果……令人失望。經過一番研究後發現,Griffin-Lite 並未開放給客戶使用,僅提供給精選的可信任測試者作為研究預覽,而該公司表示正在開發揭露功能,並與 AI 安全組織合作。

這是因為 Tavus 表示 Griffin 在公開發布前需要安全措施。

Tavus 於 2025 年 11 月由 CRV 領投,籌得 4000 萬美元的 B 輪融資。這套獲得 2.4% 分數的系統,是將三個獨立模型拼接而成,分別負責視覺、對話和感知。

可信任測試者可透過在 Tavus 網站上提交表單,申請使用 Griffin-Lite。