48%が人間と誤認したAI「Griffin」、Tavusは安全対策が整うまで公開を見送る
54人が参加した1分間のビデオ通話。
終了後に「話した相手はAIでした」と明かされた参加者のうち、48%が最後まで本物の人間だと思い込んでいました。
発表したのは、AI動画生成を手がける米スタートアップTavusです。
新モデル「Griffin」が、同社いわく「ビデオ版チューリングテスト」に初めて合格したというニュースがXで拡散しました。
ビデオ通話やライブ配信でAIと接する機会が増えている今、この数字は無視できません。
どういう条件での48%だったのか、そして本当にすぐ使えるものなのかを調べました。
先に結論をまとめると:
– Tavusの新モデル「Griffin」は、1分間のビデオ通話で54人中48%に人間だと誤認されました
– 従来モデルの誤認率は2.4%(41人中1人)で、今回はその約20倍という結果です
– 一般公開はまだで、Tavusは安全面の対策を整えてから提供する方針を明らかにしています
54人中48%が人間だと信じた1分間の通話
Tavus本人による発表が、Xでの話題の出発点でした。
Introducing Griffin, the first model to pass the video Turing test.
— Tavus (@tavus) 2026年10月1日
48% of people who talked to it live thought it was a real human. Previous systems have had a pass rate <3%. It is #1 on NVIDIA's benchmark for full-duplex AI video.
It’s the first Human Interaction Model (HIM). pic.twitter.com/eb11XbC8Xr
(日本語訳:Griffinを発表します。
ビデオ版チューリングテストに初めて合格したモデルです。
ライブで話した人の48%が、本物の人間だと思いました。
従来のシステムの合格率は3%未満でした。
NVIDIAのフルデュプレックスAI映像ベンチマークで首位です。
初めてのHuman Interaction Model(HIM)です)
Tavus公式サイトによると、この調査は54人が参加し、1人ずつ1分間のビデオ通話をする形で実施されました。
参加者には「これから1年の予定について、別の人と話してもらう」とだけ伝えられており、通話後に会話の自然さと信頼できる印象を評価してもらった後で、ようやく相手がAIだったと明かされたという段取りです。
ただ、発表した本人たちの言葉だけを鵜呑みにするのは危ういので、実際に試した第三者の反応や、技術的な背景を確認してみました。
調べてわかった、48%という数字の裏側
なぜ従来の20倍もの誤認率になったのか?
Tavusはこれまでも「Phoenix-4.5」「Sparrow-2」「Raven-1」という組み合わせでAIによるビデオ会話サービスを提供していましたが、その誤認率は2.4%(41人中1人)にとどまっていたといいます。
Griffinはこれを一気に引き上げました。
違いは仕組みにあります。
従来型は、音声認識・応答文の生成・音声合成・映像生成をそれぞれ別のモデルが順番に処理する構成が一般的で、相手の発言を聞き終えてから返答が始まるまでにわずかな間が生まれがちでした。
Griffinは、Tavusが「Human Interaction Model」と呼ぶ単一のモデルで、聞く・考える・話す・表情を作るという処理を同時に進めるつくりになっています。
早期アクセスを得た開発者の声にも、その体感が表れていました。
This is impressive! Face-to-face conversation is where AI interfaces are heading.@tavus gave me early access to Griffin, a video-to-video model that watches and listens as you talk.
— elvis (@omarsar0) 2026年10月1日
It can interrupt you, take an interruption, and react to what is happening in your room.
On… https://t.co/i3CzdAtuJC
(日本語訳:これはすごい。
対面での会話こそ、AIインターフェースが向かう先です。
Tavusから早期アクセスをもらったGriffinは、話している間、見て聞いているビデオ・トゥ・ビデオモデルです。
話を遮ることも、遮られることも、部屋で起きていることへの反応もできます)
なぜまだ一般公開されていないのか?
ここまで聞くと、すぐにでも使ってみたくなりますが、現時点でGriffin-Liteという試験版に触れられるのは「選ばれた信頼できるテスター」だけで、一般ユーザーには提供されていません。
Tavus自身が公式サイトで、その理由をこう説明しています。
人間らしい対話を自然に作れる性質は、裏を返せばAIであることを人に気づかせず欺く力にもなる、という点です。
そのため、AIだと開示する仕組みを整え、AI安全の専門機関とも連携したうえで本公開に進む方針だといいます。
この「出したいけれど出せない」という状況は、早速ネタにもされていました。
Me realizing Tavus built an AI that passed the Turing test and is apparently too powerful to release:
— Not Jerome Powell (@alifarhat79) 2026年10月1日
bro we were just trying to automate emails. https://t.co/tpdxgieLZU
(日本語訳:Tavusがチューリングテストに合格するAIを作ったのに、どうやら公開するには強すぎると気づいた瞬間を想像してみてほしい。
俺たちはただメールを自動化したかっただけなのに)
AIと人間は、もうどう見分ければいいのか?
今回のような開示前提の技術がある一方で、すでに世に出ている音声・映像生成AIは、見分け方が確立されていないまま広がっています。
「ai 見分け方」で検索する人は毎月一定数いて、一過性のブームではなく、日常的な困りごととして定着している言葉です。
決定的な見分け方は今のところありません。
Tavusが自ら開示の仕組みを用意するとしているのも、見た目や声だけでは判別できない段階に来ていることの裏返しといえます。
相手が名乗る肩書きや経緯をその場で検証できない電話・通話では、折り返しや別の手段での本人確認を挟むといった、技術以外の備えが今のところ現実的な対策になりそうです。
Shiritomo編集部の考察:開示表示そのものが機能になる日
これまでAIによる音声・映像のなりすましは、本人の声や顔を無断で複製する詐欺の文脈で語られることが多く、以前取り上げたSNS動画からの声複製詐欺もその一例でした。
Griffinが示したのは、複製ではなく最初から「人間らしく振る舞う」ことを目的に設計したモデルでも、同じ精度の壁にぶつかるという構図です。
SNS運用やカスタマーサポートにAIアバターを導入する企業にとって、今後は「バレないAI」を追求するより、「AIだと分かるように見せる」開示表示そのものが機能の一部になっていくと考えられます。
Tavusが一般公開前に開示機能を整えると明言しているのも、その先回りと見てよさそうです。
まとめ
Tavusの「Griffin」は、1分間の通話で54人中48%を人間だと信じ込ませるという結果を出しましたが、一般公開はまだで、開示の仕組みと安全対策を整えるのが先だとTavus自身が説明しています。
技術の進化と、それを安全に出す仕組みづくりは、同じスピードでは進んでいないようです。
さらに深掘りしたい方へ
Griffinの詳細な技術説明と安全面の方針は、Tavus公式のGriffin紹介ページで公開されています。

