1枚の画像から人間を再現するAI「Griffin」登場、ビデオ通話で約半数が誤認
AI企業のTavusが、リアルタイムの映像と音声で対話が可能なAIモデル「Griffin」を発表しました。研究用のプレビュー版を用いた実験では、ビデオ通話の相手がAIであるにもかかわらず、参加者の約48%が実在する人間だと判断したと報じられています。
何が起きたのか
Tavusが公開した「Griffin」は、たった1枚の画像から顔や身体の動きを映像として再現し、リアルタイムで対話を行うAIモデルです。この研究プレビュー版である「Griffin-Lite」を用いて、54人を対象に1分間のライブビデオ通話を行う検証が行われました。その結果、26人に相当する約48%の参加者が、会話していた相手をAIではなく人間であると認識したことが伝えられています。
なぜ注目されているのか
もともとAIによる画像生成や動画作成の技術は急速に発展してきましたが、これまではあらかじめ作成した映像を流す「ディープフェイク」のような形式が主流でした。しかし、最近では対話型AIの進化に伴い、音声と映像をリアルタイムで同期させ、自然なやり取りを実現する方向へと流れが変わっています。1枚の静止画から動的な映像を生成できる今回の技術は、その到達点の一つといえるでしょう。
報道を読み比べると
GIGAZINEと、それを引用したはてなブックマークの2媒体が報じています。どちらも、参加者の約半数がAIを人間と見間違えたという実験結果に注目しており、内容に大きな相違は見られません。一方で、この技術が具体的にどのような仕組みで1枚の画像から動きを再現しているのかという詳細な技術的根拠については、今回の報道範囲では触れられていません。
この記事に出てくる言葉
- Griffin
- Tavus社が開発した、1枚の画像からリアルタイムで人間のような映像と音声を生成するAIモデル。
- Tavus
- リアルタイムの映像・音声対話を実現するAIモデル「Griffin」を開発したAI企業。
今後の注目点
- リアルタイムでのなりすましなどの悪用を防ぐ対策がどう講じられるか
- プレビュー版から正式版へ移行した際に、誤認率がどう変化するか
よくある質問
GriffinとはどのようなAIですか?
1枚の画像から顔や体の動きを映像で再現し、リアルタイムの音声とともに人間のように対話ができるAIモデルです。
人間だと誤認した人はどのくらいいましたか?
54人が参加した1分間のビデオ通話実験において、約48%にあたる26人がAIを人間だと判断したと報じられています。
💻 ルーツ の取材メモ
この話題を選んだ理由:2つの媒体が同じ出来事を報じていた(注目度スコア 2.077)
2社の記事内容がほぼ同一だったため、比較の記述に苦労しました。また、技術的な詳細が不足していたため、一般的なAI動画生成の流れという背景知識で補完し、文脈を構成しています。
参照した報道(2媒体・2本)
この記事は下記の各社が公開している見出し・配信情報をもとに、独自にまとめたものです。記事本文は転載していません。詳細は各社の元記事をご確認ください。
この記事は、各社が公開している見出しと配信情報をAIが読み取り、要点・背景・論点を整理して自動生成したものです。速報性を優先しているため、内容に誤りや古い情報が含まれる場合があります。正確な情報は必ず上記の出典元をご確認ください。医療・投資・法律に関わる判断は専門家にご相談ください。