中国のAI企業iFlytekが、1枚の静止画からリアルなデジタルヒューマンを即時生成する「ultra-realistic digital human real-time generation technology」を発表した。従来は約2時間の動画撮影と訓練が必要だった作成工程を短縮し、自然な表情、ジェスチャー、リップシンクに加え、物を拾う、飲む、歌う、踊るといった動作にも対応する。Spark音声LLM、業界別知識ベース、カスタムペルソナ、長期記憶により、ブランド配信、顧客対応、無人店舗などで使うデジタルヒューマンの実用化を広げる狙いがある。
キャラ作成と会話だけでなく、投げ銭や有料化まで一気に試せるのが実践的です。収益化すると、人気の作り方だけでなく通報や出金の運用も重くなりますね。