Familiar
Summer 2026活動中ついに、自然な吹き替えを実現。Audio-Visual Translation。
- サマリー
- 映画・放送・教育などのコンテンツ事業者向けに、音声映像翻訳を提供する
- 課題
- 従来の吹替は声や表情、笑い声、音楽など話者の表現を失う
- 解決策
- 音声・人物・シーンを統合理解するworld modelで、本人の声や表情を保ったリアルタイム吹替を実現する
AI による要約
- 所在地
- Toronto, ON, Canada
- チーム規模
- 7 人
事業内容
人間を正確に捉えるWorld model。 🦋 あらゆる言語でコンテンツを提供しながら、話者のパフォーマンスをそのまま維持する。映画・テレビ、放送、教育、広告、プラットフォーム、Live Shoppingに対応する。 創業者のAn Zhu Liu、Mingi Kwon、Xu Zhengが、世界トップクラスの大学出身のPhD、教授、研究者からなるチームを率いる。彼らは音声と映像を統合した人間モデルという分野を切り拓き、リアルタイムの人間アニメーションにおける最先端技術を共同で発表してきた。 まずは動画の言語翻訳から始め、現在利用できる中でも最も高精度な翻訳サービスの一つを、リアルタイムで動作する唯一のサービスとして構築した。他社は個別のモデルと前処理を組み合わせるが、World modelは音声・人物・シーンを総合的に理解し、話者が何を意味しているかを捉える。そのため、吹き替えでも話者自身の声、顔、話し方を維持できる。 ElevenLabsと比較すると、同社のサービスでは笑い声、音楽、環境音が失われ、背景音のエラーが270%多く発生する。一方、Familiarの音声は本人らしさが27.8%高い。人間の翻訳者と比較しても、品質は100.3%を実現しながら、スケーラブルかつリアルタイムで利用できる。公開ベンチマーク:https://thefamiliarlab.com/benchmark 毎年140億ドルが費やされる吹き替え市場は、品質が十分な水準に達すればAIへと移行する。その大半を占めるのは、従来から吹き替えの中心だった映画とテレビ。Liveによって市場機会はさらに拡大する。