Kalpa Labs
Fall 2025活動中Generalist Speech modelをスケールさせる
- サマリー
- 企業向けに、複数の音声機能を統合したGeneralist speech modelsを提供する
- 課題
- 既存の音声モデルは機能が分断され、in-context learningや指示追従が不足している
- 解決策
- STT・TTS・voice cloningなどを統合し、in-context learningと強い指示追従を実現する
AI による要約
- 所在地
- San Francisco, CA, USA
- チーム規模
- 2 人
事業内容
次世代のspeech modelを開発する。speech modelにin-context learningと高いinstruction following能力をもたらすGeneralist speech modelを構築し、speech-to-text、text-to-speech、voice cloningなど、既存のspeech機能を統合する。