開発
Hugging Face、低遅延音声エージェントパイプラインをOSS公開
Hugging Faceが低遅延で完全モジュール型の音声エージェントパイプライン「speech-to-speech」をオープンソース公開。VAD・STT・LLM・TTSの4段構成で、OpenAI Realtime互換APIを提供。ローカル完全動作も可能。
Hugging Faceが低遅延で完全モジュール型の音声エージェントパイプライン「speech-to-speech」をオープンソース公開。VAD・STT・LLM・TTSの4段構成で、OpenAI Realtime互換APIを提供。ローカル完全動作も可能。
当サイトでは、アクセス分析や広告配信のためにCookieを使用しています。「同意する」をクリックすることで、Cookieの使用に同意いただいたものとみなします。詳細はプライバシーポリシーをご覧ください。