# 低遅延ストリーミング処理

Orpheus 3b 0.1 Ft
Apache-2.0
Llamaアーキテクチャに基づく高品質なテキスト音声変換モデル、感情制御と音色クローニングをサポート
音声合成 Transformers 英語
O
chutesai
2,686
0
Voila Autonomous Preview
MIT
Voilaは大規模な音声-言語基盤モデルファミリーで、人間と機械のインタラクション体験を向上させ、リアルタイムで低遅延の音声インタラクションと多言語処理をサポートします。
テキスト生成オーディオ Transformers 複数言語対応
V
maitrix-org
332
8
Voila Audio Alpha
MIT
Voilaは大規模な音声-言語基盤モデルファミリーで、人間と機械のインタラクション体験を向上させ、リアルタイムで低遅延の音声インタラクションと多言語処理をサポートします。
テキスト生成オーディオ Transformers 複数言語対応
V
maitrix-org
175
3
Voila Tokenizer
MIT
Voilaは人間と機械のインタラクション体験を向上させるために設計された大規模な音声-言語基盤モデルシリーズで、様々な音声タスクと言語をサポートします。
テキスト生成オーディオ Transformers 複数言語対応
V
maitrix-org
4,912
3
Encodec 24khz
EnCodecはMeta AIが開発した高音質リアルタイムニューラルオーディオコーデックで、エンドツーエンドトレーニング方式を採用し、複数のバンド幅設定をサポートしています。
音声生成 Transformers
E
facebook
534.08k
46
AIbase
未来を切り開く、あなたのAIソリューション知識ベース
© 2025AIbase