Diar Sortformer 4spk V1
Sortformerアーキテクチャに基づくエンドツーエンドのスピーカーダイアリゼーションモデルで、スピーカーの音声セグメント到着順に並べ替えることでダイアリゼーションの順序問題を解決し、最大4人のスピーカー識別をサポートします。
話者の処理
D
nvidia
385.49k
36
Sepformer Libri3mix
Apache-2.0
これはSepFormerアーキテクチャに基づく音源分離モデルで、Libri3Mixデータセットでトレーニングされ、混合音声を複数の独立した音源に分離できます。
音声分離 英語
S
speechbrain
1,511
7
Sepformer Libri2mix
Apache-2.0
SepFormerアーキテクチャを使用して実装された音源分離モデルで、Libri2Mixデータセットでトレーニングされ、混合オーディオから独立した音源を分離できます
音声分離 英語
S
speechbrain
783
6
Convtasnet Libri3Mix Sepnoisy
AsteroidフレームワークでトレーニングされたConvTasNetモデルで、ノイズを含む音声分離タスク用です。トレーニングデータはLibri3Mixデータセットから取得しました。
音声分離
C
mpariente
30
0
Convtasnet Libri3Mix Sepnoisy 8k
AsteroidフレームワークでトレーニングされたConvTasNetモデルで、混合音声から3つの独立した音源を分離するために設計されており、特に8kHzサンプリングレートのノイズを含む音声データに最適化されています。
音声分離
C
JorisCos
33
2
おすすめAIモデル
Llama 3 Typhoon V1.5x 8b Instruct
タイ語専用に設計された80億パラメータの命令モデルで、GPT-3.5-turboに匹敵する性能を持ち、アプリケーションシナリオ、検索拡張生成、制限付き生成、推論タスクを最適化
大規模言語モデル
Transformers 複数言語対応

L
scb10x
3,269
16
Cadet Tiny
Openrail
Cadet-TinyはSODAデータセットでトレーニングされた超小型対話モデルで、エッジデバイス推論向けに設計されており、体積はCosmo-3Bモデルの約2%です。
対話システム
Transformers 英語

C
ToddGoldfarb
2,691
6
Roberta Base Chinese Extractive Qa
RoBERTaアーキテクチャに基づく中国語抽出型QAモデルで、与えられたテキストから回答を抽出するタスクに適しています。
質問応答システム 中国語
R
uer
2,694
98