# スペクトログラム処理

Ast Finetuned Audioset 16 16 0.442
Bsd-3-clause
AudioSetデータセットでファインチューニングされたオーディオスペクトログラムトランスフォーマーで、視覚トランスフォーマーアーキテクチャを使用してオーディオスペクトログラムを処理し、オーディオ分類タスクで優れた性能を発揮します。
音声分類 Transformers
A
MIT
35
1
Ast Finetuned Audioset 12 12 0.447
Bsd-3-clause
AudioSetデータセットでファインチューニングされたオーディオスペクトログラムトランスフォーマー(AST)。ViTアーキテクチャを使用してオーディオスペクトログラムを処理し、複数のオーディオ分類ベンチマークで優れた性能を発揮します。
音声分類 Transformers
A
MIT
25
0
Ast Finetuned Audioset 10 10 0.448
Bsd-3-clause
AudioSetデータセットでファインチューニングされたオーディオスペクトログラムトランスフォーマー(AST)。ビジョントランスフォーマー構造を使用してオーディオスペクトログラムを処理し、オーディオ分類タスクで優れた性能を発揮します。
音声分類 Transformers
A
MIT
326
0
Ast Finetuned Audioset 10 10 0.450
Bsd-3-clause
AudioSetデータセットでファインチューニングされたオーディオスペクトログラムトランスフォーマーで、ViTアーキテクチャを使用してオーディオスペクトログラムを処理し、オーディオ分類タスクで優れた性能を発揮します。
音声分類 Transformers
A
MIT
109
4
AIbase
未来を切り開く、あなたのAIソリューション知識ベース
© 2025AIbase