# 4ビット量子化圧縮
Devstral Small 2507 4bit DWQ
Apache-2.0
これはMLX形式に基づく4ビット量子化言語モデルで、複数の言語のテキスト生成タスクをサポートしています。
大規模言語モデル Supports Multiple Languages
D
mlx-community
159
7
Cogito 14b Gptq Q4
Apache-2.0
Qwen2.5-14B大規模言語モデルを基にしたGPTQ量子化バージョンで、英語とスペイン語のテキスト生成タスクをサポート
大規模言語モデル
Transformers

C
mediainbox
8,547
2
Llama 3.2 11B Vision OCR
Apache-2.0
Unslothで最適化されたLlama 3.2-11B視覚命令モデル、4ビット量子化バージョン、トレーニング速度2倍向上
大規模言語モデル
Transformers English

L
Swapnik
80
1
Molmo 7B D Bnb 4bit
Apache-2.0
Molmo-7B-DはBnB 4ビット量子化を施した大規模言語モデルで、モデルサイズが30GBから7GBに縮小され、VRAM要件が約12GBに抑えられます。
大規模言語モデル
Transformers

M
cyan2k
1,994
17
Featured Recommended AI Models
Llama 3 Typhoon V1.5x 8b Instruct
タイ語専用に設計された80億パラメータの命令モデルで、GPT-3.5-turboに匹敵する性能を持ち、アプリケーションシナリオ、検索拡張生成、制限付き生成、推論タスクを最適化
大規模言語モデル
Transformers Supports Multiple Languages

L
scb10x
3,269
16
Cadet Tiny
Openrail
Cadet-TinyはSODAデータセットでトレーニングされた超小型対話モデルで、エッジデバイス推論向けに設計されており、体積はCosmo-3Bモデルの約2%です。
対話システム
Transformers English

C
ToddGoldfarb
2,691
6
Roberta Base Chinese Extractive Qa
RoBERTaアーキテクチャに基づく中国語抽出型QAモデルで、与えられたテキストから回答を抽出するタスクに適しています。
質問応答システム Chinese
R
uer
2,694
98