Edit model card

Local-Novel-LLM-project様の Ninja-V3 をGGUF形式に変換したものです。 K量子化モデルについてもiMatrix適用してあります。

iMatrixテキストはTFMC様のc4_en_ja_imatrix.txtを使用しています。

Downloads last month
84
GGUF
Model size
7.24B params
Architecture
llama

3-bit

4-bit

5-bit

6-bit

8-bit

16-bit

Inference Examples
Inference API (serverless) is not available, repository is disabled.

Model tree for MCZK/Ninja-V3-GGUF