Local-Novel-LLM-project様の Ninja-V3 をGGUF形式に変換したものです。 K量子化モデルについてもiMatrix適用してあります。

iMatrixテキストはTFMC様のc4_en_ja_imatrix.txtを使用しています。

GGUF

Model size

7.24B params

Architecture

llama

3-bit

4-bit

5-bit

6-bit

8-bit

16-bit

Inference Examples

Inference API (serverless) is not available, repository is disabled.

Model tree for MCZK/Ninja-V3-GGUF

Merge model

this model