Edit model card

Local-Novel-LLM-project様の Ninja-V3 をGGUF形式に変換したものです。 K量子化モデルについてもiMatrix適用してあります。

iMatrixテキストはTFMC様のc4_en_ja_imatrix.txtを使用しています。

Downloads last month
198
GGUF
Model size
7.24B params
Architecture
llama

3-bit

4-bit

5-bit

6-bit

8-bit

16-bit

Inference API
This model can be loaded on Inference API (serverless).

Merge of