--- license: apache-2.0 --- # *caution!* **思考をさせるためは``--jinja`` オプションにてこのモデル特有のシステムプロンプトを読み込む必要があります。**
このオプションを使用するには**llama.cpp-b4524以降への更新が必要です。** # What is this? KARAKURI Inc.によるQwQ-32B-Previewの日本語ファインチューニングモデル、[karakuri-lm-32b-thinking-2501-exp](https://huggingface.co/karakuri-ai/karakuri-lm-32b-thinking-2501-exp)をGGUFフォーマットに変換したものです。 # imatrix dataset 日本語能力を重視し、日本語が多量に含まれる[TFMC/imatrix-dataset-for-japanese-llm](https://huggingface.co/datasets/TFMC/imatrix-dataset-for-japanese-llm)データセットを使用しました。
また、CUDA版llama.cppがbfloat16に対応したため、imatrixの算出は本来の数値精度であるBF16のモデルを使用して行いました。 # Note **llama.cpp-b4524以降と合わせてご利用ください。** # Environment Windows版llama.cpp-b4514およびllama.cpp-b4524同時リリースのconvert-hf-to-gguf.pyを使用して量子化作業を実施しました。 # License Apache 2.0 # Developer Alibaba Cloud & KARAKURI Inc.