grapevine-AI
/

DeepSeek-R1-Distill-Qwen-32B-Japanese-GGUF

Model card Files Files and versions Community

grapevine-AI commited on Feb 16

Commit

405db6d

·

verified ·

1 Parent(s): b918d02

Update README.md

Files changed (1) hide show

README.md +6 -1

README.md CHANGED Viewed

@@ -2,15 +2,20 @@
 license: apache-2.0
 ---
 # What is this?
-CyberAgentによるDeepSeek-R1-Distill-Qwen-32B日本語ファインチューニングモデル、[DeepSeek-R1-Distill-Qwen-32B-Japanese](https://huggingface.co/cyberagent/DeepSeek-R1-Distill-Qwen-32B-Japanese)をGGUFフォーマットに変換したものです。
 # imatrix dataset
 日本語能力を重視し、日本語が多量に含まれる[TFMC/imatrix-dataset-for-japanese-llm](https://huggingface.co/datasets/TFMC/imatrix-dataset-for-japanese-llm)データセットを使用しました。<br>
 また、CUDA版llama.cppがbfloat16に対応したため、imatrixの算出は本来の数値精度であるBF16のモデルを使用して行いました。
 # Environment
 Windows版llama.cpp-b4514およびllama.cpp-b4524同時リリースのconvert-hf-to-gguf.pyを使用して量子化作業を実施しました。
 # License
 Apache 2.0
 # Developer
 Alibaba Cloud & DeepSeek (深度求索) & CyberAgent

 license: apache-2.0
 ---
 # What is this?
+CyberAgent社によるDeepSeek-R1-Distill-Qwen-32Bの日本語ファインチューニングモデル、[DeepSeek-R1-Distill-Qwen-32B-Japanese](https://huggingface.co/cyberagent/DeepSeek-R1-Distill-Qwen-32B-Japanese)をGGUFフォーマットに変換したものです。
 # imatrix dataset
 日本語能力を重視し、日本語が多量に含まれる[TFMC/imatrix-dataset-for-japanese-llm](https://huggingface.co/datasets/TFMC/imatrix-dataset-for-japanese-llm)データセットを使用しました。<br>
 また、CUDA版llama.cppがbfloat16に対応したため、imatrixの算出は本来の数値精度であるBF16のモデルを使用して行いました。
+# Note
+**llama.cpp-b4514以降と合わせてご利用ください。**
 # Environment
 Windows版llama.cpp-b4514およびllama.cpp-b4524同時リリースのconvert-hf-to-gguf.pyを使用して量子化作業を実施しました。
 # License
 Apache 2.0
 # Developer
 Alibaba Cloud & DeepSeek (深度求索) & CyberAgent