What is this?
NexusflowのAthene-70Bの次世代モデルAthene-V2-Agentを日本語imatrixで量子化したものです。
今回からはQwen2.5-72B-Instructベースに切り替わり、Chat用モデルとAgent用モデルの2種類が用意されるようになりました。
なお、商用利用はできませんのでご注意ください。
imatrix dataset
日本語能力を重視し、日本語が多量に含まれるTFMC/imatrix-dataset-for-japanese-llmデータセットを使用しました。
なお、計算リソースの関係上imatrixの算出においてはQ8_0量子化モデルを使用しました。
Chat template
<|im_start|>system
ここにSystem Promptを書きます。<|im_end|>
<|im_start|>user
ここにMessageを書きます。<|im_end|>
<|im_start|>assistant
Environment
Windows版llama.cpp-b4453および同時リリースのconvert-hf-to-gguf.pyを使用して量子化作業を実施しました。
License
Qwen LICENSE & Nexusflow Research License
Developer
Alibaba Cloud & Nexusflow
- Downloads last month
- 68
Inference Providers
NEW
This model is not currently available via any of the supported third-party Inference Providers, and
HF Inference API was unable to determine this model's library.