Kev-9B for kev-rs (mistral.rs)
Export of jaredpalmer/kev-9b in the layout
kev-rs (the Kev server in the espetro/mistral.rs fork) loads directly:
model/:Qwen/Qwen3.5-9B-Base(revision68c46c4b3498877f3ef123c856ecfde50c39f404) with the Kev LoRA merged in bf16, as a plain HF checkpointhead.safetensors: the Kev pointer head (q,k)kev.json: base, head_dim, temperature, dtype, special-token ids
Produced by kev-rs/scripts/export_checkpoint.py --dtype bf16. Parity against the torch
reference (kev-rs parity, smoke-v1 development set): 0/40 argmax flips, max |dp| 0.023.
kev-rs serve --checkpoint espetro/kev-9b-mistralrs --run jaredpalmer/kev-9b
# or quantized in-situ at load:
kev-rs serve --checkpoint espetro/kev-9b-mistralrs --run jaredpalmer/kev-9b --isq 8
Same Apache-2.0 license as the source checkpoint and base model.
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support
Model tree for espetro/kev-9b-mistralrs
Base model
Qwen/Qwen3.5-9B-Base