Shiftedx/ornith-1.5-9b-abliterated-attention8-bf16recurrence-vision-mtplx

🤗 Hugging Face sourceimage-text-to-textmit9.4B params19 GBsafetensorsChecksums witnessedupdated today
No torrent yet

ornith-1.5-9b-abliterated-attention8-bf16recurrence-vision-mtplx

Behavior-modified, vision-preserving hybrid MLX quant of ornith-ai/Ornith-1.5-9B, pinned to revision 489cb97981b8654bcfcf30ce1f94ed1b62e07b53.

Format

  • 130 attention-sensitive modules at affine 8-bit; 72 trunk modules at affine 4-bit
  • 48 recurrent input projections and the 333-tensor vision tower retained in BF16
  • All 15 native source mtp.* tensors retained in BF16 (SHA-256 435b631a5c36c28c8a9b73f30e257fece090d828076e73a43e1b24aedcddd9cb)
  • MTPLX 2.9.1, MLX 0.32.1, MLX-LM 0.31.3; recommended native-MTP depth: D1

Measured locally

  • D1: 73.03 decode tok/s; AR: 49.54 tok/s (1.47x) on an M4 Max 64 GiB, fans automatic
  • Frozen held-out refusal rate: 100% parent -> 8.3% abliterated
  • Held-out benign refusal: 0%; utility pass: 100%
  • Deterministic text, vision (HUNTER), structural, and MTP tensor-contract checks passed
mtplx inspect --require-mtp Shiftedx/ornith-1.5-9b-abliterated-attention8-bf16recurrence-vision-mtplx
mtplx quickstart --model Shiftedx/ornith-1.5-9b-abliterated-attention8-bf16recurrence-vision-mtplx --mtp --depth 1

This is an experimental quant and behavior edit. Review the source model card and validate it for your use case.