Commit History

Fix quantization metadata: top-level bits 2 (matches tensor data)
0dc2308
verified

majentik commited on

Card accuracy pass 2: remove unmeasured speed claims, honest brand labels
9631011
verified

majentik commited on

Card accuracy sweep: honest brand labeling, remove dead links, upstream KV tip
a5e8447
verified

majentik commited on

Remove links to retired card-only KV-docs repos
6ae8797
verified

majentik commited on

docs: upstream-first KV-cache guidance (q8_0/q4_0, mainline Hadamard rotation); fork demoted to experimental
0a94565
verified

majentik commited on

docs: remove AWQ variants from family table (AWQ lane paused, repos private)
0c57e8e
verified

majentik commited on

fix: family model links majentik/gemma4-* -> majentik/gemma-4-* (reported by @shramee in gemma-4-31B-TurboQuant-MLX-4bit#1)
a8c78f1
verified

majentik commited on

docs: Tier 2 polish — variant matrix + quant trade-off
79441a4
verified

majentik commited on

chore(card): enrich YAML frontmatter (pipeline_tag, language, library_name, inference)
043c673
verified

majentik commited on

Add MLX quantized model with KV cache compression
a74ffb5
verified

majentik commited on

initial commit
b1e8988
verified

majentik commited on