Finished file size
Byte count of the file we ship. Measured, not a class guess.
Shop lists only units we have bit-identical codec proof for, or that
already serve on AhanaBot with serve_aarm.
You buy the finished file size. Compression is lossless of the packed source.
~1-bit class is a quant size, then AQ1B packs that quant losslessly.
Dense shrink of 1/16–1/2 is the quant step — not a claim that F16 AQ1B is 16×.
Serve compressed: serve_aarm on an AARMv1 face. Never llama. Never GGUF expand for inference.
Byte count of the file we ship. Measured, not a class guess.
AhanaAI / AhanaZip compression. Bit-identical to the packed source. Serve the finished file — no secret recipe on this page.
AARMv1 is what serve_aarm loads. AQ1B is the lossless weight ship. We sell both when we make them well.
Finished sizes we measured. AhanaZip / AhanaAI lossless of the packed source.
Dense F16 1.198 GiB → 1.091 GiB finished. AhanaZip lossless of F16.
Quant source 0.434 GiB → 0.428 GiB finished. Smallest shop file.
Quant source 0.853 GiB → 0.844 GiB finished. Near 1-bit-class size.
Q4 source 2.497 GiB → 2.483 GiB finished. Lossless of Q4, not of F16.
Quant source 1.764 GiB → 1.748 GiB finished. Dated proven file only.
Dense F16 8.051 GiB → 7.358 GiB finished. AhanaZip lossless of F16.
These faces already load on our custom server. Chat is live on the 0.6B and 4B helm seats.
Dense F16-class ~1.20 GiB → 0.825 GiB finished. AhanaZip / AhanaAI. Live on AhanaBot.
Dense F16 8.05 GiB → 0.893 GiB (~9×). AhanaZip / AhanaAI. Serve compressed.
Dense F16-class ~3.4 GiB → 2.406 GiB finished. One-file serve container.
Lossless AQ1B of the source you give. Quant 1/16–1/2 if you want 1-bit-class size. Then Jeremiah wraps AARMv1 for serve_aarm.
Order a proven SKU Chat / assemble on AhanaBot
Not listed: 27B, 8B class guesses, Dual_Q1 as “lossless F16”, 9B/Gemma until sha+serve pass. Experts live on AhanaBot. Folder codec: AhanaZip.