Open weights · Published checkpoints

Models built for on-prem inference.

Canonical model names; precision and packaging identified separately.

Published models

Hugging Face profile ↗
aidendle94 / model

GLM-5.2

NF4 Lloyd Experts · GPTQ

Lloyd-codebook NF4 routed experts quantized with activation-aware GPTQ and error feedback.

NF4GPTQExperts only
aidendle94 / model

GLM-5.2

Hybrid FP8 · NVFP4 · MXFP4

Mixed-precision checkpoint built for memory-constrained, multi-node inference on four DGX Spark systems.

425BMixed precisionDGX Spark
aidendle94 / model

GLM-5.2

MXFP4 Experts · GPTQ

Activation-calibrated MXFP4 expert weights for the GLM-5.2 mixture-of-experts architecture.

MXFP4GPTQExperts
aidendle94 / model

DiffusionGemma 26B-A4B-it

INT8 Dynamic

Dynamically quantized text-generation checkpoint of DiffusionGemma 26B-A4B-it.

26BINT8Text generation