v1.1.x: optional --int8 dynamic quant (CPU, ~2x smaller memory 708->325MB, identical output) + README note 7eefdb1 verified kdirgul commited on Jun 27
v1.1: CPU support — pure-PyTorch lamba_cpu.py (decode-cache, no Triton) + lamba_rag.py --device cpu + README/notebook b3f62e8 verified kdirgul commited on Jun 27