ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-GGUF Image-Text-to-Text • 177B • Updated 9 days ago • 3.41M • 707
ISTA-DASLab/Qwen3.8-Flash-Next-GSQ-RCO-Coder-GGUF Image-Text-to-Text • 117B • Updated 9 days ago • 600k • 345
view article Article KV Caching Explained: Optimizing Transformer Inference Efficiency not-lain • Jan 30, 2025 • 428
Abiray/MiniCPM5-2B-heretic-abliterated-GGUF Text Generation • 3B • Updated about 1 month ago • 28k • 39
ivanfioravanti/Qwen3.8-Flash-Next-DS4-IQ2 Image-Text-to-Text • 136B • Updated about 1 month ago • 18.5k • 18
Jiunsong/SuperQwen3.8-27b-abliterated-MLX-4bit Image-Text-to-Text • 27B • Updated Aug 24 • 1.29k • 30