Kaleto commited on
Commit
3913a87
·
verified ·
1 Parent(s): a27f353

Switch to NVFP4A16 (W4A16) — weight-only quant, 2-4x better KLD than W4A4 per community feedback

Browse files
Files changed (1) hide show
  1. config.json +1 -6
config.json CHANGED
@@ -39,12 +39,7 @@
39
  "quantization_config": {
40
  "config_groups": {
41
  "group_0": {
42
- "input_activations": {
43
- "dynamic": true,
44
- "num_bits": 4,
45
- "type": "float",
46
- "group_size": 16
47
- },
48
  "weights": {
49
  "dynamic": false,
50
  "num_bits": 4,
 
39
  "quantization_config": {
40
  "config_groups": {
41
  "group_0": {
42
+ "input_activations": null,
 
 
 
 
 
43
  "weights": {
44
  "dynamic": false,
45
  "num_bits": 4,