shinigamiRaj commited on
Commit
ca8792c
·
verified ·
1 Parent(s): 24671e7

Upload GPTQ quantized LLaMA-3.2-1B model

Browse files
Files changed (2) hide show
  1. config.json +1 -1
  2. quantize_config.json +1 -1
config.json CHANGED
@@ -56,7 +56,7 @@
56
  "moe_vram_strategy_devices": null,
57
  "mse": 0.0,
58
  "offload_to_disk": true,
59
- "offload_to_disk_path": "/tmp/gptqmodel_npg1jh3l",
60
  "pack_impl": "cpu",
61
  "quantizer": [
62
  "gptqmodel:7.0.0"
 
56
  "moe_vram_strategy_devices": null,
57
  "mse": 0.0,
58
  "offload_to_disk": true,
59
+ "offload_to_disk_path": "/tmp/gptqmodel_no95wic7",
60
  "pack_impl": "cpu",
61
  "quantizer": [
62
  "gptqmodel:7.0.0"
quantize_config.json CHANGED
@@ -27,7 +27,7 @@
27
  "smooth": null
28
  },
29
  "offload_to_disk": true,
30
- "offload_to_disk_path": "/tmp/gptqmodel_npg1jh3l",
31
  "pack_impl": "cpu",
32
  "gc_mode": "interval",
33
  "wait_for_submodule_finalizers": false,
 
27
  "smooth": null
28
  },
29
  "offload_to_disk": true,
30
+ "offload_to_disk_path": "/tmp/gptqmodel_no95wic7",
31
  "pack_impl": "cpu",
32
  "gc_mode": "interval",
33
  "wait_for_submodule_finalizers": false,