Upload GPTQ quantized LLaMA-3.2-1B model
Browse files- config.json +1 -1
- quantize_config.json +1 -1
config.json
CHANGED
|
@@ -56,7 +56,7 @@
|
|
| 56 |
"moe_vram_strategy_devices": null,
|
| 57 |
"mse": 0.0,
|
| 58 |
"offload_to_disk": true,
|
| 59 |
-
"offload_to_disk_path": "/tmp/
|
| 60 |
"pack_impl": "cpu",
|
| 61 |
"quantizer": [
|
| 62 |
"gptqmodel:7.0.0"
|
|
|
|
| 56 |
"moe_vram_strategy_devices": null,
|
| 57 |
"mse": 0.0,
|
| 58 |
"offload_to_disk": true,
|
| 59 |
+
"offload_to_disk_path": "/tmp/gptqmodel_no95wic7",
|
| 60 |
"pack_impl": "cpu",
|
| 61 |
"quantizer": [
|
| 62 |
"gptqmodel:7.0.0"
|
quantize_config.json
CHANGED
|
@@ -27,7 +27,7 @@
|
|
| 27 |
"smooth": null
|
| 28 |
},
|
| 29 |
"offload_to_disk": true,
|
| 30 |
-
"offload_to_disk_path": "/tmp/
|
| 31 |
"pack_impl": "cpu",
|
| 32 |
"gc_mode": "interval",
|
| 33 |
"wait_for_submodule_finalizers": false,
|
|
|
|
| 27 |
"smooth": null
|
| 28 |
},
|
| 29 |
"offload_to_disk": true,
|
| 30 |
+
"offload_to_disk_path": "/tmp/gptqmodel_no95wic7",
|
| 31 |
"pack_impl": "cpu",
|
| 32 |
"gc_mode": "interval",
|
| 33 |
"wait_for_submodule_finalizers": false,
|