diff --git a/src/msquant/core/quantizer/engine.py b/src/msquant/core/quantizer/engine.py index 3037349..a21d486 100644 --- a/src/msquant/core/quantizer/engine.py +++ b/src/msquant/core/quantizer/engine.py @@ -108,7 +108,7 @@ def build_recipe(config: QuantizationConfig): "weights": { "num_bits": config.w_bit, "type": "int", - "symmetric": config.zero_point, + "symmetric": not config.zero_point, "strategy": "group", "group_size": config.group_size, }, @@ -146,10 +146,10 @@ def run(config: QuantizationConfig, logger: QuantizationLogger): if config.calib_config: oneshot_kwargs["dataset_config_name"] = config.calib_config - + if config.calib_split: - oneshot_kwargs["dataset_split"] = config.calib_split - + oneshot_kwargs["splits"] = {"calibration": config.calib_split} + logger.info("Starting LLM-Compressor oneshot() with AWQ", { "model": oneshot_kwargs["model"], "dataset": oneshot_kwargs["dataset"], @@ -220,10 +220,10 @@ def run(config: QuantizationConfig, logger: QuantizationLogger): if config.calib_config: oneshot_kwargs["dataset_config_name"] = config.calib_config - + if config.calib_split: - oneshot_kwargs["dataset_split"] = config.calib_split - + oneshot_kwargs["splits"] = {"calibration": config.calib_split} + logger.info("Starting LLM-Compressor oneshot() with FP4 quantization", { "model": oneshot_kwargs["model"], "dataset": oneshot_kwargs["dataset"],