quantize linear (#250)

2025-12-14 17:28:59 +08:00 · 2024-01-07 18:48:59 -08:00
parent 737b4c81a3
commit 485fb9ac0f
2 changed files with 0 additions and 5 deletions
--- a/lora/convert.py
+++ b/lora/convert.py
@@ -28,8 +28,6 @@ def quantize(weights, config, args):
        model,
        args.q_group_size,
        args.q_bits,
        linear_class_predicate=lambda m: isinstance(m, nn.Linear)
        and m.weight.shape[0] != config["vocab_size"],
    )
    # Update the config:
--- a/lora/lora.py
+++ b/lora/lora.py
@@ -339,9 +339,6 @@ def load_model(folder: str):
        model_args = ModelArgs(**config)
    model = Model(model_args)
    if quantization is not None:
        quantization["linear_class_predicate"] = lambda m: isinstance(
            m, nn.Linear
        ) and (m.weight.shape[0] != model_args.vocab_size)
        nn.QuantizedLinear.quantize_module(model, **quantization)
    weights = mx.load(str(model_path / "weights.npz"))