Add support for loading quantized model 2e1be30
duzx16 commited on
How to use silver/chatglm-6b-slim with Transformers:
# Load model directly
from transformers import AutoModel
model = AutoModel.from_pretrained("silver/chatglm-6b-slim", trust_remote_code=True, device_map="auto")