lm-sys/FastChat

support for 4bit quantization from transfomer library.

Ouverte

#1 798 ouverte le 27 juin 2023

 (7 commentaires) (2 réactions) (0 personne assignée)Python (4 736 forks)batch import
enhancementgood first issue

Métriques du dépôt

Stars
 (38 959 étoiles)
Métriques de merge PR
 (Métriques PR en attente)

Description

Loading a vicuna13B using 4bit quantization from the transformers library is possible load_in_4bit. How difficult could be for Fastach to support it?

Guide contributeur