Methodbaseline_with_sparsegpt_gptq_obs(self,percdamp=.01, sparsity_ratio=0.5,prune_n=0, prune_m = 0, blocksize=128,)
SpinQuant/eval_utils/obr_utils.py:109
Methodbaseline_with_sparsegpt_gptq_obs(self,percdamp=.01, sparsity_ratio=0.5,prune_n=0, prune_m = 0, blocksize=128,)
FlatQuant/flatquant/obr_utils.py:102
Functioneval_zero_shot(model_name, model, tokenizer, task_list=["boolq","rte","hellaswag","winogrande","arc_challenge","arc_easy","o
SpinQuant/ppl_utils.py:201
Functioneval_zero_shot(model_name, model, tokenizer, task_list=["boolq","rte","hellaswag","winogrande","arc_challenge","arc_easy","o
QuaRot/ppl_utils.py:204
Functioneval_zero_shot(model_name, model, tokenizer,
task_list=["boolq", "rte", "hellaswag", "winogrande", "arc_c
FlatQuant/flatquant/ppl_utils.py:207
Functionfind_qlayers(
module,
layers=[torch.nn.Linear, ActQuantWrapper, QuantizeLinear],
name: str = "",
)
SpinQuant/utils/quant_utils.py:538
Methodforward(self, hidden_states, attention_mask, position_ids, past_key_value,
output_attentions, use_cache,
FlatQuant/flatquant/model_tools/llama31_utils.py:200