In my evals 8 bit quantized smaller Qwen models were better, but again evaluating is hard.
I think they should’ve named it something else.
In my evals 8 bit quantized smaller Qwen models were better, but again evaluating is hard.