Model Card
- Base model:
meta-llama/Meta-Llama-3-8B
- Quantization method: LNQ
- Target bit-width: 2
- Backend kernel: Any-Precision-LLM kernel (
ap-gemv)
- Calibration data: RedPajama (1024 sentences / 4096 tokens)
- Calibration objective: Next-token prediction
How to run
References
Model tree for jusjinuk/Meta-Llama-3-8B-2bit-LNQ
Collection including jusjinuk/Meta-Llama-3-8B-2bit-LNQ
Paper for jusjinuk/Meta-Llama-3-8B-2bit-LNQ