Hacker News AIT2·68 pts
LittleBit-2 Achieves Sub-1-Bit LLM Compression via Latent Geometry Alignment in Low-Rank Factorization
Original: Sub-1-Bit LLM Compression via Latent Factorization
- Achieves sub-1-bit compression (0.1 to 1.0 bits/weight) using low-rank latent factorization combined with binarization.
- LittleBit-2 employs Joint-ITQ to correct geometric misalignment in SVD-derived factors, significantly improving quantization accuracy.
- The method requires no architectural changes at inference time and incurs zero additional computational overhead, facilitating easy integration.