Sub-1-Bit LLM Compression via Latent Factorization
A research paper outlines a technique for sub-1-bit large language model compression utilizing latent factorization.
A research paper outlines a technique for sub-1-bit large language model compression utilizing latent factorization.