TurboQuant kompresuje LLM KV keš na 3 bita bez gubitka tačnostiGoogle Research objavio TurboQuant, kompresionu metodu za LLM KV keš koja svodi podatke na 3 bita i smanjuje memorijske zahteve do 6x bez gubitka tačnosti.25. mart 2026.56 sekundi čitanja