En finjusteringsteknikk som kombinerer 4-bits vektkvantisering med LoRA-adaptere for å redusere minnebehov.