En finjusteringsteknik som kombinerar 4-bitars viktkvantisering med LoRA-adaptrar för att minska minnesbehovet.