Com a evolução de modelos como DeepSeek-V3, Qwen 2.5-Coder e Llama 3.3, treinar modelos menores (SLMs) tornou-se a estratégia mais econômica e segura sob a LGPD.

1. Pipeline QLoRA com Unsloth

Treinamento em 4-bit com economia de VRAM e fusão de adaptadores LoRA para exportação em GGUF e deploy em vLLM.