GGUF remplace bitsandbytes pour l'entraînement LoRA à faible VRAM sur matériel local
De nouvelles techniques permettent d'entraîner des modèles massifs Qwen et DeepSeek avec une VRAM limitée en utilisant les formats de base GGUF, éliminant ainsi le besoin de déchargement CPU sur certains matériels.





