Magnitude : un moteur d’inférence open source qui s’adapte automatiquement à votre matériel
Magnitude compile et optimise les kernels directement sur l’appareil pour exécuter des modèles ouverts jusqu’à deux fois plus vite que llama.cpp, sur Apple Silicon, NVIDIA, AMD et configurations CPU.
