Technologie
Statut éditorial : En attente de relecturellama.cpp
Moteur d’inférence C/C++ optimisé pour exécuter des modèles GGUF sur de nombreux matériels, du CPU au GPU.
Classification de la technologie
Type
Technologie
Autres noms : llama cpp
llama.cpp fournit des outils et une bibliothèque C/C++ pour l’inférence locale. Son format GGUF et ses mécanismes de quantification sont utilisés par de nombreux outils de l’écosystème, dont Ollama.
- Licence
- MIT
- Langage principal
- C++
- État des informations
- Vérifiées récemment
- Dernière vérification
- 10 août 2026