Technologie

Statut éditorial : En attente de relecture

llama.cpp

Moteur d’inférence C/C++ optimisé pour exécuter des modèles GGUF sur de nombreux matériels, du CPU au GPU.

Classification de la technologie

Type

  • Intelligence artificielle

Technologie

  • llama.cpp

Autres noms : llama cpp

llama.cpp fournit des outils et une bibliothèque C/C++ pour l’inférence locale. Son format GGUF et ses mécanismes de quantification sont utilisés par de nombreux outils de l’écosystème, dont Ollama.

Licence
MIT
Langage principal
C++
État des informations
Vérifiées récemment
Dernière vérification
10 août 2026

Sources utilisées