Exécutez des modèles d’IA sur votre ordinateur
Llama.cpp est une bibliothèque d'inférence basée sur C et C++ qui permet d'exécuter efficacement de grands modèles de langage sur du matériel standard. Le logiciel facilite l'exécution de modèles d'intelligence artificielle sur des appareils locaux grâce à sa faible utilisation de mémoire et sa structure orientée hautes performances.
Mises à jour
- 15 septembre 2026: Étoiles 127,101 → 128,278, dernière version v0.4.1 (14 septembre 2026).
- 5 septembre 2026: Étoiles 125,883 → 127,101, dernière version v0.4.0 (4 septembre 2026).
- 27 août 2026: Étoiles 125,068 → 125,883, dernière version v0.3.0 (25 août 2026).
- 22 août 2026: Étoiles 124,998 → 125,068, dernière version v0.2.0 (21 août 2026).
Ce que ça vous apporte
- Il exécute efficacement de grands modèles de langage sur du matériel standard.
- Fournit des performances élevées avec une faible utilisation de la mémoire.
- Facilite l’exécution de modèles d’IA sur des appareils locaux.
Installation
git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cppExécution
llama-cli -m my_model.ggufSi vous ne codez pas
Je souhaite exécuter de grands modèles de langage localement sur mon ordinateur. Comment puis-je exécuter mon propre fichier de modèle à l'aide de l'outil llama.cpp avec la commande «llama-cli -m my_model.gguf» ou télécharger et lancer un modèle directement depuis Hugging Face avec la commande «llama-cli -hf ggml-org/gemma-3-1b-it-GGUF» ? Pouvez-vous m'aider avec la configuration matérielle requise ou la sélection du modèle auquel je dois prêter attention dans ce processus ?
Termes liés du glossaire
Liens
TreScout n'a pas développé cet outil · nous l'avons repéré dans les tendances GitHub et présenté. Cette page décrit le dépôt tel qu'il était le 2026-06-08 : Le nombre d'étoiles et notre texte datent de ce jour, le dépôt a pu changer depuis. Consultez le lien du dépôt pour l'état actuel. Cette page a été traduite automatiquement depuis l’original turc · la version turque fait foi.