# Exécutez des modèles d’IA sur votre ordinateur

Llama.cpp est une bibliothèque d'inférence basée sur C et C++ qui permet d'exécuter efficacement de grands modèles de langage sur du matériel standard. Le logiciel facilite l'exécution de modèles d'intelligence artificielle sur des appareils locaux grâce à sa faible utilisation de mémoire et sa structure orientée hautes performances.

- ★ 123 019
- C++
- GitHub Trending · 2026-06-08

## Mise à jour
- 7 août 2026 : Star 122.941 → 123.019, dernière version b10326 (7 août 2026).
- 7 août 2026 : Star 122.872 → 122.941, dernière version b10298 (6 août 2026).
- 6 août 2026 : Star 122.866 → 122.872, dernière version b10293 (6 août 2026).
- 6 août 2026 : Star 122.857 → 122.866, dernière version b10291 (6 août 2026).

## Ce que ça vous apporte
- Il exécute efficacement de grands modèles de langage sur du matériel standard.
- Fournit des performances élevées avec une faible utilisation de la mémoire.
- Facilite l’exécution de modèles d’IA sur des appareils locaux.

## Si vous ne codez pas
Je souhaite exécuter de grands modèles de langage localement sur mon ordinateur. Comment puis-je exécuter mon propre fichier de modèle à l'aide de l'outil llama.cpp avec la commande «llama-cli -m my_model.gguf» ou télécharger et lancer un modèle directement depuis Hugging Face avec la commande «llama-cli -hf ggml-org/gemma-3-1b-it-GGUF» ? Pouvez-vous m'aider avec la configuration matérielle requise ou la sélection du modèle auquel je dois prêter attention dans ce processus ?

## Termes liés du glossaire

## Liens
- Dépôt GitHub →
- Lire en turc →

---
Source : TreScout Découvrir · https://trescout.com/fr/discover/llama-cpp/
