# Führen Sie KI-Modelle auf Ihrem Computer aus

Llama.cpp ist eine C- und C++-basierte Inferenzbibliothek, die die effiziente Ausführung großer Sprachmodelle auf Standardhardware ermöglicht. Die Software erleichtert durch ihren geringen Speicherverbrauch und ihre hochleistungsorientierte Struktur die Ausführung von Modellen der künstlichen Intelligenz auf lokalen Geräten.

- ★ 127.101
- C++
- GitHub Trending · 2026-06-08

## Was es bringt
- Es führt große Sprachmodelle effizient auf Standardhardware aus.
- Bietet hohe Leistung bei geringer Speichernutzung.
- Erleichtert die Ausführung von KI-Modellen auf lokalen Geräten.

## Installation
**Quellcode klonen**

```
git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cpp
```


## Ausführung
**GGUF-Modell ausführen**

```
llama-cli -m my_model.gguf
```


## Wenn Sie nicht programmieren
Ich möchte große Sprachmodelle lokal auf meinem Computer ausführen. Wie kann ich meine eigene Modelldatei mit dem Tool llama.cpp mit dem Befehl „llama-cli -m my_model.gguf“ ausführen oder mit dem Befehl „llama-cli -hf ggml-org/gemma-3-1b-it-GGUF“ ein Modell direkt von Hugging Face herunterladen und starten? Können Sie mir bei den Hardwareanforderungen oder der Modellauswahl helfen, auf die ich in diesem Prozess achten sollte?

## Verwandte Begriffe aus dem Glossar

## Links
- GitHub-Repository →
- Auf Türkisch lesen →

---
Quelle: TreScout Entdecken · https://trescout.com/de/discover/llama-cpp/
