# Ejecute modelos de IA en su computadora

Llama.cpp es una biblioteca de inferencia basada en C y C++ que permite ejecutar modelos de lenguaje grandes de manera eficiente en hardware estándar. El software facilita la ejecución de modelos de inteligencia artificial en dispositivos locales con su bajo uso de memoria y su estructura orientada al alto rendimiento.

- ★ 127.101
- C++
- GitHub Trending · 2026-06-08

## Qué aporta
- Ejecuta modelos de lenguaje grandes de manera eficiente en hardware estándar.
- Proporciona un alto rendimiento con bajo uso de memoria.
- Facilita la ejecución de modelos de IA en dispositivos locales.

## Instalación
**Clonar código fuente**

```
git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cpp
```


## Ejecución
**Ejecutar modelo GGUF**

```
llama-cli -m my_model.gguf
```


## Si no programa
Quiero ejecutar modelos de lenguaje grandes localmente en mi computadora. ¿Cómo puedo ejecutar mi propio archivo de modelo usando la herramienta llama.cpp con el comando 'llama-cli -m my_model.gguf' o descargar e iniciar un modelo directamente desde Hugging Face con el comando 'llama-cli -hf ggml-org/gemma-3-1b-it-GGUF'? ¿Pueden ayudarme con los requisitos de hardware o la selección del modelo a los que debo prestar atención en este proceso?

## Términos relacionados del glosario

## Enlaces
- Repositorio en GitHub →
- Leer en turco →

---
Fuente: TreScout Descubrir · https://trescout.com/es/discover/llama-cpp/
