# Execute modelos de IA em seu computador

Llama.cpp é uma biblioteca de inferência baseada em C e C++ que permite que grandes modelos de linguagem sejam executados com eficiência em hardware padrão. O software facilita a execução de modelos de inteligência artificial em dispositivos locais com baixo uso de memória e estrutura orientada para alto desempenho.

- ★ 127.101
- C++
- GitHub Trending · 2026-06-08

## O que você ganha
- Ele executa modelos de linguagem grandes com eficiência em hardware padrão.
- Fornece alto desempenho com baixo uso de memória.
- Facilita a execução de modelos de IA em dispositivos locais.

## Instalação
**Clonar código-fonte**

```
git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cpp
```


## Execução
**Executar modelo GGUF**

```
llama-cli -m my_model.gguf
```


## Se você não programa
Quero executar modelos de linguagem grandes localmente no meu computador. Como posso executar meu próprio arquivo de modelo usando a ferramenta llama.cpp com o comando 'llama-cli -m my_model.gguf' ou baixar e iniciar um modelo diretamente do Hugging Face com o comando 'llama-cli -hf ggml-org/gemma-3-1b-it-GGUF'? Você pode me ajudar com os requisitos de hardware ou seleção de modelo aos quais devo prestar atenção neste processo?

## Termos relacionados do glossário

## Links
- Repositório no GitHub →
- Ler em turco →

---
Fonte: TreScout Descobrir · https://trescout.com/pt/discover/llama-cpp/
