Execute modelos de IA em seu computador
Llama.cpp é uma biblioteca de inferência baseada em C e C++ que permite que grandes modelos de linguagem sejam executados com eficiência em hardware padrão. O software facilita a execução de modelos de inteligência artificial em dispositivos locais com baixo uso de memória e estrutura orientada para alto desempenho.
Atualizações
- 5 de setembro de 2026: Estrelas 125,883 → 127,101, versão mais recente v0.4.0 (4 de setembro de 2026).
- 27 de agosto de 2026: Estrelas 125,068 → 125,883, versão mais recente v0.3.0 (25 de agosto de 2026).
- 22 de agosto de 2026: Estrelas 124,998 → 125,068, versão mais recente v0.2.0 (21 de agosto de 2026).
- 21 de agosto de 2026: Estrelas 124,919 → 124,998, versão mais recente b10549 (21 de agosto de 2026).
O que você ganha
- Ele executa modelos de linguagem grandes com eficiência em hardware padrão.
- Fornece alto desempenho com baixo uso de memória.
- Facilita a execução de modelos de IA em dispositivos locais.
Instalação
git clone https://github.com/ggml-org/llama.cpp.git
cd llama.cppExecução
llama-cli -m my_model.ggufSe você não programa
Quero executar modelos de linguagem grandes localmente no meu computador. Como posso executar meu próprio arquivo de modelo usando a ferramenta llama.cpp com o comando 'llama-cli -m my_model.gguf' ou baixar e iniciar um modelo diretamente do Hugging Face com o comando 'llama-cli -hf ggml-org/gemma-3-1b-it-GGUF'? Você pode me ajudar com os requisitos de hardware ou seleção de modelo aos quais devo prestar atenção neste processo?
Termos relacionados do glossário
Links
A TreScout não desenvolveu esta ferramenta · nós a encontramos nas tendências do GitHub e a apresentamos. Esta página descreve o repositório em 2026-06-08: A contagem de estrelas e o nosso texto são daquele dia, o repositório pode ter mudado desde então. Consulte o link do repositório para ver o estado atual. Esta página foi traduzida automaticamente do original em turco · a versão turca é a que vale.