# Execute modelos gigantes de IA com 4 GB de VRAM

AirLLM permite que grandes modelos de linguagem com 70 bilhões de parâmetros sejam executados em unidades de processamento gráfico com apenas 4 GB de memória de vídeo (VRAM). Esta biblioteca utiliza técnicas de otimização de memória para permitir o uso de modelos de alta capacidade com baixos requisitos de hardware.

- ★ 33.755
- Jupyter Notebook
- GitHub Trending · 2026-06-04

## O que você ganha
- Possibilidade de rodar modelos com parâmetros de 70B com 4GB VRAM.
- Capacidade de usar modelos 405B Llama3.1 com 8 GB VRAM.
- Aumento de velocidade de até 3x com compactação baseada em bloco.

## Instalação
**com pip (PyPI)**

```
pip install airllm
```


## Se você não programa
Quero rodar um modelo com parâmetros de 70B usando a biblioteca AirLLM na minha placa gráfica com baixa capacidade de VRAM. Usei o comando pip install airllm para instalação. Como posso criar a estrutura de código Python necessária para carregar meu modelo e produzi-lo com uma entrada de texto simples, usando a classe AutoModel? Eu sei que preciso ter espaço em disco suficiente durante o processo. Você pode explicar as etapas básicas que preciso seguir para iniciar o processo?

## Termos relacionados do glossário

## Links
- Repositório no GitHub →
- Ler em turco →

---
Fonte: TreScout Descobrir · https://trescout.com/pt/discover/airllm/
