# O que é Inference Engine?

Um mecanismo de software que usa um modelo de inteligência artificial treinado para produzir previsões ou resultados com base em novas entradas fornecidas a ele.

## Definição
Depois que os modelos de inteligência artificial são treinados, o mecanismo que funciona em segundo plano enquanto os utiliza ao vivo é chamado de mecanismo de inferência. Este mecanismo fornece respostas rápidas e precisas às perguntas usando os pesos do modelo. O cérebro do modelo é esse motor, que são as cordas vocais que lhe permitem falar.

## Como funciona
Os arquivos de modelo são carregados no sistema e o mecanismo de inferência processa as solicitações recebidas otimizando esses arquivos. Ele garante que a resposta chegue até você usando recursos de hardware (GPU/CPU) da maneira mais eficiente.

## Onde é usado
Ele está disponível em serviços de IA, APIs baseadas em nuvem e aplicativos de IA executados localmente.

## Costuma ser confundido com
Confunde-se com o próprio modelo; O modelo é a informação, o motor é o sistema que utiliza essa informação.

## Perguntas frequentes
**Por que usamos um mecanismo separado?**
Porque os modelos brutos são muito grandes; os motores os aceleram e os otimizam.

**Isso afeta minha velocidade?**
Sim, um bom mecanismo de inferência faz o modelo responder mais rápido.


## Termos relacionados
- [Inference](/pt/dictionary/inference/)
- [LLM](/pt/dictionary/llm/)
- [AI Models](/pt/dictionary/ai-models/)

## Ferramentas relacionadas
- [Ds4](/pt/discover/ds4/)

---
Fonte: TreScout Glossário · https://trescout.com/pt/dictionary/inference-engine/
