# O que é Inference Server?

É um sistema de servidor especializado onde modelos de inteligência artificial são executados para gerar respostas a perguntas recebidas.

## Definição
Depois que um modelo de inteligência artificial é treinado, ele precisa estar em execução contínua para que os usuários possam fazer perguntas e obter respostas. O servidor de inferência é um centro de computação poderoso que hospeda esse modelo, processa rapidamente os dados recebidos e retorna resultados. Esses sistemas podem otimizar o desempenho do modelo e atender a muitas pessoas simultaneamente.

## Como funciona
O modelo necessário é carregado neste servidor e configurado para atender às perguntas que chegam por meio de uma porta (API). O servidor traduz a pergunta recebida para a linguagem que o modelo entende, executa o modelo e envia a resposta gerada de volta ao usuário.

## Onde é usado
É utilizado em segundo plano em aplicações com suporte de inteligência artificial em plataformas de computação em nuvem ou nos próprios centros de dados de grandes empresas.

## Costuma ser confundido com
Não é apenas um computador, mas uma infraestrutura especializada otimizada para o funcionamento do modelo.

## Perguntas frequentes
**Por que um computador comum não é suficiente?**
Os modelos de inteligência artificial exigem muito poder de processamento e memória, por isso são necessários servidores com hardware especializado.

**É a mesma coisa que o treinamento do modelo?**
Não, o treinamento é o processo de aprendizado do modelo, enquanto a inferência é o processo de usar o que foi aprendido.


## Termos relacionados
- [Inference](/pt/dictionary/inference/)
- [AI Models](/pt/dictionary/ai-models/)
- [Deployment](/pt/dictionary/deployment/)

## Ferramentas relacionadas
- [Magnitude](/pt/discover/magnitude/)
- [SIE](/pt/discover/sie/)

---
Fonte: TreScout Glossário · https://trescout.com/pt/dictionary/inference-server/
