O que é Computer Vision?
É uma tecnologia que permite aos computadores analisar dados visuais (fotos, vídeos) e dar sentido aos objetos, pessoas ou eventos neles contidos.
Definição
A visão computacional permite que a inteligência artificial veja e interprete o mundo como um ser humano. Ele analisa não apenas os pixels, mas também o que esses pixels significam (por exemplo, um gato ou um acidente de trânsito). Graças a esta tecnologia, as máquinas podem processar o mundo visual.
Como funciona
Os dados visuais são transmitidos por redes neurais artificiais. O modelo classifica ou localiza objetos na imagem com base em milhões de exemplos que viu no passado.
Onde é usado
É utilizado em veículos autônomos, sistemas de reconhecimento facial, imagens médicas e câmeras de segurança.
Costuma ser confundido com
Pode ser misturado com multimodal; multimodal pode processar texto e imagens, enquanto a visão computacional é orientada visualmente.
Perguntas frequentes
A visão computacional pode ver tudo?
Não, é tão bem-sucedido quanto os dados nos quais é treinado.
Isso causa reconhecimento incorreto?
Sim, pode ser confundido com imagens de baixa qualidade ou com um objeto que nunca viu antes.
Termos relacionados
Ferramentas relacionadas
Esta explicação foi escrita em linguagem simples para a TreScout e traduzida automaticamente do original em turco · a versão turca é a que vale. Se algo parecer errado ou faltando, escreva para hello@trescout.com. Ler em turco →