¿Qué es Computer Vision?
Es una tecnología que permite a las computadoras analizar datos visuales (fotos, videos) y dar sentido a los objetos, personas o eventos que contienen.
Definición
La visión por computadora permite a la inteligencia artificial ver e interpretar el mundo como un humano. Analiza no sólo los píxeles, sino también lo que significan esos píxeles (por ejemplo, un gato o un accidente de tráfico). Gracias a esta tecnología, las máquinas pueden procesar el mundo visual.
Cómo funciona
Los datos visuales pasan a través de redes neuronales artificiales. El modelo clasifica o localiza objetos en la imagen basándose en millones de ejemplos que ha visto en el pasado.
Dónde se usa
Se utiliza en vehículos autónomos, sistemas de reconocimiento facial, imágenes médicas y cámaras de seguridad.
Suele confundirse con
Se puede mezclar con multimodal; multimodal puede procesar tanto texto como imágenes, mientras que la visión por computadora está orientada visualmente.
Preguntas frecuentes
¿Puede la visión por computadora verlo todo?
No, es tan exitoso como los datos con los que se entrena.
¿Provoca un reconocimiento incorrecto?
Sí, puede confundirse con imágenes de baja calidad o con un objeto que nunca antes ha visto.
Términos relacionados
Herramientas relacionadas
Esta explicación se redactó en lenguaje sencillo para TreScout y se tradujo automáticamente del original en turco · prevalece la versión turca. Si algo le parece erróneo o incompleto, escriba a hello@trescout.com. Leer en turco →