← Glossário
Glossário · AI

O que é Diffusion Model?

É um método de inteligência artificial que produz imagens limpas e significativas a partir de dados ruidosos.

Definição

Os modelos de difusão são sistemas generativos de inteligência artificial que podem criar imagens significativas a partir de ruído aleatório, ou seja, uma tela formigante. Ele aprende limpando os dados passo a passo e eventualmente revela a imagem desejada.

Analogia: É como se um escultor retirasse lentamente o excesso de um bloco de mármore e revelasse a escultura em seu interior. O modelo descobre padrões de ruído e os esclarece.

Como funciona

Durante o treinamento, o modelo adiciona gradualmente ruído às imagens, tornando-as completamente confusas. Então ele aprende a reverter esse processo; isto é, reconstrói a imagem original a partir de um conjunto de pontos ruidosos.

Onde é usado

DALL-E é usado em ferramentas de renderização como Midjourney e Stable Diffusion.

Costuma ser confundido com

É confundido com GAN (Generative Adversarial Networks), mas os modelos de difusão produzem resultados mais estáveis ​​e de alta qualidade.

Perguntas frequentes

Produz apenas imagens?

É principalmente focado visualmente, mas também pode ser adaptado para produção de áudio e vídeo.

Por que requer tanto poder de processamento?

Construir a imagem passo a passo requer intenso poder de processamento, pois requer cálculo matemático de milhões de pixels.

Termos relacionados

Esta explicação foi escrita em linguagem simples para a TreScout e traduzida automaticamente do original em turco · a versão turca é a que vale. Se algo parecer errado ou faltando, escreva para hello@trescout.com. Ler em turco →