O que é Diffusion Model?
É um método de inteligência artificial que produz imagens limpas e significativas a partir de dados ruidosos.
Definição
Os modelos de difusão são sistemas generativos de inteligência artificial que podem criar imagens significativas a partir de ruído aleatório, ou seja, uma tela formigante. Ele aprende limpando os dados passo a passo e eventualmente revela a imagem desejada.
Como funciona
Durante o treinamento, o modelo adiciona gradualmente ruído às imagens, tornando-as completamente confusas. Então ele aprende a reverter esse processo; isto é, reconstrói a imagem original a partir de um conjunto de pontos ruidosos.
Onde é usado
DALL-E é usado em ferramentas de renderização como Midjourney e Stable Diffusion.
Costuma ser confundido com
É confundido com GAN (Generative Adversarial Networks), mas os modelos de difusão produzem resultados mais estáveis e de alta qualidade.
Perguntas frequentes
Produz apenas imagens?
É principalmente focado visualmente, mas também pode ser adaptado para produção de áudio e vídeo.
Por que requer tanto poder de processamento?
Construir a imagem passo a passo requer intenso poder de processamento, pois requer cálculo matemático de milhões de pixels.
Termos relacionados
Esta explicação foi escrita em linguagem simples para a TreScout e traduzida automaticamente do original em turco · a versão turca é a que vale. Se algo parecer errado ou faltando, escreva para hello@trescout.com. Ler em turco →