O que é STT?
Speech-to-Text
É a tecnologia que ouve palavras faladas e as converte em texto escrito.
Definição
O STT analisa as ondas sonoras e as traduz em palavras que o computador pode compreender. Esses sistemas produzem saída de texto analisando entonações e sotaques na fala humana.
Como funciona
Os dados de voz são recebidos através do microfone, a inteligência artificial analisa essa voz e escreve os textos correspondentes na tela.
Onde é usado
Ele é usado em aplicativos de anotações de reuniões, sistemas de comando de voz e ferramentas de legendagem.
Costuma ser confundido com
Misturado com síntese de voz (Text-to-Speech); Um converte som em texto, o outro converte texto em som.
Perguntas frequentes
Ele consegue entender idiomas diferentes?
Sim, os modelos STT modernos suportam vários idiomas e sotaques.
Funciona em ambientes barulhentos?
Os modelos avançados podem filtrar o ruído de fundo, mas a margem de erro pode aumentar em ambientes muito barulhentos.
Termos relacionados
Ferramentas relacionadas
Esta explicação foi escrita em linguagem simples para a TreScout e traduzida automaticamente do original em turco · a versão turca é a que vale. Se algo parecer errado ou faltando, escreva para hello@trescout.com. Ler em turco →