← Glossário
Glossário · AI

O que é STT?

Speech-to-Text

É a tecnologia que ouve palavras faladas e as converte em texto escrito.

Definição

O STT analisa as ondas sonoras e as traduz em palavras que o computador pode compreender. Esses sistemas produzem saída de texto analisando entonações e sotaques na fala humana.

Analogia: Ela é como a secretária mais rápida do mundo, fazendo anotações rápidas enquanto você fala e nunca se cansando.

Como funciona

Os dados de voz são recebidos através do microfone, a inteligência artificial analisa essa voz e escreve os textos correspondentes na tela.

Onde é usado

Ele é usado em aplicativos de anotações de reuniões, sistemas de comando de voz e ferramentas de legendagem.

Costuma ser confundido com

Misturado com síntese de voz (Text-to-Speech); Um converte som em texto, o outro converte texto em som.

Perguntas frequentes

Ele consegue entender idiomas diferentes?

Sim, os modelos STT modernos suportam vários idiomas e sotaques.

Funciona em ambientes barulhentos?

Os modelos avançados podem filtrar o ruído de fundo, mas a margem de erro pode aumentar em ambientes muito barulhentos.

Termos relacionados

Ferramentas relacionadas

Esta explicação foi escrita em linguagem simples para a TreScout e traduzida automaticamente do original em turco · a versão turca é a que vale. Se algo parecer errado ou faltando, escreva para hello@trescout.com. Ler em turco →