← Glossário
Glossário · AI

O que é Text-to-Speech?

TTS

É a vocalização de textos escritos com voz humana por inteligência artificial.

Definição

Text-to-Speech é uma tecnologia que permite que textos escritos sejam lidos por inteligência artificial em uma voz humana natural e fluente. Essa tecnologia oferece grande comodidade para quem tem dificuldade de leitura ou tem mãos ocupadas.

Analogia: É como se alguém virasse as páginas de um livro e lesse o texto em voz alta para você, como se você estivesse na frente dele.

Como funciona

O texto escrito é analisado, os acentos e as entonações são determinados. O modelo de inteligência artificial então converte esse texto em ondas sonoras e o torna audível pelo alto-falante.

Onde é usado

É usado constantemente em aplicativos de audiolivros, dispositivos de navegação e assistentes digitais.

Costuma ser confundido com

É mixado com gravação de áudio; No entanto, esta tecnologia não é um som pré-gravado, mas sim um som produzido instantaneamente.

Perguntas frequentes

Por que as vozes às vezes parecem robóticas?

A naturalidade pode variar dependendo da qualidade do modelo utilizado e da diversidade do conjunto de dados sobre o qual é treinado.

Posso usar minha própria voz?

Sim, com as tecnologias de clonagem de voz, você pode introduzir sua própria voz no sistema e fazer com que os textos sejam lidos com sua própria voz.

Termos relacionados

Ferramentas relacionadas

Esta explicação foi escrita em linguagem simples para a TreScout e traduzida automaticamente do original em turco · a versão turca é a que vale. Se algo parecer errado ou faltando, escreva para hello@trescout.com. Ler em turco →