# Was ist Speech Synthesis?

Dabei handelt es sich um die Technologie der künstlichen Intelligenz, geschriebene Texte in menschliche Stimmen umzuwandeln.

## Definition
Sprachsynthese ist der allgemeine Fachbegriff, der sich auf die Umwandlung geschriebener Texte in künstliche Schallwellen mithilfe künstlicher Intelligenz bezieht. Es ist der wissenschaftliche und technische Name der Text-to-Speech-Technologie.

## So funktioniert es
Der Text wird anhand grammatikalischer Regeln und Phoneme verarbeitet. Anschließend werden diese Einheiten kombiniert, um einen natürlichen Sprachfluss zu erzeugen.

## Wo es eingesetzt wird
Es ist ein grundlegender Baustein für Barrierefreiheitstools, automatisierte Callcenter und die Produktion digitaler Inhalte.

## Häufig verwechselt mit
Es wird mit reinem Voiceover verwechselt; Allerdings handelt es sich bei diesem Vorgang um eine komplexe mathematische Berechnung, die auch die Bedeutung und Hervorhebung des Textes berechnet.

## Häufige Fragen
**Was ist der Unterschied zwischen Sprachsynthese und Text-to-Speech?**
Es ist dasselbe; Das eine ist der technische Prozess und das andere ist der angewandte Name dieses Prozesses, der dem Benutzer präsentiert wird.

**Kann es Emotionen im Klang widerspiegeln?**
Ja, fortgeschrittene Modelle können Emotionen im Text, wie etwa Traurigkeit oder Aufregung, in Ton umwandeln.


## Verwandte Begriffe
- [Text-to-Speech](/de/dictionary/text-to-speech/)
- [Voice Cloning](/de/dictionary/voice-cloning/)
- [NLP](/de/dictionary/nlp/)

---
Quelle: TreScout Glossar · https://trescout.com/de/dictionary/speech-synthesis/
