Directe omzetting van spraak naar spraak door een voicebot. Hierbij wordt spraak niet omgezet naar tekst waarna gebruik wordt gemaakt van een kennisbank, maar wordt gewerkt met spraaktokens. Dat leidt tot een snellere verwerking dan bij het alternatieve cascase-model. Bij speech-to-speech blijven intonatie en emotie behouden als informatiebron. Deze technologie werkt met een groot spraakmodel dat getraind is met grote hoeveelheden spraak.
Zie ook cascade-model, voicebot, spraakherkenning, voice activity detection, LLM
Terug naar startpagina woordenboek
