VPS - Voice Processing Solution
Die Voice Processing Solution (VPS) von e.sigma ist ein leistungsstarkes Sprachverarbeitungssystem, das aus 4 Modulen besteht. Diese Module bieten jeweils eine Spracherkennungskomponente (STT - Speech-To-Text), ein Übersetzungssystem, eine Sprachgenerierkomponente (TTS - Text-To-Speech) und eine Intention-Klassifizierung an. Alle Module agieren offline und benötigen keinen Internet-Zugriff, was eine sichere Nutzung ohne Datenexposition gewährleistet.
Die Kombination der verschiedenen Module eröffnet sämtliche Möglichkeiten zur Entwicklung professioneller Applikationen – zum Beispiel eines Dialogsystems, die Steuerung grafischer Oberflächen oder natürliche Sprachschnittstellen für die Ausbildung und Überwachung im Phraseologie-Training.
Jedes Modul ist als Docker Container gekapselt, was eine einfache Integration und Skalierung ermöglicht. Mit einem jeweiligen RestAPI werden alle benötigten Funktionen umgesetzt und können transparent, je nach Anforderung, aufgerufen werden.
VPS bietet die folgenden Vorteile für einen erfolgreichen Einsatz
- Echtzeitfähige state-of-the-art, sprecher-unabhängige Spracherkennung
- Schnelle und einfache Erstellung von kundenspezifischen Sprechern (TTS)
- Intention-Klassifizierung für robuste Kommando-Schnittstelle
- Übersetzungssystem für über 20 Sprachkombinationen
- Web-basierte Übersetzungsapplikation
Technische Funktionen und operationellen Vorteile
- einfache Integration durch Docker Container
- RestAPI-Unterstützung für alle Funktionen
- Kundenspezifisches Training von Intention-Klassifizierer (xml2icsf)
- XML-Beschreibung der Intentionen/Slots (xml)
- Modelltraining und -einsatz zur Abbildung von natürlicher Sprache auf Intentionen (icsf)
- Unterstützung von über 20 Sprachen (STT, TTS, Übersetzung, Klassifizierung)
- Automatisierte Aussprache- und Verständnis-Evaluierung
- Einfache Erstellung von nicht-muttersprachlichen Sprechern