Audio

Last updated: May 15, 2026

Hier finden Sie alle Informationen über die wichtigsten Audioeinstellungen für Ihre KI-Anrufe.

In den Audioeinstellungen können Sie die folgenden technischen Funktionen Ihres KI-Assistenten steuern:

  • Sprechgeschwindigkeit

  • Empfindlichkeit

Sprechgeschwindigkeit

Mit der Sprechgeschwindigkeit können Sie steuern, wie schnell Ihr Assistent spricht. Je nach Anwendungsfall und Zielgruppe kann es sinnvoll sein, die Geschwindigkeit anzupassen. Wir empfehlen im Allgemeinen eine Sprechgeschwindigkeit, die etwa in der Mitte des verfügbaren Bereichs liegt.

Die Sprechgeschwindigkeit regelt nur das Tempo, mit dem die KI ihre Antworten spricht. Sie verbessert nicht die Latenz.

Das Reduzieren der Sprechgeschwindigkeit kann die Artikulation bei hartnäckigen Ausspracheproblemen verbessern, obwohl dies die Latenz nicht beeinflusst.

Empfindlichkeit

Empfindlichkeit bestimmt, wie leicht die KI unterbrochen werden kann. Hier können Sie steuern, wie empfindlich die KI gegenüber Sprache sowie Geräuschen ist. Je nach Anwendungsfall kann es sinnvoll sein, diese Einstellung anzupassen.

Wenn viele Ihrer Anrufe in einer lauten Umgebung mit starkem Hintergrundgeräusch stattfinden (zum Beispiel auf einer Baustelle), kann die Anrufqualität verbessert werden, wenn Sie die Empfindlichkeit verringern, sodass die KI weniger leicht auf Geräusche reagiert.
Umgekehrt kann es sinnvoll sein, die Empfindlichkeit zu erhöhen, wenn Ihre Anrufer typischerweise leise sprechen und sich in einer ruhigen Umgebung befinden (zum Beispiel ältere Menschen).

Fachbegriffe und Ausspracheoptimierung

Zusätzliche Techniken helfen, die Aussprache von Namen und Fachbegriffen zu verbessern:

  • Phonetische Schreibweise im Prompt: Geben Sie die gewünschte Aussprache direkt an (z. B. "Müller, ausgesprochen 'Mül-ler'" oder "Schmidt = Shmit").

  • Technische Begriffe registrieren: Fügen Sie wichtige Namen oder Begriffe als spezialisierten Wortschatz hinzu, damit die Spracherkennung sie zuverlässiger erfasst.

  • Schreibweise-Fallback: Integrieren Sie eine Sicherheitsabfrage für kritische Namen (z. B. "Um sicherzugehen, könnten Sie bitte Ihren Nachnamen buchstabieren?").

Diese Techniken sind besonders wertvoll, wenn die standardmäßigen Audioeinstellungen allein nicht ausreichen, um eine konsistente Aussprache sicherzustellen.