Passer au contenu principal
Le VoiceSDK offre des capacités de conversation vocale avancées avec l’intégration automatique du système de chat et des hooks React pour construire des applications compatibles avec la voix. Créez des interactions vocales naturelles avec des agents IA, complètes avec visualisation audio, transcription et gestion de conversation. Dans cet article, vous trouverez un exemple de démarrage rapide qui vous permettra non seulement de vous lancer rapidement, mais aussi de comprendre comment cela fonctionne. Le reste de l’article détaille les diverses méthodes que vous pouvez utiliser, à quoi elles servent et les meilleures pratiques.

Installation

Démarrage rapide

Conversation vocale basique

Dans cet exemple, vous apprendrez comment implémenter des conversations vocales en temps réel en utilisant le VoiceSDK dans les applications TypeScript et React. Vous commencez par initialiser le VoiceSDK avec vos identifiants API, y compris un agentId spécifique qui définit quel agent vocal IA gérera la conversation, puis utilisez startVoiceConversation() pour démarrer une session vocale avec des gestionnaires de rappel qui vous permettent de répondre aux événements de connexion, de recevoir des messages IA, de gérer les déconnexions et de traiter les transcriptions en direct de ce que dit l’utilisateur (isFinal indiquant quand une phrase complète a été reconnue). L’option saveToChat vous permet de persister la conversation vocale en tant que texte dans votre historique de chat pour une référence ultérieure. Pour les applications React, vous utiliserez le hook useVoiceConversation, qui fournit une interface plus propre avec la gestion d’état intégrée : il vous donne une variable status pour suivre l’état de la connexion, les méthodes startSession() et endSession() pour contrôler la conversation, setVolume() pour ajuster les niveaux audio, getInputByteFrequencyData() pour visualiser l’entrée audio (parfait pour créer des affichages de forme d’onde) et conversationState qui contient des informations en temps réel comme les niveaux de volume actuels. Cela vous donne tout ce dont vous avez besoin pour créer des applications vocales compatibles avec l’IA avec reconnaissance et synthèse vocale en temps réel, parfait pour créer des assistants vocaux, des interfaces sans mains ou des expériences conversationnelles d’IA, avec le hook React gérant toute la gestion d’état complexe et les connexions WebSocket pour vous.

Utilisation du hook React

Configuration

Interface VoiceSDKConfig

Paramètres vocaux

Exemple de configuration :

Fonctionnalités principales

Sessions de conversation vocale

Le VoiceSDK gère les sessions de conversation vocale avec intégration automatique du chat :

Messages vocaux

Gestion des sessions

startVoiceConversation(options?)

Démarrer une nouvelle session de conversation vocale.
Options StartVoiceConversationOptions :
Exemple :

endVoiceSession(sessionId, reason?)

Terminer une session de conversation vocale.
Exemple :

getVoiceState(sessionId)

Obtenir l’état actuel de la conversation vocale.
Exemple :

Intégration React

Hook useVoiceConversation

Le hook useVoiceConversation fournit l’intégration React avec la gestion d’état :
Exemple React complet :

Contrôles vocaux

Contrôle du volume

Contrôle du microphone

Mises à jour des paramètres vocaux

Visualisation audio

Données audio en temps réel

Composant de visualisation audio

Intégration du chat

Enregistrement automatique du chat

Les conversations vocales peuvent être automatiquement enregistrées dans votre système de chat :

Intégration manuelle du chat

Mises à jour contextuelles

Envoyer du contexte supplémentaire à la conversation vocale :

Gestion des erreurs

Exemples

Support client avec voix

Meilleures pratiques

Gestion des erreurs et solutions de secours

Gestion des ressources

Optimisation des performances

Accessibilité