LiveAvatar — avatar IA conversationnel en temps réel
Savoir-faire : intégrer un avatar IA conversationnel en temps réel — un interlocuteur vidéo animé, doté d'une voix clonée, avec qui on échange à l'oral comme en visio. (Démo R&D, non déployée en production.)
Le principe
Le visiteur lance une session, autorise son micro et parle. L'avatar — visage et voix personnalisés — écoute, comprend et répond en vidéo + voix de synthèse, en temps réel, sans intervention humaine.
Comment c'est construit
Architecture en deux étages, pensée pour ne jamais exposer la clé API :
- Backend : un service génère à la demande un jeton de streaming éphémère ; la clé HeyGen reste exclusivement côté serveur.
- Endpoint proxy : délivre ce jeton au navigateur, protégé par un rate limiter anti-abus.
- Frontend : un contrôleur Stimulus + le SDK HeyGen attachent le flux WebRTC à la page et démarrent le dialogue voix.
Maîtrise des coûts & sécurité (le vrai sujet)
Un avatar streaming est facturé à la minute — l'enjeu est de ne jamais payer pour rien :
- Clé API jamais exposée côté client (jeton à usage unique).
- Arrêt automatique triple filet : navigation, fermeture d'onglet, passage en arrière-plan → la session (et la facturation) se coupent dès que l'utilisateur regarde ailleurs.
- Rate limiting par IP.
- Transparence RGPD : les flux audio/vidéo transitent par les serveurs HeyGen (US) — signalé à l'utilisateur.
Cas d'usage
Accueil interactif, FAQ incarnée, présentation produit, prise de contact augmentée — partout où une présence humaine synthétique crée de l'engagement sans mobiliser quelqu'un en direct.