Reverie AI

Reverie AI crée avec Fish Audio un divertissement qui vous répond

Reverie AI développe des modèles d’interaction en temps réel qui transforment la vidéo en mondes réactifs. Son IA interprète les paroles, choix, pressions et actions des utilisateurs, puis adapte l’expérience en conséquence. Les personnages ne peuvent donc pas dépendre de dialogues préenregistrés. Fish Audio fournit la voix en streaming pendant que le monde réagit, donnant à Reverie le contrôle de la parole, des réactions et de l’identité des personnages dans chaque branche de l’expérience.

Produits utilisés
Fish Audio S2 ProSynthèse vocaleAPI de streaming

Reverie AI crée un divertissement qui répond à l’utilisateur

Le divertissement traditionnel suit une chronologie fixe : le scénario est écrit, la performance enregistrée, et chaque spectateur voit la même séquence.

Reverie AI construit autre chose. Ses modèles reçoivent du texte, de la voix, de la vidéo, des gestes, des interactions tactiles, des choix et des actions à l’écran pour décider de la suite. L’utilisateur peut parler à un personnage, influencer une scène, changer une fin ou ouvrir une branche encore inexistante un instant auparavant.

L’expérience n’est donc plus entièrement définie avant l’arrivée de l’utilisateur. Personnages et scènes doivent répondre à ce qui se passe sur le moment.

Un monde réactif ne peut pas attendre la voix off

Dans un contenu fixe, la voix peut être enregistrée une fois le scénario terminé. Dans un monde interactif, la réplique suivante peut n’exister qu’après une action de l’utilisateur.

Reverie avait besoin d’une voix capable de commencer avant la fin de la génération, de suivre des consignes au sein d’une réplique et de préserver le personnage entre scènes et embranchements. Les coûts devaient aussi rester viables si chaque interaction produisait de nouvelles paroles.

Il ne s’agissait pas seulement de rendre une voix générée humaine, mais de la faire agir comme une partie d’un monde vivant.

Reverie AI voulait diriger le personnage, pas choisir une expérience vocale figée

Reverie a évalué quatre critères : streaming rapide, contrôle expressif, identité persistante du personnage et prise en charge multilingue. L’équipe devait diriger le personnage à chaque instant plutôt que choisir une seule humeur pour toute une réponse.

Fish Audio répondait à ces critères dans une même infrastructure vocale. La parole est diffusée par WebSocket pendant sa génération, l’expression se dirige dans le texte en langage naturel et les modèles réutilisables préservent une identité vocale cohérente tout au long de l’expérience.

Fish Audio permet aux personnages de répondre immédiatement

Avec Fish Audio, Reverie commence à diffuser la voix avant la fin de la génération de la réponse. L’intervalle entre l’action de l’utilisateur et la réaction du personnage reste assez court pour donner une impression de continuité.

L’équipe peut diriger chaque moment d’une réplique avec des indications de chuchotement, de rire ou d’enthousiasme. Au lieu d’un réglage vocal unique pour toute la scène, elle adapte la performance aux événements.

Les modèles vocaux réutilisables rendent les personnages reconnaissables entre les scènes, sessions et embranchements.

Une base vocale pour des mondes sans frontières

Les expériences de Reverie visent un public mondial. La voix doit donc fonctionner dans plusieurs langues sans créer une chaîne de production distincte pour chaque marché.

Le modèle de production actuel de Fish Audio prend en charge 83 langues, permettant à Reverie d’introduire ses personnages sur de nouveaux marchés tout en conservant la même architecture vocale.

Le coût compte aussi. L’API à l’usage de Fish Audio est facturée 15 dollars par million d’octets UTF-8, offrant une infrastructure qui évolue avec l’utilisation à mesure que les interactions génèrent de la parole.

La voix devient une partie du monde

Pour Reverie, la voix passe du statut de lecture à celui de participation.

Les personnages réagissent sur le moment plutôt que réciter des répliques enregistrées. Leurs voix changent avec la scène tout en restant reconnaissables. La même infrastructure soutient les différents formats, des compagnons de jeu de rôle et animaux virtuels aux aventures interactives et aux jeux.

Fish Audio a donné à Reverie la base vocale nécessaire pour rendre ces expériences réactives sans transformer la production vocale en processus séparé.

Lire d’autres témoignages clients

Fish Audio

Nous sommes prêts quand vous l’êtes

Parlez de votre déploiement avec notre équipe. Nous arriverons préparés.