BeFreed

BeFreed entwickelt KI-Audiolektionen, die wie echte Gespräche klingen

BeFreed ist eine KI-Lernplattform, die Bücher, Forschungsarbeiten, Expertenvorträge und Podcasts in personalisierte Audiolektionen verwandelt. Mit über einer Million Lernenden entwickelt das Unternehmen ein Lernerlebnis für den Alltag – vom Pendeln über Sport bis zur Hausarbeit.

Verwendete Produkte
Fish Audio S2 ProText-to-SpeechCloud-API

BeFreed verwandelt Bücher in hörenswerte Gespräche

BeFreed macht aus umfangreichem Ausgangsmaterial kurze, personalisierte Lektionen. Lernende wählen Stimme, Tonfall und Tempo und hören überall zu. Das Erlebnis ist auf Audio statt auf den Bildschirm ausgerichtet und ermöglicht Lernen auch dann, wenn Lesen nicht möglich ist.

Das besondere Format geht noch weiter. Statt ein Buch oder eine Arbeit nur vorzulesen, verwandelt BeFreed den Inhalt in einen KI-Podcast: Zwei unterschiedliche Stimmen diskutieren miteinander. Die Folgen dauern 10, 20 oder 40 Minuten und wirken wie ein persönlich bestellter Podcast.

Damit wurde Sprache zum Kern des Produkts. Die beiden Sprecher mussten wie unterschiedliche Menschen im Gespräch klingen, nicht wie zwei Stimmen, die generierten Text vorlesen.

Ein 40-minütiges Gespräch stellt andere Anforderungen an TTS

Eine Stimme, die einen Satz gut vorträgt, überzeugt nicht unbedingt eine ganze Folge lang. Über 20 oder 40 Minuten fallen kleine Probleme stärker auf: monotone Wiedergabe, wiederholte Ausdrucksmuster oder Stimmen, die aneinander vorbeireden.

BeFreed brauchte außerdem Personalisierung im gesamten Erlebnis. Lernende wählen Stimmen, denen sie eine ganze Folge zuhören möchten. Deshalb benötigte die Plattform viele eigenständige Stimmen statt eines einzelnen Standarderzählers.

Da BeFreed mehr als 10 Sprachen anbietet, musste das Erlebnis auch in verschiedenen Märkten funktionieren. Natürlichkeit, Ausdruck, Stimmenvielfalt und Sprachabdeckung mussten gemeinsam überzeugen.

Audio steht im Mittelpunkt des Lernens unserer Nutzer, deshalb ist Sprachqualität nicht verhandelbar. Fish Audio liefert uns natürliche, emotional ausdrucksstarke Audios mit mehreren Stimmen – in dem Umfang und zu den Kosten, die wir brauchen, um jeden Inhalt hörbar zu machen.

Jisong Liu

Gründer von BeFreed

BeFreed brauchte Stimmen, die gestalten statt nur vorlesen

Bei der Bewertung konzentrierte sich BeFreed auf die Leistung der Stimmen in langen Gesprächsinhalten, die den Kern des Produkts bilden.

Fish Audio überzeugte durch Natürlichkeit und emotionale Bandbreite auch in längeren Passagen. Zwei Stimmen konnten ihre eigene Identität bewahren und zugleich lebendiger miteinander sprechen – die Grundlage für das KI-Podcastformat von BeFreed.

Auch die Auswahl an Stimmen war wichtig. Weil Personalisierung zum Produkt gehört, konnte BeFreed Lernenden mehr Auswahl bieten, wem sie zuhören, statt alles um eine einzige Stimme herum zu gestalten.

Fish Audio bietet BeFreed eine Sprachbasis für lange Audioformate

BeFreed integrierte die Text-to-Speech-API von Fish Audio direkt in seine Inhaltsverarbeitung. Wählt ein Lernender Stimme und Tonfall, erzeugt BeFreed das passende Audio als Teil des Erlebnisses in der App.

Dieselbe Sprachinfrastruktur unterstützt monologische Lektionen und Gesprächsfolgen mit zwei Stimmen. So kann BeFreed verschiedene Lernformate entwickeln, ohne für jedes einen eigenen Sprachproduktionsprozess aufzubauen.

Auch die Wirtschaftlichkeit zählt. BeFreed kann Audio auf Abruf erzeugen, statt jede Lektion manuell zu produzieren. So lässt sich eine große Materialbibliothek praktisch in personalisierte Hörerlebnisse verwandeln.

Eine Sprachbasis für eine globale Lernplattform

BeFreed bietet inzwischen KI-personalisierte Audiolektionen in mehr als 10 Sprachen für eine weltweite Gemeinschaft von über einer Million Lernenden.

Die breite Sprachabdeckung von Fish Audio ermöglicht Wachstum, ohne die Sprachinfrastruktur für jeden Markt neu aufzubauen. Auch wenn BeFreed weitere Formate einführt und interaktive Audioerlebnisse erweitert, trägt dieselbe Sprachbasis das Produkt.

Diese Architektur hält Sprache im Produkt, statt sie als getrennten Prozess der Inhaltsproduktion zu behandeln.

Ein Lernerlebnis, das antwortet

BeFreed erweitert personalisiertes Audio über generierte Lektionen hinaus zu interaktiven Erlebnissen, in denen Lernende in Echtzeit mit der Lektion sprechen können.

Damit entwickelt sich das Produkt vom Zuhören zur Interaktion. Das Prinzip der KI-Podcasts bleibt: Lernen kann sich an die Person, den Moment und die gewünschte Art der Beteiligung anpassen.

Fish Audio liefert die Sprachbasis für diese Entwicklung und ermöglicht BeFreed Audioerlebnisse, die mit der Zeit persönlicher, dialogorientierter und ausdrucksstärker werden.

Weitere Kundengeschichten lesen

Fish Audio

Bereit, wenn Sie es sind

Sprich mit unserem Team über dein Deployment. Wir kommen vorbereitet.