BeFreed は書籍を聴きたくなる会話に変える
BeFreed は情報量の多い資料を、短く個人に合わせたレッスンに変えます。学習者は声、口調、速度を選び、どこでも聴けます。画面ではなく音声を中心に据えることで、読書が難しい時間帯にも学習できます。
同社独自の形式は、この発想をさらに進めています。書籍や論文を単に読み上げるのではなく、異なる二つの声が内容を話し合う AI ポッドキャストに変換します。各回は 10 分、20 分、40 分から選べ、自分専用に依頼したポッドキャストのような体験になります。
この形式によって、声は製品の中核になりました。二人の話者は、生成された文章を読む二つの声ではなく、異なる人同士が会話しているように聞こえる必要がありました。
40 分の会話には異なる TTS の課題がある
一文では心地よい声でも、エピソード全体で通用するとは限りません。20 分や 40 分になると、平板な話し方、繰り返される表現、かみ合わない二人の声といった小さな問題が目立ちます。
BeFreed は体験全体での個別化も必要としていました。学習者は一回分を通して聴きたい声を選ぶため、単一の標準ナレーターではなく、個性の異なる多様な声が求められました。
さらに、BeFreed は 10 以上の言語で提供されており、各市場で同じ体験を実現する必要があります。自然さ、表現力、声の多様性、対応言語を同時に満たすことが重要でした。
音声はユーザーの学習の中心なので、声の品質には妥協できません。Fish Audio は、あらゆるコンテンツを聴ける形にするために必要な規模とコストで、自然で感情豊かな複数話者の音声を提供してくれます。

Jisong Liu
BeFreed 創業者
BeFreed が必要としたのは、読むだけでなく演じられる声
評価では、製品の中心にある長時間の対話コンテンツで、声がどのように機能するかに注目しました。
Fish Audio は、長い文章でも自然さと豊かな感情表現を保つ点で際立っていました。二つの声がそれぞれの個性を維持しながら表情豊かにやり取りでき、AI ポッドキャスト形式の土台になりました。
声の選択肢の多さも重要でした。個別化を製品に組み込んでいるため、一つの声を軸に体験を設計するのではなく、誰の声を聴くかを学習者がより自由に選べます。
Fish Audio が長時間音声に適した基盤を BeFreed に提供
BeFreed は Fish Audio のテキスト読み上げ API をコンテンツ処理に直接統合しました。学習者が声と口調を選ぶと、アプリ内の体験として対応する音声を生成します。
同じ音声基盤が、一人で話すレッスンと二人の対話型エピソードの両方を支えます。形式ごとに別の音声制作工程を用意せず、さまざまな学習形式を構築できます。
経済性も重要です。各レッスンを手作業で制作せず、必要に応じて音声を生成できるため、大量の資料を個人に合わせた聴取体験へ変えることが現実的になります。
世界の学習プラットフォームを一つの音声基盤で支える
BeFreed は現在、世界で 100 万人を超える学習者に、10 以上の言語で AI による個別化音声レッスンを提供しています。
Fish Audio の幅広い言語対応により、市場ごとに音声基盤を作り直さず体験を広げられます。形式の追加や双方向音声体験の拡充にも、同じ基盤が製品を支え続けます。
この構成により、音声は独立したコンテンツ制作工程ではなく、製品の一部として機能します。
応答してくれる学習体験へ
BeFreed は、生成されたレッスンを聴くだけでなく、学習者がレッスンとリアルタイムに会話できる双方向体験へ個別化音声を広げています。
製品は聴取から対話へと進化します。AI ポッドキャストと同じ理念のもと、学習は人、その時々の状況、望む参加方法に合わせて変化できます。
Fish Audio はその進化を音声基盤で支え、BeFreed がより個別化され、会話的で表現豊かな音声体験を育てていく土台を提供します。