BeFreed 将书籍变成值得聆听的对话
BeFreed 将密集的原始资料转化为简短的个性化课程。学习者可以选择声音、语气和语速,随时随地收听。体验围绕音频而非屏幕展开,让一天中不方便阅读的时段也能用于学习。
其独特的内容形式更进一步:BeFreed 不只是朗读书籍或论文,而是将其转为 AI 播客,由两种不同的声音交替讨论内容。每集可长达 10、20 或 40 分钟,仿佛为学习者量身定制的播客。
这种形式让语音成为产品的核心。两位说话者需要听起来像不同的人在交流,而不是两种声音在朗读生成的文本。
40 分钟的对话带来了不同的 TTS 挑战
一句话听起来悦耳,并不意味着整集节目都能保持同样的效果。在 20 或 40 分钟里,平淡的表达、重复的语气,或两位说话者各说各话等小问题会变得更加明显。
BeFreed 还需要让个性化贯穿整个体验。学习者要选择陪伴自己收听整集节目的声音,因此平台需要丰富且各具特色的声音,而非单一的默认旁白。
由于 BeFreed 已支持十多种语言,同样的体验还必须适用于不同市场。自然度、表现力、声音多样性和语言覆盖缺一不可。
音频是用户学习体验的核心,因此语音质量不容妥协。Fish Audio 以我们所需的规模和成本,提供自然、富有情感的多声音音频,让每一份内容都能被聆听。

Jisong Liu
BeFreed 创始人
BeFreed 需要能演绎内容的声音,而不只是旁白
评估过程中,BeFreed 重点关注声音在产品核心的长篇对话内容中的表现。
Fish Audio 在较长段落中的自然度和情感表现力脱颖而出。两种声音既能保持各自的特点,又能呈现更生动的交流,为 BeFreed 的 AI 播客形式奠定基础。
声音的丰富程度同样重要。个性化是产品的内在设计,BeFreed 因而能够让学习者自由选择聆听对象,而不必围绕单一声音构建体验。
Fish Audio 为 BeFreed 提供适合长音频的语音基础
BeFreed 将 Fish Audio 文本转语音 API 直接集成到内容流程中。当学习者选择声音和语气后,BeFreed 就会生成相应音频,成为应用内体验的一部分。
同一套语音基础设施同时支持独白课程和双人对话节目。因此,BeFreed 可以构建不同的学习形式,无需为每一种形式单独建立语音制作流程。
成本也很重要。BeFreed 可以按需生成音频,无需人工制作每一节课,让海量原始资料转化为个性化聆听体验成为现实。
一套语音基础,服务全球学习平台
BeFreed 目前以十多种语言,为全球超过 100 万学习者提供 AI 个性化音频课程。
Fish Audio 更广泛的语言覆盖,让团队可以扩展体验,无需为每个市场重建语音基础设施。随着 BeFreed 增加内容形式并拓展交互音频体验,同一套语音基础可以持续支撑产品。
这样的架构将语音保留在产品内部,而不是把它当作独立的内容制作流程。
打造能够回应你的学习体验
BeFreed 正将个性化音频从生成式课程拓展到交互体验,让学习者可以实时与课程对话。
产品由此从聆听走向互动。AI 播客背后的理念也延续到这些体验中:学习可以适应不同的人、不同的时刻,以及他们希望参与的方式。
Fish Audio 为这一演进提供底层语音支持,让 BeFreed 的音频体验能够不断变得更个性化、更具对话性,也更富表现力。