Final Round AI、Fish Audio で 25 分間の AI 面接を実現
Final Round AI は求職者の面接準備を支援する AI キャリアプラットフォームです。模擬面接では、最初から最後まで本物の面接を支えられる体験を目指しました。Fish Audio が音声を担い、面接官の声を制御しながら、音声とアバターの費用を約 10 分の 1 に削減しています。
Final Round AI は音声を製品の中心に据える
Final Round AI は、本番前に AI 面接官と練習できる場を提供します。一次面接を再現するため、候補者が長い対話の中で質問に答え、面接官とやり取りする設計です。
平均セッションは約 25 分です。音声は単なるインターフェースではなく製品の基盤であり、面接官は会話全体で品質、応答性、表現力を維持する必要があります。
25 分間の面接は音声 AI に求めるものを変える
短いやり取りに適した声が、25 分間の会話にも適しているとは限りません。素早く応答し、一定の品質を保ち、状況に応じて表現を変える必要があります。長い対話では、品質や応答性のわずかな低下も目立ちます。
想定する利用規模でも費用が成り立つ必要がありました。チームは一体型の音声・アバタープラットフォームの制約を受け入れるのではなく、自社製品に合わせて柔軟に面接体験を設計したいと考えました。
Final Round AI は面接官の体験を自ら構築
チームは、アバター、音声、インフラをまとめたプラットフォームを評価しました。AI 面接官を素早く作れる一方で、体験を制御できる範囲には制約がありました。
そこで面接官アバターを自社開発し、その下に Fish Audio の音声を統合しました。チームが製品に合わせてアバターと対話を設計し、Fish Audio が音声生成を担当します。
これにより、自社の音声インフラを構築・維持せずに、面接官体験を柔軟に作れるようになりました。
適切な音声基盤はコスト構造も変えた
音声基盤をアバター体験から分離したことで、制御の自由度だけでなく、面接ごとの運用費用も変わりました。
従来の提供元の構成を自社のアバター体験と Fish Audio の TTS に置き換え、音声とアバターのインフラ費用を約 10 分の 1 に削減しました。25 分間の面接を中心とする製品にとって、利用を拡大する大きな余地になります。
低コスト化により、音声インフラを製品の制約にせず、より長く頻繁な会話を支えられます。
Final Round は音声とアバターのインフラ費用を約 10 分の 1 に削減
アバター体験で候補者の利用時間が伸びた
効果は利用時間に現れました。音声のみだった以前の体験に比べ、アバターを使った模擬面接の利用時間が 25% 以上伸びました。
面接練習では、利用時間が長いほど面接全体を通して練習し、プレッシャーの中で答える時間を確保できます。アバター体験が、製品をより魅力的にしました。
新しい音声 AI 基盤により、Final Round の利用時間は 25% 以上増加しました。
製品を軸にした音声インフラ
Final Round は自社製品に沿った面接官体験を保有し、Fish Audio がその下の音声を支えています。
一体型のアバターや音声体験に縛られず、AI の話し方を自由に設計し、製品の進化に合わせて面接官を改善できます。