기업용음성 인프라

대규모 음성 서비스를 출시하는 팀을 위해 설계되었습니다. 매번 정확한 결과가 중요한 애플리케이션을 뒷받침하는 음성 모델입니다.

8M+
개발자
4.6M
일일 요청 수
26%
단어 오류율 감소
<70ms
지연 시간

프로덕션에서 음성을 만드는 팀들이 신뢰합니다

팀들이 우리와 함께 개발하는 이유.

설정

$10K부터 플랫폼 수수료 · 1회

배포

VPC · 온프레미스 · 에어갭 · 주권 클라우드

최소 지출

$10K/월 · 12개월 약정

규제 대상 워크로드, 주권형 배포, 프로덕션에서 실행되는 모델을 완전히 제어해야 하는 팀을 위해 Fish는 프리미엄 엔터프라이즈 티어로 셀프 호스팅을 제공합니다. 자체 VPC, 에어갭 환경 또는 데이터센터에서 실행하세요. 조달 과정에서 요구하지만 좀처럼 얻기 어려운 아키텍처입니다.

프로덕션 성과, 데모에서의 승리가 아닙니다.

핵심은 품질이라는 말이 아니라, 전환 후 팀이 무엇을 달성했는지입니다. 각 이야기는 고객이 직접 작성한 정량화된 결과입니다.

비미국식 영어 억양 음성 클로닝에서 대안 대비 3대 1로 선택되었습니다.

Picto VOICE 안의 일본어 AI 캐릭터에 캐릭터 수준의 표현력을 제공합니다.

1,000만 명 이상 사용자를 위한 실시간 음성 에이전트 TTS - 자연스러움, 감정, 지연 시간, 다국어.

엔터프라이즈 대화를 위한 실시간 오케스트레이션 기반 프로덕션 음성 에이전트.

25%+ AI 면접 참여 시간 증가 · ~10x Fish Audio를 통한 음성 비용 절감

프리미엄 지원.

고객은 언제나 귀 기울이고 있으니까요.

연중무휴 프로덕션 지원

음성 AI 전문가와 직접 소통하고, 고객 경험에 영향을 미치는 문제에 대해 약정된 응답 지원을 받으세요.

전담 기술 계정 관리자

음성 기술 스택을 이해하고 복잡한 문제 해결과 서비스 확장을 돕는 전담 팀의 지원을 받으세요.

99% 가동률 SLA

음성 애플리케이션의 가용성과 응답성을 유지하고 모든 상호작용에 대비할 수 있도록 설계된 인프라 서비스 약정을 믿고 맡기세요.

맞춤형 서비스

엔지니어와 함께 아키텍처 검토, 통합, 성능 최적화를 진행하고 프로덕션 환경에서 음성 경험을 구현하세요.

여섯 가지 음성 제품 범주가,
오늘 프로덕션에서 출시되고 있습니다.

아바타 영상부터 다국어 고객 지원까지, 아래 모든 범주는 로드맵 약속이 아니라 Fish에서 실행 중인 실제 엔터프라이즈 배포입니다.

AI 에이전트를 위한 음성

캐릭터 및 컴패니언 앱.

아바타 및 비디오 보이스오버

다국어 고객 지원.

중국어 · 일본어 · 한국어 · 광둥어

대규모 음성 클로닝.

200만 음성 생태계 · 30초 클론

오디오 번역 및 더빙.

80개 이상 모든 언어 · 코드 스위칭

이미 사용하는 음성 에이전트 스택에 연결됩니다.

음성 팀이 오늘 출시할 때 쓰는 오케스트레이션, 전화, 인프라 도구를 드롭인으로 지원합니다. 주요 언어 SDK, WebSocket 스트리밍, REST, 인바운드 webhook 패턴을 문서화했습니다.

준비되면 바로 시작할 수 있습니다.

배포 계획을 저희 팀과 이야기해 주세요. 준비해서 만나겠습니다.

자주 묻는 질문

내 데이터는 어디에 저장되나요? 미국, EU, APAC 데이터 레지던시를 지원하나요?

기본적으로 데이터는 미국에 보관되며 Google Cloud에 호스팅되고 Cloudflare R2 스토리지를 사용합니다. 추론은 미국과 아시아 태평양(도쿄)의 edge 리전에서 실행되어 사용자가 어디에 있든 낮은 지연 시간을 제공합니다. 컴플라이언스가 필요한 워크로드의 경우 enterprise 계약에서 Zero Data Retention을 활성화할 수 있으며, 이는 요청 텍스트와 오디오가 디스크에 기록되지 않는다는 뜻입니다. 데이터가 특정 국가나 지역 안에 머물러야 한다면 self-hosted enterprise 티어가 고객의 자체 인프라 안에서 완전히 실행되므로 어떤 데이터도 고객 환경을 벗어나지 않습니다.

대규모 배포와 트래픽 급증을 지원할 수 있나요?

예, 매우 큰 규모도 지원합니다. 용량은 계약에 따라 확장되는 동시 생성 수로 프로비저닝되며, 이미 1,000개 이상의 동시 생성을 운영 중인 프로덕션 고객이 있습니다. Rust edge gateway가 여러 GPU 리전에서 추론을 제공하므로 트래픽이 급증하면 저희 팀이 당일에 한도를 올릴 수 있습니다. 지원 티켓 대기열에 머무르지 않고 바로 확장할 수 있습니다.

어떤 보안 인증을 보유하고 있나요?

보안은 플랫폼의 모든 계층에 적용됩니다. SOC 2 Type II 감사는 현재 진행 중이며, 완료되면 NDA 하에 고객에게 보고서를 제공할 예정입니다. Zero Data Retention은 enterprise 계약에서 사용할 수 있어 요청 payload가 저장되지 않으며, self-hosted 티어는 고객 데이터의 모든 바이트를 고객 환경 안에 유지합니다. 또한 HIPAA에 부합하는 구성을 지원하고 조건을 충족하는 헬스케어 워크로드에는 BAA를 체결할 수 있으며, 독립적인 침투 테스트가 지속적인 컴플라이언스 프로그램의 일부로 진행됩니다.

맞춤 배포를 위한 엔지니어링 지원을 제공하나요?

물론입니다. enterprise 고객은 티켓 대기열이 아니라 팀의 업무 방식에 맞는 채널에서 저희 엔지니어링 팀과 직접 연결됩니다. 저희는 개별 고객을 위해 통합별 기능과 프로토콜 확장을 정기적으로 제공하며, self-hosted 배포도 첫 설정부터 go-live까지 end-to-end로 함께 구축합니다.

SSO와 RBAC를 지원하나요?

예, 첫날부터 세밀한 제어를 제공합니다. 역할 기반 접근 제어를 통해 팀 수준에서는 owner, admin, member 역할을, workspace 수준에서는 manager, contributor, viewer 역할을 부여할 수 있어 모든 사람이 필요한 만큼의 접근 권한만 갖게 됩니다. Single sign-on은 현재 Google 및 GitHub OAuth로 동작합니다.

자사 데이터로 모델을 파인튜닝하거나 자체 음성을 사용할 수 있나요?

둘 다 가능하며, 고객의 조건에 맞춰 진행합니다. API 또는 web UI를 통해 최소 10초의 reference audio로 private voice clone을 즉시 만들 수 있고, 최상의 결과에는 30초 이상을 권장합니다. 생성된 voice clone은 팀 내부에 완전히 비공개로 유지됩니다. 더 깊은 협업에서는 고객 데이터로 custom model도 fine-tune합니다.

다른 음성 공급업체에서 이전하는 경우는 어떻게 되나요?

Fish Audio로의 마이그레이션은 간단하며, 대부분의 팀은 그 속도에 놀랍니다. 기존 음성은 reference audio로 다시 생성해 가져올 수 있고, Python, TypeScript, Go SDK와 WebSocket streaming API가 이미 사용 중인 통합 패턴을 지원합니다. 저희 엔지니어링 팀이 함께 cutover를 진행해 프로덕션이 멈추지 않도록 합니다.