음성 인식 및 전사로 돌아가기

모델 비교

Chirp 3 대 Scribe v2

동일한 공급자 소스 음성 인식 및 전사 루브릭을 사용하여 Chirp 3와 Scribe v2를 비교합니다. 미스터리 점수도 없고 벤치마크 순위도 만들어지지 않았습니다.

확인된 사실 2026년 9월 4일

비용 예상하기

사용량을 입력하면 예상 비용이 바로 업데이트됩니다.

녹음 길이를 시간 단위로 입력합니다. 30분은 0.5시간입니다. 추가 기능과 최소 요금에 따라 청구액이 달라질 수 있습니다.

예상 비용 계산 방식

세금, 도구, 캐시 저장·쓰기, 무료 할당량, 개별 할인은 제외됩니다. 이미지 비용은 출력만 포함하며 프롬프트와 참조 이미지 비용은 제외됩니다. 품질 모드는 모델마다 다릅니다. 미등록 설정은 무료로 간주하지 않습니다.

비용 예상하기
모델예상 총액 (USD)
Chirp 3Google Cloud검토된 요금 없음
Scribe v2ElevenLabs검토된 요금 없음

빠른 테이크

Chirp 3

다양한 언어와 지역에서 스트리밍, 파일 및 저렴한 동적 배치 전사를 위한 Google Cloud의 일반 음성-텍스트 모델입니다.

다음에 가장 적합

  • 다국어 클라우드 전사
  • 실시간 및 배치 워크로드를 혼합하는 팀
  • 지역 엔드포인트가 필요한 Google Cloud 애플리케이션

조심하세요

정확한 언어와 지역은 Chirp 3 표를 확인하세요. 화자 라벨, 타임스탬프, 적응 및 일괄 동작에는 단일 적용 범위 번호로 숨길 수 있는 경로별 제약이 있습니다.

Scribe v2

ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다.

다음에 가장 적합

  • 다국어 미디어 전사
  • 여러 스피커 또는 사운드 이벤트가 포함된 녹음
  • 이미 ElevenLabs를 사용하고 있는 오디오 스택

조심하세요

배치와 실시간이 동일한 경로나 가격이라고 가정하지 마십시오. 제로 데이터 보존은 자동이 아닌 조건부이므로 민감한 오디오를 처리하기 전에 계획, 엔드포인트, 지역 및 활성화 로깅 동작을 확인하십시오.

공개된 사실을 비교해보세요

Chirp 3 vs Scribe v2

값은 각 공급자가 게시한 단위와 한도를 사용합니다. 공백은 공급자가 검토된 소스에서 직접적으로 비교할 수 있는 값을 게시하지 않았음을 의미합니다.

음성 인식 및 전사Chirp 3Scribe v2
전사 가격나열된 처리 경로에 대한 오디오 시간 또는 분당 현재 공급자 가격입니다.$0.016/분 표준 · $0.003/분 동적 배치$0.22 / 오디오 시간; 실시간은 별도로 나열됨
라이브 또는 배치모델이 실시간 스트림, 업로드된 녹음 또는 둘 다를 처리하는지 여부입니다.스트리밍, 동기 및 배치일괄 및 긴 오디오; 별도의 실시간 경로
언어공급자가 게시한 언어 적용 범위, 필요한 경우 특별히 검증된 언어와 훈련되거나 광고된 적용 범위를 분리합니다.85개 이상의 언어 및 로케일90개 이상의 언어
화자 라벨모델이 발언한 사람과 발표된 발언자 수 제한을 식별하는지 여부입니다.문서화된 언어 하위 집합에 대해 지원됩니다.최대 32개의 스피커
타임스탬프사용 가능한 단어, 세그먼트 또는 발화 수준 타이밍 정보.경로 제약 조건이 있는 단어 수준 타임스탬프단어 수준 타임스탬프
어휘 통제키워드 부스팅, 맞춤 철자법, 문맥, 프롬프트 또는 도메인 용어를 개선하는 기타 방법입니다.음성 적응, 맞춤형 어휘, 언어 감지, 노이즈 제거최대 1,000개의 핵심 용어; 오디오 태그 및 언어 감지
사용처공급자가 문서화한 다이렉트 API, 클라우드 카탈로그, 애플리케이션 또는 지역 엔드포인트입니다.Google Cloud 음성-텍스트 V2ElevenLabs 음성-텍스트 API

선택 방법

과대 광고가 아닌 직업을 비교하십시오.

완료해야 하는 작업부터 시작한 다음 정확한 공급자 경로에 대한 비용, 액세스 및 정책 세부 정보를 확인하세요.

Chirp 3

Google는 고객이 데이터 로깅을 선택하지 않는 한 Speech-to-Text 콘텐츠는 서비스 제공 외에는 사용되지 않는다고 말합니다. 스트리밍 및 동기 콘텐츠는 메모리에서 처리됩니다. 비동기 결과는 문서화된 대로 일시적으로 유지될 수 있습니다.

Scribe v2

ElevenLabs를 통해 적격 API 고객은 데이터 사용 기본 설정을 관리할 수 있습니다. Enable_logging=false를 통한 제로 데이터 보존은 Scribe v2를 포함하여 적격 엔터프라이즈 구성 및 지원 모델로 제한됩니다. 실시간 계획과 지역 엔드포인트를 확인하세요.

자주 묻는 질문

Chirp 3 대 Scribe v2 FAQ

Chirp 3와 Scribe v2의 주요 차이점은 무엇입니까?

Chirp 3: 다양한 언어와 지역에서 스트리밍, 파일 및 저렴한 동적 배치 전사를 위한 Google Cloud의 일반 음성-텍스트 모델입니다. Scribe v2: ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다.

Chirp 3 또는 Scribe v2를 선택해야 합니까?

우선순위가 다국어 클라우드 전사인 경우 Chirp 3를 고려하세요. 우선순위가 다국어 미디어 전사인 경우 Scribe v2를 고려하세요. 커밋하기 전에 자체 데이터와 공급자 경로를 모두 테스트하세요.

이 비교는 Cody 벤치마크를 기반으로 한 Chirp 3와 Scribe v2 비교입니까?

아니요. 이 비교는 음성 인식 및 전사 범주에 대해 공급자가 게시한 사실과 일치합니다. 보편적인 승자를 주장하거나 호환되지 않는 타사 벤치마크 점수를 결합하지 않습니다.