Meta · 미리보기
Muse Voice Transcribe
라이브 캡션, 긴 오디오, 다수의 화자, 코드 전환 및 도메인 인식 전사를 위한 Meta의 스트리밍 음성 인식 모델입니다.
- 전사 가격
- $0.18 / 오디오 시간
- 라이브 또는 배치
- 실시간 스트리밍 및 긴 형식의 오디오
리소스
5 모델의 1–5 표시
Meta · 미리보기
라이브 캡션, 긴 오디오, 다수의 화자, 코드 전환 및 도메인 인식 전사를 위한 Meta의 스트리밍 음성 인식 모델입니다.
Microsoft · 미리보기
긴 녹음, 화자 레이블, 단어 타이밍, 키워드 편향 및 깔끔한 또는 축어적 대본을 위한 Microsoft의 빠른 일괄 대본 모델입니다.
Google Cloud · 안정적
다양한 언어와 지역에서 스트리밍, 파일 및 저렴한 동적 배치 전사를 위한 Google Cloud의 일반 음성-텍스트 모델입니다.
코드 전환, 화자 레이블, 타임스탬프 및 상황에 맞는 프롬프트를 갖춘 파일 및 라이브 오디오용 AssemblyAI의 정확성 중심 전사 모델입니다.
ElevenLabs · 안정적
ElevenLabs' 다국어 음성-텍스트 모델은 많은 화자, 단어 타이밍, 오디오 이벤트 및 대규모 사용자 정의 키워드 목록이 포함된 자세한 대본을 제공합니다.
이 라이브러리를 사용하는 방법
실제 제품 결정을 위한 실용적인 API 정보가 포함된 선별된 교차 카테고리 세트인 개척자, 전문가 및 카테고리 정의 모델입니다.
Cody는 범용 품질 리더보드를 실행하지 않습니다. 공급자 청구에는 라벨이 지정되어 있으며 가격에는 세금 및 옵션 도구가 제외되어 있으며 프로덕션 구매자는 모델을 선택하기 전에 실시간 공급자 조건을 확인해야 합니다.
기술 제한, 수명 주기, 가격 책정, 지역별 액세스 및 데이터 정책이 있는 경우 자사 문서를 사용하세요.
동일한 카테고리 내의 모델만 비교하고 각 제공업체의 측정 기준을 유지하세요.
제공자가 비교 가능한 사실을 추정하는 대신 공개하지 않은 경우 표시 미공개입니다.
가격과 가용성을 날짜가 지정된 스냅샷으로 처리하고 모든 페이지를 실시간 제공업체 문서에 연결하세요.
음성 대기 시간, 텍스트 처리량, 비디오 렌더링 시간 및 월드 모델 프레임 속도는 서로 바꿔 사용할 수 없습니다.
누락된 출시 날짜, 국가 목록 또는 지연 시간 번호는 예상 대신 게시되지 않음으로 표시됩니다.
모델 페이지는 기본 소스에 연결되며 가격, 액세스 및 정책이 마지막으로 확인된 시기를 표시합니다.
모델을 작업에 활용
Cody의 확장된 프롬프트 플레이북과 선별된 에이전트 기술을 사용하여 모델 선택을 반복 가능한 워크플로로 전환하세요.