Seed ASR 2.0 — Reelina AI 사운드
오디오 컨테이너 형식입니다.
선택적 언어 코드입니다. 비워두면 중국어/영어/방언을 자동으로 인식합니다. 또는 en-US, zh-CN, yue-CN, ja-JP, es-MX 등의 코드를 지정할 수 있습니다(51개 언어 지원).
ITN 사용
역텍스트 정규화입니다(예: 'one hundred' → '100').
문장 부호 사용
대본에 문장 부호를 추가합니다.
DDC 사용
시맨틱 스무딩(간투사/반복 제거).
화자 정보 사용
화자 분리(최대 10명).
발화 표시
문장 단위로 타임스탬프가 포함된 구간을 반환합니다.
목록에 있는 용어(예: 제품명)의 인식률을 높이기 위한 핫워드 테이블 이름입니다. 참고: 존재하지 않는 테이블 이름은 별도 오류 없이 무시되며 작업은 그대로 성공합니다.
보정 테이블 이름입니다. 존재하지 않는 테이블 이름은 조용히 무시됩니다.
테이블 없이 사용할 수 있는 인라인 핫워드입니다. {"hotwords":[{"word":"YourTerm"}]} 형식의 JSON 문자열이어야 합니다. 경고: JSON 형식이 아닌 일반 텍스트를 입력하면 작업이 실패합니다. 인식되지 않는 JSON 키는 무시됩니다.
Seed ASR 2.0 소개
BytePlus Seed Speech recording-file recognition (ASR 2.0): 오디오 파일을 텍스트로 변환하며, 문장 부호, ITN, 문장 분할, 화자 분리, 51개 언어 지원을 제공합니다.
사양
| 제공사 | ByteDance |
|---|---|
| 유형 | 오디오 생성 |
| 1회 실행 비용 | 1 크레딧 |
| 입력 | 텍스트 프롬프트 |
Seed ASR 2.0 대체 모델
이 워크스페이스에서 같은 작업을 하는 모델입니다. 가격이 가까운 순으로 정렬되며, 크레딧 잔액은 모든 모델에 공통으로 쓰입니다.
자주 묻는 질문
- Seed ASR 2.0은 무엇인가요?
- BytePlus Seed Speech recording-file recognition (ASR 2.0): 오디오 파일을 텍스트로 변환하며, 문장 부호, ITN, 문장 분할, 화자 분리, 51개 언어 지원을 제공합니다.
- Seed ASR 2.0 비용은 얼마인가요?
- Seed ASR 2.0은 1회 실행에 1 크레딧이며 Reelina 잔액에서 차감됩니다. 정확한 비용은 생성 버튼을 누르기 전에 표시되고, 하나의 잔액으로 모든 모델을 쓸 수 있습니다. 모델별 개별 구독은 없습니다.
- Seed ASR 2.0을 쓰려면 무엇이 필요한가요?
- 원하는 내용을 설명하는 텍스트 프롬프트. 업로드는 필요 없습니다.
- 결과물을 상업적으로 사용할 수 있나요?
- 만든 결과물은 이용약관과 허용 사용 정책 범위 안에서 사용자의 것입니다. 비즈니스에 중요한 용도라면 선택한 모델의 라이선스를 확인하세요.
- 제 파일은 얼마나 보관되나요?
- 업로드한 파일은 결과를 만드는 데만 쓰입니다. 생성물은 기본적으로 비공개이며, 생성 후 일주일이 지나면 모두 삭제됩니다.
다른 걸 찾고 있나요? 모든 모델 보기.
