Reelina

Seed ASR 2.0 — Reelina AI 사운드

오디오 컨테이너 형식입니다.

선택적 언어 코드입니다. 비워두면 중국어/영어/방언을 자동으로 인식합니다. 또는 en-US, zh-CN, yue-CN, ja-JP, es-MX 등의 코드를 지정할 수 있습니다(51개 언어 지원).

ITN 사용

역텍스트 정규화입니다(예: 'one hundred' → '100').

문장 부호 사용

대본에 문장 부호를 추가합니다.

DDC 사용

시맨틱 스무딩(간투사/반복 제거).

화자 정보 사용

화자 분리(최대 10명).

발화 표시

문장 단위로 타임스탬프가 포함된 구간을 반환합니다.

목록에 있는 용어(예: 제품명)의 인식률을 높이기 위한 핫워드 테이블 이름입니다. 참고: 존재하지 않는 테이블 이름은 별도 오류 없이 무시되며 작업은 그대로 성공합니다.

보정 테이블 이름입니다. 존재하지 않는 테이블 이름은 조용히 무시됩니다.

테이블 없이 사용할 수 있는 인라인 핫워드입니다. {"hotwords":[{"word":"YourTerm"}]} 형식의 JSON 문자열이어야 합니다. 경고: JSON 형식이 아닌 일반 텍스트를 입력하면 작업이 실패합니다. 인식되지 않는 JSON 키는 무시됩니다.

Seed ASR 2.0 소개

BytePlus Seed Speech recording-file recognition (ASR 2.0): 오디오 파일을 텍스트로 변환하며, 문장 부호, ITN, 문장 분할, 화자 분리, 51개 언어 지원을 제공합니다.

사양

제공사ByteDance
유형오디오 생성
1회 실행 비용 1 크레딧
입력텍스트 프롬프트

Seed ASR 2.0 대체 모델

이 워크스페이스에서 같은 작업을 하는 모델입니다. 가격이 가까운 순으로 정렬되며, 크레딧 잔액은 모든 모델에 공통으로 쓰입니다.

자주 묻는 질문

Seed ASR 2.0은 무엇인가요?
BytePlus Seed Speech recording-file recognition (ASR 2.0): 오디오 파일을 텍스트로 변환하며, 문장 부호, ITN, 문장 분할, 화자 분리, 51개 언어 지원을 제공합니다.
Seed ASR 2.0 비용은 얼마인가요?
Seed ASR 2.0은 1회 실행에 1 크레딧이며 Reelina 잔액에서 차감됩니다. 정확한 비용은 생성 버튼을 누르기 전에 표시되고, 하나의 잔액으로 모든 모델을 쓸 수 있습니다. 모델별 개별 구독은 없습니다.
Seed ASR 2.0을 쓰려면 무엇이 필요한가요?
원하는 내용을 설명하는 텍스트 프롬프트. 업로드는 필요 없습니다.
결과물을 상업적으로 사용할 수 있나요?
만든 결과물은 이용약관과 허용 사용 정책 범위 안에서 사용자의 것입니다. 비즈니스에 중요한 용도라면 선택한 모델의 라이선스를 확인하세요.
제 파일은 얼마나 보관되나요?
업로드한 파일은 결과를 만드는 데만 쓰입니다. 생성물은 기본적으로 비공개이며, 생성 후 일주일이 지나면 모두 삭제됩니다.

다른 걸 찾고 있나요? 모든 모델 보기.