xAI STT v1 — Reelina AI 사운드
ISO 639-1 언어 코드입니다(필리핀어는 'fil' 사용). 이 매개변수와 관계없이 모델은 지원되는 모든 언어의 음성을 전사합니다. 이 값을 설정하고 text_normalization=true로 지정하면 해당 언어에 맞게 숫자, 화폐, 단위를 문자 형식으로 표기할 수 있습니다. 언어를 자동으로 감지하려면 설정하지 마세요.
이는 오디오 형식이 아닌 전사문의 텍스트 형식을 제어합니다.
true로 설정하면 화자 구분(Speaker Diarization)이 활성화됩니다. 결과의 각 단어에는 감지된 화자를 식별하는 speaker_id 필드가 포함됩니다.
true로 설정하면 각 오디오 채널을 독립적으로 전사합니다.
true로 설정하면 필러 단어(예: "음", "어")가 전사 결과에 포함됩니다. false(기본값)일 경우 자동으로 제거됩니다.
전사 시 우선적으로 인식할 핵심 용어입니다(예: 제품명). 최대 100개, 각 용어는 최대 50자까지 가능합니다.
헤더가 없는 원시 오디오를 위한 형식 힌트입니다. mp3, wav 등 컨테이너 형식은 자동으로 감지되며, 이 경우 값을 'auto'로 설정하세요.
샘플레이트(Hz)입니다. 원시 오디오(pcm, mulaw, alaw)에만 필요합니다.
오디오 채널 수(2~8)입니다. 멀티채널 raw 오디오에만 필요하며, 컨테이너 포맷은 자동으로 감지됩니다.
xAI STT v1 소개
xAI STT v1은 오디오를 정확하고 형식화된 텍스트로 변환하는 프로덕션급 speech-to-text 모델입니다. 24개 이상의 언어를 자동 언어 감지, 단어 단위 타임스탬프, 화자 분리(speaker diarization), 다채널 트랜스크립션, 역 텍스트 정규화와 함께 지원합니다.
사양
| 제공사 | xAI |
|---|---|
| 유형 | 오디오 생성 |
| 1회 실행 비용 | 1 크레딧 |
| 입력 | 텍스트 프롬프트 |
xAI STT v1 대체 모델
이 워크스페이스에서 같은 작업을 하는 모델입니다. 가격이 가까운 순으로 정렬되며, 크레딧 잔액은 모든 모델에 공통으로 쓰입니다.
자주 묻는 질문
- xAI STT v1은 무엇인가요?
- xAI STT v1은 오디오를 정확하고 형식화된 텍스트로 변환하는 프로덕션급 speech-to-text 모델입니다. 24개 이상의 언어를 자동 언어 감지, 단어 단위 타임스탬프, 화자 분리(speaker diarization), 다채널 트랜스크립션, 역 텍스트 정규화와 함께 지원합니다.
- xAI STT v1 비용은 얼마인가요?
- xAI STT v1은 1회 실행에 1 크레딧이며 Reelina 잔액에서 차감됩니다. 정확한 비용은 생성 버튼을 누르기 전에 표시되고, 하나의 잔액으로 모든 모델을 쓸 수 있습니다. 모델별 개별 구독은 없습니다.
- xAI STT v1을 쓰려면 무엇이 필요한가요?
- 원하는 내용을 설명하는 텍스트 프롬프트. 업로드는 필요 없습니다.
- 결과물을 상업적으로 사용할 수 있나요?
- 만든 결과물은 이용약관과 허용 사용 정책 범위 안에서 사용자의 것입니다. 비즈니스에 중요한 용도라면 선택한 모델의 라이선스를 확인하세요.
- 제 파일은 얼마나 보관되나요?
- 업로드한 파일은 결과를 만드는 데만 쓰입니다. 생성물은 기본적으로 비공개이며, 생성 후 일주일이 지나면 모두 삭제됩니다.
다른 걸 찾고 있나요? 모든 모델 보기.
