Reelina

xAI STT v1 — Reelina AI 사운드

ISO 639-1 언어 코드입니다(필리핀어는 'fil' 사용). 이 매개변수와 관계없이 모델은 지원되는 모든 언어의 음성을 전사합니다. 이 값을 설정하고 text_normalization=true로 지정하면 해당 언어에 맞게 숫자, 화폐, 단위를 문자 형식으로 표기할 수 있습니다. 언어를 자동으로 감지하려면 설정하지 마세요.

텍스트 정규화

이는 오디오 형식이 아닌 전사문의 텍스트 형식을 제어합니다.

화자 분리

true로 설정하면 화자 구분(Speaker Diarization)이 활성화됩니다. 결과의 각 단어에는 감지된 화자를 식별하는 speaker_id 필드가 포함됩니다.

다채널

true로 설정하면 각 오디오 채널을 독립적으로 전사합니다.

간투사

true로 설정하면 필러 단어(예: "음", "어")가 전사 결과에 포함됩니다. false(기본값)일 경우 자동으로 제거됩니다.

전사 시 우선적으로 인식할 핵심 용어입니다(예: 제품명). 최대 100개, 각 용어는 최대 50자까지 가능합니다.

헤더가 없는 원시 오디오를 위한 형식 힌트입니다. mp3, wav 등 컨테이너 형식은 자동으로 감지되며, 이 경우 값을 'auto'로 설정하세요.

샘플레이트(Hz)입니다. 원시 오디오(pcm, mulaw, alaw)에만 필요합니다.

오디오 채널 수(2~8)입니다. 멀티채널 raw 오디오에만 필요하며, 컨테이너 포맷은 자동으로 감지됩니다.

xAI STT v1 소개

xAI STT v1은 오디오를 정확하고 형식화된 텍스트로 변환하는 프로덕션급 speech-to-text 모델입니다. 24개 이상의 언어를 자동 언어 감지, 단어 단위 타임스탬프, 화자 분리(speaker diarization), 다채널 트랜스크립션, 역 텍스트 정규화와 함께 지원합니다.

사양

제공사xAI
유형오디오 생성
1회 실행 비용 1 크레딧
입력텍스트 프롬프트

xAI STT v1 대체 모델

이 워크스페이스에서 같은 작업을 하는 모델입니다. 가격이 가까운 순으로 정렬되며, 크레딧 잔액은 모든 모델에 공통으로 쓰입니다.

자주 묻는 질문

xAI STT v1은 무엇인가요?
xAI STT v1은 오디오를 정확하고 형식화된 텍스트로 변환하는 프로덕션급 speech-to-text 모델입니다. 24개 이상의 언어를 자동 언어 감지, 단어 단위 타임스탬프, 화자 분리(speaker diarization), 다채널 트랜스크립션, 역 텍스트 정규화와 함께 지원합니다.
xAI STT v1 비용은 얼마인가요?
xAI STT v1은 1회 실행에 1 크레딧이며 Reelina 잔액에서 차감됩니다. 정확한 비용은 생성 버튼을 누르기 전에 표시되고, 하나의 잔액으로 모든 모델을 쓸 수 있습니다. 모델별 개별 구독은 없습니다.
xAI STT v1을 쓰려면 무엇이 필요한가요?
원하는 내용을 설명하는 텍스트 프롬프트. 업로드는 필요 없습니다.
결과물을 상업적으로 사용할 수 있나요?
만든 결과물은 이용약관과 허용 사용 정책 범위 안에서 사용자의 것입니다. 비즈니스에 중요한 용도라면 선택한 모델의 라이선스를 확인하세요.
제 파일은 얼마나 보관되나요?
업로드한 파일은 결과를 만드는 데만 쓰입니다. 생성물은 기본적으로 비공개이며, 생성 후 일주일이 지나면 모두 삭제됩니다.

다른 걸 찾고 있나요? 모든 모델 보기.