xAI STT v1 — Reelina AI 聲音
ISO 639-1 語言代碼(菲律賓語使用「fil」)。無論此參數設定為何,模型都能轉錄任何支援語言的語音——設定此參數並搭配 text_normalization=true,可將數字、貨幣與單位轉換為該語言的書寫形式。留空則自動偵測語言。
文字正規化
此設定僅控制逐字稿的文字格式,不影響音訊格式。
語者分離
啟用時將開啟語者分離(speaker diarization)。結果中每個字詞都會包含 speaker_id 欄位以標示偵測到的語者。
多聲道
啟用時,將對每個音訊聲道獨立進行轉錄。
贅字
啟用時,語氣詞(例如「嗯」「啊」)會包含在逐字稿中;停用時(預設),系統會自動移除這些詞。
轉錄時優先識別的關鍵詞(例如產品名稱)。最多 100 個詞彙,每個詞彙最多 50 個字元。
原始/無標頭音訊的格式提示。對於容器格式(例如 mp3、wav 等),可自動偵測,請將此值設為「auto」。
取樣率(Hz)。僅原始音訊(pcm、mulaw、alaw)需要設定。
音訊聲道數量(2–8)。僅在多聲道原始音訊時需要,容器格式會自動偵測。
關於 xAI STT v1
xAI STT v1 是一款生產級語音轉文字模型,能將音訊轉錄為準確且格式化的文字。支援 24 種以上語言,具備自動語言偵測、逐字時間戳記、講者分離、多聲道轉錄及反向文字正規化功能。
規格
| 供應商 | xAI |
|---|---|
| 類型 | 音訊生成 |
| 單次執行費用 | 1 積分 |
| 輸入 | 文字提示 |
xAI STT v1 的替代模型
此工作區中能完成同樣任務的模型,依價格接近程度排列。你的積分餘額在所有模型間通用。
常見問題
- xAI STT v1 是什麼?
- xAI STT v1 是一款生產級語音轉文字模型,能將音訊轉錄為準確且格式化的文字。支援 24 種以上語言,具備自動語言偵測、逐字時間戳記、講者分離、多聲道轉錄及反向文字正規化功能。
- xAI STT v1 多少錢?
- xAI STT v1 每次執行 1 積分,從你的 Reelina 餘額扣除。按下「生成」前會顯示準確費用,一份餘額通用於所有模型——不需為每個模型單獨訂閱。
- 使用 xAI STT v1 需要準備什麼?
- 一段描述你需求的文字提示。不需上傳。
- 生成結果可以商用嗎?
- 你生成的內容屬於你,須遵守我們的條款與可接受使用政策。用於關鍵業務前,請查看所選模型的授權條款。
- 我的檔案會保存多久?
- 上傳的檔案僅用於產生你的結果。作品預設為私密,生成一週後全部刪除。
在找別的? 瀏覽全部模型.
