Reelina

xAI STT v1 — Reelina AI 聲音

ISO 639-1 語言代碼(菲律賓語使用「fil」)。無論此參數設定為何,模型都能轉錄任何支援語言的語音——設定此參數並搭配 text_normalization=true,可將數字、貨幣與單位轉換為該語言的書寫形式。留空則自動偵測語言。

文字正規化

此設定僅控制逐字稿的文字格式,不影響音訊格式。

語者分離

啟用時將開啟語者分離(speaker diarization)。結果中每個字詞都會包含 speaker_id 欄位以標示偵測到的語者。

多聲道

啟用時,將對每個音訊聲道獨立進行轉錄。

贅字

啟用時,語氣詞(例如「嗯」「啊」)會包含在逐字稿中;停用時(預設),系統會自動移除這些詞。

轉錄時優先識別的關鍵詞(例如產品名稱)。最多 100 個詞彙,每個詞彙最多 50 個字元。

原始/無標頭音訊的格式提示。對於容器格式(例如 mp3、wav 等),可自動偵測,請將此值設為「auto」。

取樣率(Hz)。僅原始音訊(pcm、mulaw、alaw)需要設定。

音訊聲道數量(2–8)。僅在多聲道原始音訊時需要,容器格式會自動偵測。

關於 xAI STT v1

xAI STT v1 是一款生產級語音轉文字模型,能將音訊轉錄為準確且格式化的文字。支援 24 種以上語言,具備自動語言偵測、逐字時間戳記、講者分離、多聲道轉錄及反向文字正規化功能。

規格

供應商xAI
類型音訊生成
單次執行費用 1 積分
輸入文字提示

xAI STT v1 的替代模型

此工作區中能完成同樣任務的模型,依價格接近程度排列。你的積分餘額在所有模型間通用。

常見問題

xAI STT v1 是什麼?
xAI STT v1 是一款生產級語音轉文字模型,能將音訊轉錄為準確且格式化的文字。支援 24 種以上語言,具備自動語言偵測、逐字時間戳記、講者分離、多聲道轉錄及反向文字正規化功能。
xAI STT v1 多少錢?
xAI STT v1 每次執行 1 積分,從你的 Reelina 餘額扣除。按下「生成」前會顯示準確費用,一份餘額通用於所有模型——不需為每個模型單獨訂閱。
使用 xAI STT v1 需要準備什麼?
一段描述你需求的文字提示。不需上傳。
生成結果可以商用嗎?
你生成的內容屬於你,須遵守我們的條款與可接受使用政策。用於關鍵業務前,請查看所選模型的授權條款。
我的檔案會保存多久?
上傳的檔案僅用於產生你的結果。作品預設為私密,生成一週後全部刪除。

在找別的? 瀏覽全部模型.