Reelina

Seed ASR 2.0 — Reelina AI サウンド

オーディオコンテナ形式。

言語コード(任意)。空欄のままにすると中国語/英語/各方言を自動判定します。コードを指定することもできます(例:en-US、zh-CN、yue-CN、ja-JP、es-MXなど、51言語に対応)。

ITNを有効化

逆テキスト正規化(例:「one hundred」→「100」)。

句読点を有効化

文字起こしに句読点を追加します。

DDCを有効化

セマンティックスムージング(フィラーや繰り返しを除去)。

話者情報を有効化

話者分離(最大10人まで)。

発話を表示

タイムスタンプ付きの文単位セグメントを返します。

リストに登録された用語(製品名など)の認識精度を高めるホットワードテーブル名。テーブル名の取得には単語リストを添えてお問い合わせください。注:存在しないテーブル名を指定してもエラーにはならず、そのままタスクは成功します。

補正テーブル名: 認識後の強制置換(誤り→正しいのペア)。存在しないテーブル名は無視されます。

テーブルを使わないインラインのホットワード。{"hotwords":[{"word":"YourTerm"}]} という形式のJSON文字列である必要があります。警告:JSON形式でない通常のテキストを指定するとタスクは失敗します。認識されないJSONキーは無視されます。

Seed ASR 2.0 について

BytePlus Seed Speech recording-file recognition(ASR 2.0):音声ファイルをテキストに書き起こし、句読点付与、ITN、文分割、話者分離、51言語対応を実現。

仕様

提供元ByteDance
種類音声生成
1回あたりの費用 1 クレジット
入力テキストプロンプト

Seed ASR 2.0 の代替モデル

このワークスペースで同じ用途に使えるモデル。価格が近い順に並んでいます。クレジット残高はすべてのモデルで共通です。

よくある質問

Seed ASR 2.0 とは?
BytePlus Seed Speech recording-file recognition(ASR 2.0):音声ファイルをテキストに書き起こし、句読点付与、ITN、文分割、話者分離、51言語対応を実現。
Seed ASR 2.0 の料金は?
Seed ASR 2.0 は1回の実行につき 1 クレジットで、Reelina の残高から差し引かれます。正確な費用は「生成」を押す前に表示され、1つの残高ですべてのモデルを利用できます。モデルごとの個別契約はありません。
Seed ASR 2.0 を使うには何が必要ですか?
作りたいものを説明するテキストプロンプト。アップロードは不要です。
生成物を商用利用できますか?
生成したものはあなたのものです(利用規約と使用許諾ポリシーの範囲内)。業務上重要な用途では、選んだモデルのライセンスをご確認ください。
ファイルはどのくらい保存されますか?
アップロードされたファイルは結果の生成にのみ使われます。作成物は既定で非公開で、生成から1週間後にすべて削除されます。

ほかをお探しですか? すべてのモデルを見る.