Seed ASR 2.0 — Reelina AI サウンド
オーディオコンテナ形式。
言語コード(任意)。空欄のままにすると中国語/英語/各方言を自動判定します。コードを指定することもできます(例:en-US、zh-CN、yue-CN、ja-JP、es-MXなど、51言語に対応)。
ITNを有効化
逆テキスト正規化(例:「one hundred」→「100」)。
句読点を有効化
文字起こしに句読点を追加します。
DDCを有効化
セマンティックスムージング(フィラーや繰り返しを除去)。
話者情報を有効化
話者分離(最大10人まで)。
発話を表示
タイムスタンプ付きの文単位セグメントを返します。
リストに登録された用語(製品名など)の認識精度を高めるホットワードテーブル名。テーブル名の取得には単語リストを添えてお問い合わせください。注:存在しないテーブル名を指定してもエラーにはならず、そのままタスクは成功します。
補正テーブル名: 認識後の強制置換(誤り→正しいのペア)。存在しないテーブル名は無視されます。
テーブルを使わないインラインのホットワード。{"hotwords":[{"word":"YourTerm"}]} という形式のJSON文字列である必要があります。警告:JSON形式でない通常のテキストを指定するとタスクは失敗します。認識されないJSONキーは無視されます。
Seed ASR 2.0 について
BytePlus Seed Speech recording-file recognition(ASR 2.0):音声ファイルをテキストに書き起こし、句読点付与、ITN、文分割、話者分離、51言語対応を実現。
仕様
| 提供元 | ByteDance |
|---|---|
| 種類 | 音声生成 |
| 1回あたりの費用 | 1 クレジット |
| 入力 | テキストプロンプト |
Seed ASR 2.0 の代替モデル
このワークスペースで同じ用途に使えるモデル。価格が近い順に並んでいます。クレジット残高はすべてのモデルで共通です。
よくある質問
- Seed ASR 2.0 とは?
- BytePlus Seed Speech recording-file recognition(ASR 2.0):音声ファイルをテキストに書き起こし、句読点付与、ITN、文分割、話者分離、51言語対応を実現。
- Seed ASR 2.0 の料金は?
- Seed ASR 2.0 は1回の実行につき 1 クレジットで、Reelina の残高から差し引かれます。正確な費用は「生成」を押す前に表示され、1つの残高ですべてのモデルを利用できます。モデルごとの個別契約はありません。
- Seed ASR 2.0 を使うには何が必要ですか?
- 作りたいものを説明するテキストプロンプト。アップロードは不要です。
- 生成物を商用利用できますか?
- 生成したものはあなたのものです(利用規約と使用許諾ポリシーの範囲内)。業務上重要な用途では、選んだモデルのライセンスをご確認ください。
- ファイルはどのくらい保存されますか?
- アップロードされたファイルは結果の生成にのみ使われます。作成物は既定で非公開で、生成から1週間後にすべて削除されます。
ほかをお探しですか? すべてのモデルを見る.
