xAI STT v1 — Reelina AI Audio
Codice lingua ISO 639-1 (il filippino usa 'fil'). Il modello trascrive il parlato in qualsiasi lingua supportata indipendentemente da questo parametro: impostarlo, insieme a text_normalization=true, permette di formattare numeri, valute e unità nella loro forma scritta per quella lingua. Lascia vuoto per il rilevamento automatico della lingua.
Se impostato su true, abilita la normalizzazione inversa del testo, che converte numeri/valute in forma parlata in forma scritta (es. Controlla la formattazione del testo della trascrizione, non il formato audio.
Se impostato su true, abilita la diarizzazione dei parlanti. Ogni parola nel risultato include un campo speaker_id che identifica il parlante rilevato.
Se impostato su true, trascrive ogni canale audio in modo indipendente.
Se impostato su true, le parole di riempimento (es. "ehm", "uh") vengono incluse nella trascrizione; se false (predefinito), vengono rimosse automaticamente.
Termini chiave verso cui orientare la trascrizione (es. nomi di prodotto). Fino a 100 termini, ciascuno di massimo 50 caratteri.
Suggerimento di formato per audio grezzo/senza header. Rilevato automaticamente per i formati contenitore (come mp3, wav, ecc.), imposta il valore su 'auto'.
Frequenza di campionamento in Hz. Richiesta solo per audio raw (pcm, mulaw, alaw).
Numero di canali audio (2-8). Richiesto solo per audio raw multicanale. Rilevato automaticamente per i formati container.
Informazioni su xAI STT v1
xAI STT v1 is a production-grade speech-to-text model that transcribes audio into accurate, formatted text. It supports 24+ languages with automatic language detection, word-level timestamps, speaker diarization, multichannel transcription, and inverse text normalization.
Specifiche
| Fornitore | xAI |
|---|---|
| Tipo | Generazione audio |
| Costo per esecuzione | 1 crediti |
| Input | Prompt testuale |
Alternative a xAI STT v1
Modelli di questo workspace che fanno lo stesso lavoro, dal prezzo più vicino. Il tuo saldo crediti vale per tutti.
Domande frequenti
- Che cos'è xAI STT v1?
- xAI STT v1 is a production-grade speech-to-text model that transcribes audio into accurate, formatted text. It supports 24+ languages with automatic language detection, word-level timestamps, speaker diarization, multichannel transcription, and inverse text normalization.
- Quanto costa xAI STT v1?
- xAI STT v1 costa 1 crediti per esecuzione, scalati dal tuo saldo Reelina. Il costo esatto è mostrato prima di premere Genera e un solo saldo copre tutti i modelli: nessun abbonamento separato per modello.
- Cosa mi serve per usare xAI STT v1?
- Un prompt testuale che descriva quello che vuoi. Nessun caricamento necessario.
- Posso usare i risultati a fini commerciali?
- Le tue creazioni sono tue, nel rispetto dei nostri termini e della policy di uso accettabile. Per usi business-critical, controlla la licenza del modello scelto.
- Per quanto tempo restano i miei file?
- I file caricati servono solo a produrre il risultato. Le creazioni sono private per impostazione predefinita e tutto viene eliminato una settimana dopo la generazione.
Cerchi qualcos'altro? Sfoglia tutti i modelli.
