xAI STT v1 — Reelina AI Son
Code de langue ISO 639-1 (le filipino utilise « fil »). Le modèle transcrit la parole dans n'importe quelle langue prise en charge, indépendamment de ce paramètre — le définir, avec text_normalization=true, permet de formater les nombres, devises et unités sous leur forme écrite pour cette langue. Laissez ce champ vide pour une détection automatique de la langue.
Si activé, active la normalisation inverse du texte — convertit les nombres/devises en forme parlée vers leur forme écrite (par ex. « cent dollars » en « 100 $ »). Ceci contrôle le formatage du texte de la transcription, pas le format audio.
Si activé, active la diarisation des locuteurs. Chaque mot du résultat inclut un champ speaker_id identifiant le locuteur détecté.
Si activé, transcrit chaque canal audio indépendamment.
Si activé, les mots de remplissage (par ex. « euh », « hum ») sont inclus dans la transcription ; s'il est désactivé (par défaut), ils sont automatiquement supprimés.
Termes clés à privilégier pour la transcription (ex. noms de produits). Jusqu'à 100 termes, chacun de 50 caractères maximum.
Indice de format pour l'audio brut sans en-tête. Détecté automatiquement pour les formats conteneurs (comme mp3, wav, etc.), réglez la valeur sur 'auto'.
Fréquence d'échantillonnage en Hz. Requise uniquement pour l'audio brut (pcm, mulaw, alaw).
Nombre de canaux audio (2 à 8). Requis uniquement pour l'audio brut multicanal. Détecté automatiquement pour les formats conteneurs.
À propos de xAI STT v1
xAI STT v1 est un modèle speech-to-text de qualité production qui transcrit l'audio en texte précis et formaté. Il prend en charge 24+ langues avec détection automatique de la langue, horodatage au niveau du mot, diarisation des locuteurs, transcription multicanal et normalisation inverse du texte.
Caractéristiques
| Fournisseur | xAI |
|---|---|
| Type | Génération audio |
| Coût par exécution | 1 pièces |
| Entrée | Prompt texte |
Alternatives à xAI STT v1
Les modèles de cet espace qui font le même travail, du prix le plus proche au plus éloigné. Votre solde de pièces fonctionne pour tous.
Questions fréquentes
- Qu'est-ce que xAI STT v1 ?
- xAI STT v1 est un modèle speech-to-text de qualité production qui transcrit l'audio en texte précis et formaté. Il prend en charge 24+ langues avec détection automatique de la langue, horodatage au niveau du mot, diarisation des locuteurs, transcription multicanal et normalisation inverse du texte.
- Combien coûte xAI STT v1 ?
- xAI STT v1 coûte 1 pièces par exécution, déduites de votre solde Reelina. Le coût exact s'affiche avant que vous appuyiez sur Générer, et un seul solde couvre tous les modèles — pas d'abonnement séparé par modèle.
- De quoi ai-je besoin pour utiliser xAI STT v1 ?
- Un prompt texte décrivant ce que vous voulez. Aucun envoi de fichier nécessaire.
- Puis-je utiliser les résultats à des fins commerciales ?
- Vos créations vous appartiennent, dans le respect de nos conditions et de notre politique d'utilisation acceptable. Pour un usage critique, vérifiez la licence du modèle choisi.
- Combien de temps mes fichiers sont-ils conservés ?
- Les fichiers envoyés servent uniquement à produire votre résultat. Les créations sont privées par défaut et tout est supprimé une semaine après la génération.
Vous cherchez autre chose ? Voir tous les modèles.
