> ## Documentation Index
> Fetch the complete documentation index at: https://veniceai-mintlify-f533effe.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Modèles de transcription (Speech-to-Text)

> Modèles de transcription Venice : audio vers texte multilingue, horodatages et endpoint /audio/transcriptions compatible OpenAI pour vos applis.

<div id="model-search-placeholder" data-filter="asr">
  Utilisez la valeur `id` comme paramètre `model` dans les requêtes API. 5 modèles actuellement disponibles.

  | Modèle                | ID                            | Par seconde audio | Confidentialité |
  | --------------------- | ----------------------------- | ----------------- | --------------- |
  | ElevenLabs Scribe V2  | `elevenlabs/scribe-v2`        | \$0.0002          | Anonymized      |
  | Parakeet ASR          | `nvidia/parakeet-tdt-0.6b-v3` | \$0.0001          | Private         |
  | Whisper Large V3      | `openai/whisper-large-v3`     | \$0.0001          | Private         |
  | Wizper (Whisper v3)   | `fal-ai/wizper`               | \$0.0001          | Private         |
  | xAI Speech to Text v1 | `stt-xai-v1`                  | \$0.0000          | Anonymized      |
</div>

***

## Utilisation

Les modèles de transcription convertissent l'audio parlé en texte écrit. Ils sont accessibles via l'[API Audio Transcriptions](/api-reference/endpoint/audio/transcriptions).

### Formats audio pris en charge

`mp3`, `mp4`, `mpeg`, `mpga`, `m4a`, `wav`, `webm`, `flac`, `ogg`

### Formats de réponse

| Format         | Description                                                            |
| -------------- | ---------------------------------------------------------------------- |
| `json`         | Par défaut. Renvoie `{ "text": "..." }`.                               |
| `text`         | Texte transcrit brut.                                                  |
| `srt`          | Format de sous-titres SubRip avec horodatages.                         |
| `vtt`          | Format de sous-titres WebVTT avec horodatages.                         |
| `verbose_json` | Réponse complète avec horodatages au niveau du segment et métadonnées. |

<Note>
  La tarification est facturée par seconde d'audio en entrée. Voir l'[API Audio Transcriptions](/api-reference/endpoint/audio/transcriptions) pour des exemples de requête et des détails sur les paramètres.
</Note>
