Speech to Text : API Speech Recognition

Intégrée à vos outils conversationnels : une reconnaissance vocale optimale, conçue pour faciliter la vie des développeurs.

Word Error Rate< 5 %Moteur le plus précis de France, post-LMF
Latence< 600 msSur flux conversationnels en conditions réelles
PrixLe + basDu marché, avec engagement à la minute

De grandes entreprises, intégrateurs et chercheurs nous font confiance

Language Model Factory

Adaptation express des modèles de langage

Grâce à notre Language Model Factory (LMF), ne ratez aucun vocabulaire spécifique. Entraînez vos modèles adaptés en seulement 15 minutes et choisissez celui qui convient le mieux à votre cas d’usage.

  • Un modèle opérationnel en 15 minutes
  • Jargon, noms propres, acronymes métier
  • Modèles pré-entraînés par secteur disponibles
01

Modèles sectoriels

Pré-entraînés sur les verticales métier.

02

Jargon et noms propres

Vocabulaire lié à votre activité.

03

Acronymes

Reconnaissance et expansion auto.

04

Expressions métier

Propres à vos processus et cas d’usage.

Anonymisation

Sécurisation et suppression des données sensibles

Caviardage automatique des informations sensibles en temps réel en fonction de vos cas d’usage : données personnelles, bancaires et de santé.

Agent Acme Corp : Bonjour, vous êtes bien chez Acme Corp[entreprise]. Que puis-je faire pour vous aujourd’hui ?

Client : Bonjour, je vous appelle pour mettre à jour mes informations personnelles.

Agent Acme Corp : Pas de souci, je vais vous aider avec ça. Pouvez-vous me donner votre nom complet, s’il vous plaît ?

Client : Oui, c’est Jean Persona[prénom] [nom].

Agent Acme Corp : Merci, Jean[prénom]. Et quelle est votre nouvelle adresse ?

Client : C’est au 123 Rue de l’Élysée, 75000 Paris[adresse].

Agent Acme Corp : Très bien, c’est noté. Avez-vous également un nouveau numéro de téléphone ?

Client : Oui, le nouveau est le 06 12 34 56 78[téléphone].

Agent Acme Corp : Parfait. Une dernière question : vos informations de paiement ont-elles changé ?

Client : Oui, j’ai une nouvelle carte bancaire : 1234 5678 9101 1121, expiration 12/26, CVV 321[carte bancaire].

Agent Acme Corp : Merci, Jean[prénom]. Vos informations sont à jour !

Batch

API Speech-to-Text des enregistrements audio

Déposez simplement vos conversations téléphoniques sur FTP sécurisé pour une transcription en quelques minutes, ou en utilisant nos connecteurs :

NICEGenesysAxialysOdigo
Langues disponibles

Français, anglais, espagnol, allemand, italien, +5 autres (Europe)

PYTHON SDK
# Dépôt FTP sécurisé
import uhlive
client = uhlive.connect("api.uh.live")
# Transcription batch
job = client.transcribe_file(
    file="appel_2026-04-28.wav",
    model="fr-telephony-v3",
    redaction=True
)
# Résultat
transcript = job.result()
print(transcript.text)
Illustration : transcription multilingue pour les humains
Streaming · Live

Streaming API pour les humains

Connectez directement vos flux audio en WebSocket pour recevoir la transcription en temps réel multi-locuteurs, ou à l’aide de Trunk SIP / SIP REC.

Langues disponibles

Français, anglais, espagnol et allemand

Streaming · Bot

Streaming API pour les bots

Stream API pour les SVI et Voicebot. Transcrivez vos interactions live avec nos solutions avancées.

Illustration : voicebot multilingue
Nos protocoles
  • › MRCP v2
  • › WebSocket
Built-in pour chaque interaction

Gestion des temps de parole, choix des modèles de langage, grammaires, reconnaissance d’adresses, de dates, de chiffres et de réponses booléennes.

Langues disponibles

Français, anglais, espagnol et allemand

WER < 5 %Moteur le plus précis en France
100 MAppels analysés par an
40 %Des analyses en temps réel

Prêt à transcrire vos premiers appels ?

Accédez à l’API Speech-to-Text uh!ive. Configuration en quelques minutes.

Essayez Gratuitement