Fournisseurs de reconnaissance vocale

Vue d’ensemble

L’onglet Reconnaissance vocale, sous Fournisseurs LM, gère les fournisseurs que QAnswer utilise pour transcrire l’audio — c’est ce qui alimente l’entrée micro de l’interface de chat :

Speech-to-Text Providers Menu

Ajouter un fournisseur

Cliquez sur Ajouter un fournisseur pour ouvrir l’assistant de création en deux étapes.

Étape 1 — Sélectionner un fournisseur

Choisissez une tuile de fournisseur. On Premise prend en charge la diarisation des locuteurs et lit son URL / sa clé API depuis les paramètres de l’application par défaut. Les fournisseurs disponibles sont :

  • On Premise — 🇪🇺 EU-hosted · RecommandéTranscribe audio using the self-hosted transcriber service. URL and API key are read from the application settings by default and can be overridden here. Supports speaker diarization.
  • OpenAI (Whisper) — 🇺🇸 US-hostedTranscribe audio with OpenAI Whisper via the OpenAI API.
  • Mistral (Voxtral) — 🇪🇺 EU-hostedTranscribe audio with Mistral Voxtral via the Mistral API.
Speech-to-Text Providers Create — Step 1, select a provider

Étape 2 — Configurer les identifiants

Contrairement aux fournisseurs LLM / Embedder, les fournisseurs de reconnaissance vocale n’ont pas de nom interne ni de nom affiché — le formulaire tient en une seule section courte :

  • Clé API — l’identifiant du fournisseur (non requis pour On Premise, qui retombe sur les paramètres de l’application).
  • Modèle — le modèle de transcription à utiliser, choisi parmi les modèles réellement pris en charge par le fournisseur.
  • Coût — coût par minute d’audio transcrit, utilisé pour le suivi de la consommation.
Speech-to-Text Providers Create — Step 2, credentials and model

Validation des champs obligatoires

Soumettre le formulaire avec une clé API obligatoire vide la met en évidence en rouge avec un message d’erreur en ligne, ce qui la rend facile à repérer avant l’enregistrement.

Speech-to-Text Providers — required-field validation

Gérer les fournisseurs existants

Chaque carte de fournisseur propose les actions Test de connexion, Définir par défaut, Modifier et Supprimer. Au-dessus de la liste, quelques outils facilitent la gestion d’un grand nombre de fournisseurs :

  • Recherche — filtre la liste par nom à mesure que vous saisissez.
  • Bascule Grille / Liste — alterne entre une grille de cartes et une disposition en liste compacte.
  • Mode sélection — coche plusieurs fournisseurs pour lancer un Test de connexion, une Activation ou une Suppression en masse depuis la barre d’actions qui apparaît en bas de l’écran.
  • Modifier — ouvre l’entrée sur une page dédiée, en lecture seule jusqu’à ce que vous cliquiez sur Modifier ; le même formulaire que lors de la création.
Speech-to-Text Providers — select mode with batch actions bar

Import et export

Vous pouvez importer ou exporter la liste des fournisseurs de reconnaissance vocale de votre organisation au format JSON à l’aide des boutons de la barre d’outils au-dessus de la liste.

Utilisez le champ de recherche avant d’exporter pour n’inclure que les entrées correspondant à votre filtre de recherche actuel — pratique pour exporter un sous-ensemble d’une longue liste.