Baarcha · Fennec

Transcription en tunisien : ASR et STT — Fennec

Fennec est le modèle de reconnaissance vocale en darja tunisienne de Baarcha. L’ASR (automatic speech recognition), aussi appelé speech-to-text ou STT, transforme la parole en texte. Essayez une note vocale avec des passages en français : le playground accepte le microphone et les fichiers audio, et l’API permet d’intégrer la transcription dans votre logiciel.

Des usages à tester

  • Obtenir un brouillon de transcription d’une note vocale autorisée.
  • Évaluer la transcription après appel sur des enregistrements représentatifs d’un centre d’appel.
  • Vérifier les noms, les montants et le changement de langue avec une référence humaine.

Tester sur votre propre exemple

  1. Enregistrez un message fictif avec un nom, un nombre et une expression française.
  2. Écrivez la transcription de référence avant de lancer le modèle.
  3. Chargez le fichier dans le mode Transcription du playground ; la limite actuelle y est indiquée.
  4. Comparez le résultat, puis essayez /api/v1/audio/transcriptions en multipart avec le modèle fennec.

Un exemple pour commencer

عسلامة، نحب نبدّل موعدي للجمعة مع العشرة متاع الصباح. ابعثلي confirmation بالـSMS.

Une consigne à essayer, pas une réponse garantie.

Les points à vérifier

Le bruit, les locuteurs et la qualité audio changent le résultat. Une démonstration choisie ne mesure pas la précision en production. La séparation des locuteurs, la téléphonie et la validation humaine demandent une intégration distincte. Utilisez seulement des enregistrements que vous pouvez traiter.

Grille d’évaluation ↗

API de transcription audio en tunisien

Créez une clé API dans le tableau de bord et définissez BAARCHA_API_KEY sur votre serveur. Remplacez recording.mp3 par votre fichier audio. Envoyez le fichier et le modèle en multipart ; la réponse JSON par défaut contient la transcription dans le champ text.

curl https://baarcha.tn/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $BAARCHA_API_KEY" \
  -F file=@'recording.mp3' \
  -F model=fennec
Documentation API ↗

Vos questions sur l’ASR et le STT tunisiens

Quelle différence entre ASR et STT ?

ASR signifie automatic speech recognition, ou reconnaissance vocale. STT signifie speech-to-text, ou conversion de la parole en texte. Ici, les deux désignent la transcription de la darja tunisienne avec Fennec. Le modèle ne produit pas une réponse parlée.

Fennec reconnaît-il la darja mélangée au français ?

Fennec prend en charge la parole tunisienne et les passages en français. Comparez des enregistrements représentatifs de votre usage à une transcription humaine. Vérifiez les changements de langue, les noms propres, les montants et les passages avec du bruit.

Comment convertir une note vocale tunisienne en texte ?

Ouvrez le mode Transcription du playground, importez un fichier ou enregistrez-vous au microphone. Lancez la transcription et relisez le texte obtenu. Pour une intégration, envoyez l’audio à /api/v1/audio/transcriptions avec le modèle fennec.

La transcription traduit-elle ou résume-t-elle l’audio ?

La transcription écrit ce qui a été dit. La traduction et le résumé sont des étapes distinctes. Vous pouvez transmettre une transcription relue à Hannibal avec une consigne de traduction ou de résumé, puis vérifier que le sens est conservé.

Les autres modèles

Essayer Fennec