Tous les articles
12 min de lecture

API de transcription hébergée en France : où passent vos médias

L’audio transporte des données personnelles : choisir une API de transcription ne se résume pas à la précision du modèle. Où le média est traité, combien de temps les fichiers survivent, comment la suppression se propage — voici la réponse de Techtuel et les questions à poser à tout fournisseur.

Un fichier audio ou vidéo peut contenir des données personnelles, des échanges confidentiels, des informations clients ou des contenus non publiés.

Pour une application européenne, choisir une API de transcription n’est donc pas qu’une affaire de précision du modèle.

Il faut aussi savoir :

  • où le média est téléchargé ;
  • où l’audio est traité ;
  • quels fournisseurs cloud interviennent ;
  • combien de temps les fichiers temporaires subsistent ;
  • où les transcriptions sont stockées ;
  • comment supprimer un contenu ;
  • quels sous-traitants supplémentaires reçoivent les données.

Techtuel est une API de transcription de médias web conçue et hébergée en France.

Elle convertit vidéos YouTube, podcasts, sources RSS, fichiers audio et URL vidéo en transcriptions structurées, en gardant la chaîne de traitement sur une infrastructure européenne.

Conçu et hébergé en France

L’infrastructure de Techtuel s’appuie sur des fournisseurs français :

  • traitement des médias sur OVHcloud à Gravelines ;
  • secrets hébergés chez Scaleway ;
  • aucune dépendance à AWS, Google Cloud ou Microsoft Azure dans la chaîne de transcription.

Le détail de ces choix techniques est exposé sur la page infrastructure.

L’objectif est simple : garder les médias soumis et les transcriptions produites dans un environnement technique français et européen.

Votre application

API Techtuel

Traitement média européen

Transcription horodatée

Envoyer une URL plutôt que déplacer des fichiers de cloud en cloud

Beaucoup de workflows de transcription multiplient les copies d’un même contenu :

  1. télécharger le média dans votre application ;
  2. le stocker temporairement ;
  3. le téléverser chez un prestataire de speech-to-text ;
  4. télécharger le résultat ;
  5. supprimer les copies temporaires.

Techtuel accepte directement l’URL de la source d’origine.

curl https://api.techtuel.com/v1/transcribe \
  -H "Authorization: Bearer $TECHTUEL_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "source_url": "https://cdn.example.eu/prive/entretien.mp4"
  }'

Le service résout la source, transcrit le média et renvoie le texte dans la réponse.

Autant de composants d’infrastructure en moins à exploiter de votre côté.

Des jobs asynchrones pour les enregistrements longs

Un long entretien ne tient pas dans une requête HTTP. Passé trente secondes d’attente (ajustables via ?wait=, jusqu’à 120), POST /v1/transcribe renvoie un 202 Accepted avec un identifiant de job au lieu du texte. Ce n’est pas une erreur : le traitement continue.

Vous récupérez alors la transcription quand elle est prête :

GET /v1/transcriptions/:id

POST /v1/transcriptions reste disponible si vous préférez obtenir l’identifiant immédiatement et piloter le suivi vous-même — c’est le bon outil pour ingérer un fonds d’archives.

Les états sont les suivants :

processing → completed
           ↘ failed

Un job passe aussi brièvement par claimed, le temps qu’un worker le prenne : traitez-le comme processing. Seuls completed et failed sont terminaux. Un job en échec porte un message dans error et peut être relancé avec POST /v1/transcriptions/{id}/retry. Le cycle de vie complet est documenté sur la page API de transcription asynchrone.

Il n’y a pas de rappel par webhook : vous interrogez le job. C’est un point d’entrée public de moins à authentifier et à protéger chez vous — une simplification qui compte quand le contenu est confidentiel.

Ce schéma permet de :

  • traiter des enregistrements longs ;
  • s’appuyer sur des workers de fond ;
  • maîtriser la concurrence ;
  • rejouer les échecs transitoires ;
  • ingérer des catalogues de médias ;
  • séparer la transcription de l’indexation.

Minimiser les données par l’architecture

Vous réduisez le risque en n’envoyant et ne stockant que ce dont votre produit a besoin.

Quelques techniques utiles :

  • ne transcrire que les médias nécessaires ;
  • éviter de stocker le fichier d’origine dans votre propre infrastructure ;
  • ne conserver la transcription brute que si nécessaire ;
  • retirer les métadonnées superflues ;
  • caviarder les champs sensibles ;
  • appliquer des contrôles d’accès par client ;
  • chiffrer les transcriptions stockées ;
  • définir une durée de conservation automatique ;
  • supprimer les embeddings quand la transcription source disparaît.

Gardez en tête que les embeddings et les résumés restent des données personnelles dérivées lorsque leur source en contient.

Construire un workflow de suppression

Une commande de suppression de production coordonne toutes les copies :

type DeleteMediaCommand = {
  tenantId: string
  mediaId: string
}
 
export async function deleteMedia(command: DeleteMediaCommand): Promise<void> {
  // DELETE /v1/transcriptions/{id} côté Techtuel...
  await deleteRemoteTranscription(command.mediaId)
  // ...puis toutes les copies que vous en avez dérivées.
  await deleteTranscriptChunks(command.tenantId, command.mediaId)
  await deleteSearchDocuments(command.tenantId, command.mediaId)
  await deleteLocalTranscript(command.tenantId, command.mediaId)
  await recordDeletion(command)
}

L’implémentation exacte dépend de votre stockage, mais le principe compte : la suppression doit se propager à chaque actif dérivé.

Workflows médias pris en charge

Un seul point d’entrée traite plusieurs types de sources :

  • vidéos YouTube ;
  • épisodes de podcast ;
  • sources orientées podcast et RSS ;
  • URL audio directes MP3, WAV, M4A et autres formats courants ;
  • URL vidéo MP4 et formats courants ;
  • fichiers privés téléversés (POST /v1/uploads, puis upload_id) ;
  • médias accessibles depuis les pages web prises en charge.

La sortie peut être récupérée en :

  • texte brut (?format=txt) ;
  • JSON avec segments horodatés (?format=json) ;
  • sous-titres SRT (?format=srt) ;
  • sous-titres VTT (?format=vtt).

Exemple de JSON :

{
  "id": "job_9f2c",
  "status": "completed",
  "title": "Entretien de recherche utilisateur",
  "language": "fr",
  "minutes": 31.0,
  "transcript": "Merci d’avoir accepté cet entretien...",
  "segments": [
    {
      "start_seconds": 0.0,
      "text": "Merci d’avoir accepté cet entretien."
    }
  ]
}

La transcription se trouve dans transcript, et un segment ne porte que deux champs : start_seconds et text. Il n’y a pas d’instant de fin — un segment court jusqu’au début du suivant. Cette forme est décrite en détail sur la page API de transcription avec horodatages.

Traitement et suppression des fichiers

Les fichiers téléversés sont traités puis supprimés.

La transcription produite reste accessible via l’API et peut être effacée par le client avec DELETE /v1/transcriptions/{id}.

Une application robuste doit tout de même implémenter son propre cycle de vie :

  • supprimer la transcription chez Techtuel ;
  • supprimer les copies locales de la transcription ;
  • supprimer les chunks et les embeddings ;
  • invalider les index de recherche ;
  • journaliser l’événement de suppression ;
  • appliquer la même politique aux sauvegardes.

Une suppression n’est complète que lorsque toutes les copies dérivées de votre propre système ont disparu.

Hébergement européen ne veut pas dire conformité RGPD automatique

Recourir à une infrastructure européenne simplifie la cartographie des données et l’évaluation des fournisseurs, mais ne suffit pas à rendre chaque traitement conforme.

Il revient à votre organisation de déterminer :

  • la base légale de la transcription ;
  • si les participants doivent être informés ;
  • si un consentement est nécessaire ;
  • combien de temps médias et transcriptions sont conservés ;
  • qui peut y accéder ;
  • si des données sensibles sont concernées ;
  • comment traiter les demandes des personnes concernées ;
  • s’il existe des transferts internationaux ailleurs dans votre stack.

Techtuel doit s’évaluer comme l’un des sous-traitants de l’architecture complète de votre application.

Pour toute conclusion juridique, adressez-vous à votre DPO ou à un conseil qualifié.

Pensé pour les équipes de développement européennes

Techtuel s’adresse aux développeurs qui construisent :

  • des produits de veille média ;
  • des plateformes de podcast ;
  • des outils de recherche journalistique ;
  • des bases de connaissances internes ;
  • des vidéothèques interrogeables ;
  • des workflows d’accessibilité ;
  • des systèmes RAG ;
  • des outils de production de contenu ;
  • des plateformes d’archives et de documentation.

L’API masque le pipeline média propre à chaque source tout en renvoyant une structure prévisible, branchable sur votre base de données ou votre workflow IA.

Manipuler les URL médias privées avec précaution

Une URL média privée ou signée doit :

  • utiliser HTTPS ;
  • expirer rapidement ;
  • n’exposer que l’objet visé ;
  • éviter tout identifiant permanent dans les paramètres de requête ;
  • être générée côté serveur ;
  • être journalisée sans laisser fuiter sa valeur secrète complète.

Exemple de flux côté serveur :

L’utilisateur demande une transcription

Votre backend vérifie ses droits

Votre stockage crée une URL signée à durée courte

Votre backend envoie l’URL à Techtuel

Techtuel traite puis supprime le média

N’exposez jamais votre clé d’API Techtuel dans du code frontend. Une clé est un identifiant au porteur : quiconque la détient peut appeler l’API en votre nom. Authorization: Bearer txl_... n’a sa place que sur votre serveur.

Techtuel comparé à une stack de transcription auto-hébergée

L’auto-hébergement offre un contrôle maximal sur l’infrastructure, au prix de responsabilités opérationnelles.

DomaineTechtuelStack auto-hébergée
Extraction des sources médiasIncluseÀ votre charge
Service des modèlesGéréÀ votre charge
Capacité GPUGéréeÀ provisionner
ScalabilitéGérée par le serviceÀ concevoir
SupervisionResponsabilité partagéeÀ votre charge
Montées de version des modèlesGéréesÀ planifier
Localisation des donnéesFrance / EuropeSelon votre infrastructure
Contrôle des modèles personnalisésLimité aux fonctions du serviceTotal
Effort de maintenancePlus faiblePlus élevé

L’auto-hébergement peut être le bon choix pour une isolation stricte, des modèles sur mesure ou des charges très volumineuses et prévisibles.

Une API européenne managée sera préférable quand l’objectif est de livrer un produit sans exploiter toute la plateforme média et d’inférence.

Les questions à poser à tout fournisseur d’API de transcription

Avant d’envoyer du contenu de production à un service, documentez les réponses à ces questions.

Infrastructure

  • Dans quel pays le média est-il traité ?
  • Où les transcriptions sont-elles stockées ?
  • Quels fournisseurs cloud sont utilisés ?
  • Des hyperscalers américains interviennent-ils ?
  • Des fournisseurs d’inférence ou d’autres sous-traitants sont-ils impliqués ?

Conservation

  • Les fichiers d’origine sont-ils stockés ?
  • Pendant combien de temps ?
  • Les fichiers temporaires sont-ils supprimés automatiquement ?
  • Le client peut-il supprimer ses transcriptions ?
  • Comment les sauvegardes sont-elles gérées ?

Sécurité

  • Les données sont-elles chiffrées en transit ?
  • Comment les clés d’API sont-elles stockées ?
  • Les données des différents clients sont-elles isolées ?
  • Les accès sont-ils journalisés ?
  • Les URL privées ou signées sont-elles prises en charge de façon sûre ?

Conditions juridiques et contractuelles

  • Un accord de sous-traitance est-il disponible ?
  • La liste des sous-traitants ultérieurs est-elle publiée ?
  • Les lieux de traitement sont-ils documentés ?
  • Les incidents de sécurité sont-ils couverts contractuellement ?
  • Le fournisseur réutilise-t-il les données clients pour entraîner ses modèles ?

Ces questions valent que le fournisseur soit européen ou américain.

Questions fréquentes

Où Techtuel est-il hébergé ?

Le traitement des médias s’exécute sur OVHcloud à Gravelines, en France, avec des secrets hébergés chez Scaleway.

Techtuel utilise-t-il AWS, Azure ou Google Cloud ?

Non. La chaîne de transcription ne dépend ni d’AWS, ni de Microsoft Azure, ni de Google Cloud.

Les fichiers téléversés sont-ils conservés ?

Les fichiers téléversés sont traités puis supprimés. La transcription produite reste disponible via l’API jusqu’à ce que vous la supprimiez.

L’hébergement européen garantit-il la conformité RGPD ?

Non. La localisation de l’infrastructure n’est qu’un élément de la conformité. Votre cas d’usage, votre base légale, votre politique de conservation, vos contrôles de sécurité, vos contrats et le reste de votre chaîne de sous-traitance doivent aussi être évalués.

Peut-on envoyer une URL signée ?

Oui, en source_url ou audio_url. Utilisez des URL signées à durée courte et à privilèges minimaux, et vérifiez les limites en vigueur dans la documentation de l’API.

L’API renvoie-t-elle des horodatages ?

Oui, des instants de départ. Chaque segment JSON porte start_seconds et text, sans champ de fin ; les sorties SRT et VTT sont disponibles via ?format=.

Peut-on utiliser Techtuel pour du RAG ?

Oui. Stockez les segments de transcription avec leur URL source et leurs instants de départ, créez vos chunks et vos embeddings, puis indexez-les dans votre moteur de recherche.

Gardez votre pipeline de transcription en Europe

Une seule API pour transformer vos sources audio, vidéo, YouTube et podcast en texte structuré, sur une infrastructure conçue et hébergée en France.

Lire la documentation de l’API

Essayer sans compte