API de reconnaissance et de synthèse vocales

L’IA vocale qui comprend et parle le suisse allemand.

Transcrivez le Züritüütsch, le Bärndütsch et tous les autres dialectes en un texte propre, rédigé en allemand standard, et répondez en vrai dialecte, pas avec un accent. Une seule API pour le temps réel et le batch, conçue pour les voicebots, les centres d’appels et l’analyse des appels.

Sans carte de crédit. Ensuite, facturation à la seconde.

POST /v1/tts
curl -X POST https://api.suisse-speech.ch/v1/tts \
  -H "X-API-Key: $SUISSE_SPEECH_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text": "Grüezi, schön sind Sie da.",
       "voice": "anna", "language": "de-CH", "dialect": "zurich"}' \
  --output greeting.mp3
< 1 sjusqu’au premier son en synthèse temps réel
250 msentre deux mises à jour de la transcription en direct
5 + 14dialectes suisses allemands: 5 affinés à la main, 14 autres régions
12voix, chacune parle toutes les langues

Dans les deux sens, une seule API

La même clé, les mêmes codes de langue et le même format d’erreur pour écouter et pour parler.

Reconnaissance vocale

Du suisse allemand parlé en entrée, du texte en allemand standard en sortie, avec l’horodatage et l’indice de confiance de chaque mot. Transmettez l’audio en direct ou envoyez des enregistrements complets.

  • Transcription en direct via WebSocket, actualisée toutes les 250 ms
  • Détection à la volée de l’allemand, du français, de l’italien et de l’anglais
  • Votre propre vocabulaire: noms, produits, lieux
  • Longs enregistrements sous forme de tâches, jusqu’à 200 Mo

En savoir plus →

Synthèse vocale

Écrivez en allemand standard et écoutez un vrai dialecte, avec ses propres mots, sa grammaire et sa sonorité. Douze voix, de la qualité téléphonique à la qualité studio.

  • Zurichois, bernois, bâlois et lucernois, affinés à la main
  • Streaming en temps réel pour les voicebots, modèle studio pour l’audio préparé à l’avance
  • Nombres, dates et montants en CHF correctement prononcés, à la suisse
  • Prêt pour la téléphonie: G.711 µ-law et A-law à 8 kHz

En savoir plus →

Pourquoi les équipes choisissent Suisse Speech

Un vrai dialecte, pas un accent

En suisse allemand, la synthèse utilise le vocabulaire et la grammaire du dialecte. Ce n’est pas de l’allemand standard lu avec un accent suisse.

Les spécificités suisses maîtrisées

Numéros de téléphone groupés à la suisse, selon le dialecte. Dates, heures et montants en CHF sous leur forme orale.

Une conversation, quatre langues

La reconnaissance détecte l’allemand, le français, l’italien ou l’anglais. La synthèse répond avec le même code de langue.

Vos données audio ne sont pas stockées

L’audio, les textes et les transcriptions sont traités en mémoire. Nous ne conservons que des métadonnées sans contenu, pour la facturation.

Une sandbox gratuite pour vos tests

Les clés sandbox renvoient de l’audio et des transcriptions de test réalistes, jamais facturés. Conçues pour l’intégration continue.

Transparence sur les limites

Chaque refus en indique la raison: votre débit de requêtes, votre offre, votre crédit ou notre capacité. Rien n’est mis en file d’attente à votre insu.

Conçu pour les produits vocaux suisses

Voicebots et centres d’appels

Écoutez avec la transcription en temps réel, répondez avec la voix en temps réel. L’appelant entend la réponse dans sa langue et, si vous le souhaitez, dans son dialecte.

Transcription et analyse des appels

Transformez les appels enregistrés en texte consultable en allemand standard, horodaté mot par mot, grâce à une tâche batch nettement plus rapide que le temps réel.

Messages de serveur vocal et annonces

Produisez vos messages vocaux et d’accueil ainsi que vos annonces en qualité studio, dans le dialecte de votre région. Les numéros de téléphone sont lus à la suisse.

Médias, e-learning et accessibilité

Voix off pour vos contenus en suisse allemand, en français et en italien, et transcription du suisse allemand parlé pour les sous-titres et les archives.

Payez à la seconde, commencez avec une heure

Reconnaissance vocale dès CHF 1.35 par heure d’audio, synthèse vocale dès CHF 4.60. Sans abonnement ni minimum par requête.

Questions fréquentes

L’API peut-elle transcrire le dialecte suisse allemand?

Oui. Le suisse allemand de toutes les régions est transcrit. Comme le suisse allemand n’a pas d’orthographe standard, la transcription est rédigée en allemand standard, la forme que la recherche, l’analyse et les modèles de langage traitent le mieux.

La synthèse parle-t-elle un vrai dialecte ou de l’allemand standard avec un accent?

Un vrai dialecte. Pour le suisse allemand, le texte est transposé dans le dialecte: son vocabulaire, sa grammaire et sa prononciation. Le zurichois, le bernois, le bâlois et le lucernois sont affinés à la main. 14 autres régions sont disponibles, sans garantie de qualité.

Quelles langues sont prises en charge?

En priorité le suisse allemand, le haut allemand suisse, le français de Suisse et l’italien de Suisse. L’allemand, le français, l’italien et l’anglais avec leurs variantes régionales, et environ 90 variantes linguistiques au total.

Comment l’utilisation est-elle facturée?

À la seconde d’audio, sans minimum par requête. Le temps réel (streaming) et le batch ont des tarifs distincts, indiqués sur la page des tarifs. Vous rechargez un crédit prépayé, et chaque nouveau compte démarre avec 60 minutes gratuites.

Stockez-vous mes données audio ou mes transcriptions?

Non. L’audio, les textes et les transcriptions sont traités en mémoire et ne sont pas stockés. Les résultats des tâches batch ne sont conservés que jusqu’à ce que vous les récupériez, 48 heures au plus.

Faites l’essai avec vos propres enregistrements

Obtenez 60 minutes gratuites de reconnaissance et de synthèse vocales. Aucune carte de crédit requise.