par Nodical

ASDIC est un projet de recherche 2027-2028. Les mesures publiées sont celles du carnet ; les objectifs sont des objectifs.

Savoir

L'espagnol au téléphone : accents, vitesse et « ¿diga? »

Publié le Par Douglas DemartÉtat du projet au 1er octobre 2026

En une phrase

Un agent vocal qui appelle en espagnol doit comprendre « ¿Diga? », « ¿Bueno? » et « ¿Aló? », un accent de Madrid, des Canaries ou de Buenos Aires et un débit rapide, alors que les classements publics n'évaluent que de l'espagnol lu, jamais au téléphone ; et comme les premiers appels espagnols de Nodical n'ont pas encore eu lieu, ASDIC ne publie encore aucun chiffre en espagnol.

La première seconde change déjà d'un pays à l'autre

En France, on décroche avec « Allô ? ». En Espagne, avec « ¿Diga? », « ¿Dígame? » (« dites », « dites-moi ») ou un simple « ¿Sí? ». Le dictionnaire de l'Académie royale espagnole (RAE) note que « diga » et « dígame » s'emploient « quand on répond au téléphone », signale « ¿bueno? » comme mexicain et « aló » comme américain, avec un détail amusant : le mot vient du français allô. Des mots différents, avec la même forme : un mot court, une question, puis le silence. C'est ce qui distingue une personne d'un répondeur, qui parle longtemps sans attendre de réponse.

Le problème, pour une machine, c'est ce que le mot veut dire dans chaque pays. « Bueno » veut aussi dire « d'accord » : un « ¿Bueno? » au décroché au Mexique n'est pas un oui. Et au Mexique, d'après le Catálogo de voces hispánicas de l'Instituto Cervantes, « ¿mande? » signifie « pardon ? » : une demande de répéter, pas une réponse.

Une langue, beaucoup d'accents

Environ 520 millions de personnes ont l'espagnol pour langue maternelle, selon l'Instituto Cervantes (2025), et elles ne le prononcent pas de la même façon. Le Catálogo de voces hispánicas décrit les différences ville par ville ; certaines tombent précisément là où une machine les remarque :

  • Madrid distingue le s du z (« casa », la maison, et « caza », la chasse, ne sonnent pas pareil) et tend à aspirer le s en fin de syllabe.
  • Las Palmas de Gran Canaria les prononce de la même façon (le seseo), aspire ou perd le s final (« mesas », les tables, sonne presque « mesah ») et a une intonation qui a des points communs avec celle des Caraïbes.
  • Buenos Aires pratique aussi le seseo, tend à aspirer le s final et tutoie avec « vos » (« vos tenés »).
  • Mexico pratique le seseo, mais garde les s finaux tendus et longs et affaiblit les voyelles non accentuées (« antes » sonne presque « ants »).

Le s final est si parlant que le Linguistic Data Consortium s'en est servi pour séparer les locuteurs « caribéens » et « non caribéens » de ses corpus téléphoniques espagnols. Et il porte souvent le pluriel : « las mesas » contre « la mesa ». Réduit à un souffle et passé par une ligne étroite (voir la page sur l'audio 8 kHz), nous pensons qu'il s'entend encore moins bien ; c'est une hypothèse que nous n'avons pas encore mesurée.

La vitesse : plus de syllabes, pas plus d'information

Une étude du CNRS et de l'université Lyon 2 (Science Advances, 2019) a comparé 17 langues, dont l'espagnol et le français, à partir de 15 textes courts lus par 10 locuteurs natifs par langue. L'espagnol y est cité comme l'exemple d'une langue parlée vite, avec peu d'information par syllabe ; au bout du compte, toutes les langues étudiées transmettent environ 39 bits d'information par seconde. Parler vite, ce n'est pas en dire plus.

Pour une machine, en revanche, quelque chose change : plus de syllabes à découper dans le même temps, dans un son déjà étroit, et la décision de fin de tour à prendre sur un débit plus rapide. Mais l'étude mesure des textes lus : nous ne connaissons aucune mesure publiée du débit de l'espagnol au téléphone.

Ce que les classements publics évaluent en espagnol

Le classement public le plus utilisé en reconnaissance vocale, l'Open ASR Leaderboard, évalue l'espagnol dans sa piste multilingue. L'article qui le présente (octobre 2025) cite CoVoST-2 (des phrases lues), FLEURS (des phrases de Wikipédia lues, en 102 langues) et MLS (des livres audio de LibriVox) ; son jeu de données actuel, mis à jour en juillet 2026, contient pour l'espagnol FLEURS, Common Voice et MLS. Toujours de la parole lue, en large bande.

Sur ce terrain, l'espagnol s'en sort bien : dans le tableau multilingue de l'article, cinq modèles (Canary, Whisper, Phi-4, Parakeet et Voxtral) se trompent en moyenne sur 3,2 à 3,8 % des mots en espagnol, et pour chacun d'eux c'est, des cinq langues évaluées, celle où il se trompe le moins. Bonne nouvelle pour l'espagnol lu. Cela ne dit rien de l'espagnol au téléphone.

Ce qu'ils n'évaluent pas : le téléphone

Le classement n'a pas de piste téléphone, dans aucune langue, et les jeux privés ajoutés en mai 2026 sont en anglais seulement. Pourtant, contrairement au français, l'espagnol a bien de l'audio téléphonique de recherche, distribué par le LDC : CALLHOME Spanish (environ 38 heures, 120 conversations à 8 kHz, surtout avec de la famille ou des amis), Fisher Spanish (environ 163 heures, 819 conversations de 10 à 12 minutes entre 136 locuteurs caribéens et non caribéens) et deux CALLFRIEND de 60 conversations chacun.

Ce sont des corpus sérieux, mais aucun ne ressemble à un appel commercial de dix secondes : ce sont de longues conversations, enregistrées depuis l'Amérique (États-Unis, Canada, Porto Rico, République dominicaine), publiées entre 1996 et 2010, et aucun classement public ne les utilise. Le banc d'essai eot-bench de LiveKit compte l'espagnol parmi ses 14 langues de conversations réelles entre une personne et un agent, mais ne dit rien de la téléphonie. En français, la situation est pire encore, comme nous le racontons dans la page sur le corpus d'appels en français.

Où en est ASDIC en espagnol

En espagnol, ASDIC n'a aucun chiffre : les premiers appels espagnols de Nodical n'ont pas encore eu lieu. Les mesures publiées dans le carnet ont été faites sur des appels en français, et nous ne les transposons pas. Quand les premières campagnes en espagnol démarreront, nous mesurerons la même chose qu'en français (répondeur, fin de tour, coupures, transferts, durée), par pays et par accent, sur du son 8 kHz tel qu'il arrive sur la ligne. Les objectifs du programme valent pour le français, l'espagnol et l'anglais ; ils ne sont atteints dans aucune langue et seront publiés avec la mesure qui le prouvera.

Ce que ça change pour une campagne en Espagne

Un agent qui appelle en Espagne ne doit pas sonner comme s'il appelait au Mexique, ni prendre un « ¿Bueno? » pour un oui, ni perdre le pluriel de quelqu'un qui aspire ses s. Nodical explique sur son site comment se déroule une campagne de prospection sortante, de la qualification au transfert à chaud.

Et concrètement ? comment se déroule une campagne de prospection sortante

Sources

consultées le 1er octobre 2026.

  1. RAE-ASALE, Diccionario de la lengua española, « aló » (« interj. Am. U. para responder al teléfono », du français allô) — https://dle.rae.es/al%C3%B3
  2. RAE-ASALE, Diccionario de la lengua española, « bueno » (« interj. Méx. U. para contestar al teléfono ») — https://dle.rae.es/bueno
  3. RAE-ASALE, Diccionario de la lengua española, « decir » (« diga, o dígame : exprs. U. cuando se responde al teléfono ») — https://dle.rae.es/decir
  4. Instituto Cervantes, Catálogo de voces hispánicas, Madrid — https://cvc.cervantes.es/lengua/voces_hispanicas/espana/madrid.htm
  5. Instituto Cervantes, Catálogo de voces hispánicas, Las Palmas de Gran Canaria — https://cvc.cervantes.es/lengua/voces_hispanicas/espana/las_palmas.htm
  6. Instituto Cervantes, Catálogo de voces hispánicas, Buenos Aires — https://cvc.cervantes.es/lengua/voces_hispanicas/argentina/buenosaires.htm
  7. Instituto Cervantes, Catálogo de voces hispánicas, Ciudad de México — https://cvc.cervantes.es/lengua/voces_hispanicas/mexico/mexicodf.htm
  8. Instituto Cervantes, « El español: lengua para el mundo 2025 », 20 claves (520 millions de locuteurs natifs) — https://cvc.cervantes.es/lengua/anuario/anuario_25/elm/p01.htm
  9. CNRS, « Similar information rates across languages, despite divergent speech rates » (communiqué, septembre 2019) — https://www.cnrs.fr/en/press/similar-information-rates-across-languages-despite-divergent-speech-rates
  10. Coupé, Oh, Dediu, Pellegrino, « Different languages, similar encoding efficiency », Science Advances, 4 septembre 2019 — https://doi.org/10.1126/sciadv.aaw2594
  11. arXiv 2510.06961, « Open ASR Leaderboard » (tableau 1 : jeux de données ; tableau 4 : erreurs par langue) — https://arxiv.org/html/2510.06961v1
  12. Open ASR Leaderboard, dépôt GitHub (jeux multilingues actuels : FLEURS, Common Voice, MLS) — https://github.com/huggingface/open_asr_leaderboard
  13. Hugging Face, « Open ASR Leaderboard: private data » (6 mai 2026, jeux privés en anglais seulement) — https://huggingface.co/blog/open-asr-leaderboard-private-data
  14. arXiv 2205.12446, « FLEURS: Few-shot Learning Evaluation of Universal Representations of Speech » — https://arxiv.org/abs/2205.12446
  15. arXiv 2012.03411, « MLS: A Large-Scale Multilingual Dataset for Speech Research » — https://arxiv.org/abs/2012.03411
  16. LDC, CALLHOME Spanish Speech (LDC96S35) — https://catalog.ldc.upenn.edu/LDC96S35
  17. LDC, Fisher Spanish Speech (LDC2010S01) — https://catalog.ldc.upenn.edu/LDC2010S01
  18. LDC, CALLFRIEND Spanish-Caribbean Dialect (LDC96S57) — https://catalog.ldc.upenn.edu/LDC96S57
  19. LDC, CALLFRIEND Spanish-Non-Caribbean Dialect (LDC96S58) — https://catalog.ldc.upenn.edu/LDC96S58
  20. LiveKit, eot-bench (14 langues, dont l'espagnol) — https://github.com/livekit/eot-bench
  21. ASDIC, carnet n° 1 : « Septembre 2026 : première mesure » — https://asdic.ai/carnet/2026-09-premiere-mesure

Corrections

Aucune correction à ce jour.