de Nodical
Investigación · 2027-2028

ASDIC. El modelo que escucha para reconocer.

Por teléfono todo se decide en segundos. Los modelos del mercado se diseñaron para habla leída, en inglés. Construimos el nuestro, para la conversación telefónica, en francés, español e inglés, entrenado y alojado en Europa.

En desarrollo · proyecto de investigación 2027-2028

Impulso enviadoEco: una personaEco: contestador o ruido
Hoy
Objetivo
  1. T+0,0 sdescolgado
    T+0,0 sdescolgado
  2. T+0,4 s«¿Diga?»
    T+0,4 s«¿Diga?»
  3. T+8 scontestador reconocido (mediana en nuestras campañas)
    T+2 scontestador reconocido, menos del 3 % de error
  4. T+1,3 stiempo de respuesta, 9 de cada 10 veces
    T+0,5 stiempo de respuesta, sin interrumpir
  5. T+135 stransferencia a un asesor (mediana)
    momento justotransferencia con un resumen de dos líneas

Los valores «hoy» se midieron en nuestras llamadas de septiembre de 2026. Los objetivos son objetivos: se publicarán con las mediciones, no antes.

El problema

La mitad de las llamadas contestadas duran diez segundos o menos.

Los modelos de reconocimiento del habla aprendieron con habla leída, en banda ancha, sobre todo en inglés. Por teléfono el sonido es estrecho, la gente se interrumpe y hay que decidir en menos de un segundo. Cada segundo de comprensión perdido cuesta un contacto.

60 287llamadas contestadas por una persona, septiembre de 2026
10 sduración mediana de una llamada contestada
8 de 10llamadas de menos de veinte segundos
8 shasta que hoy se reconoce un contestador

Leído en la base de producción de Nodical, 14 campañas, sin leer el contenido de las conversaciones.

Qué hace

Cinco decisiones, durante la llamada.

  1. desde que descuelgan

    Persona o contestador

    ASDIC dice con quién habla el agente, con un índice de confianza. Hoy la decisión llega a los ocho segundos (mediana). El objetivo: menos de dos segundos.

  2. mientras habla

    Qué quiere la persona

    Interesada, no interesada, volver a llamar, número equivocado, pide una persona, no quiere que la contacten más: la intención se reconoce en directo, junto con las respuestas a las preguntas de elegibilidad. Contrastadas con las ventas que el cliente cerró realmente, estas señales afinan la probabilidad de cierre de cada contacto: su equipo sabe en quién centrarse.

  3. en cada turno

    Cuándo ha terminado de hablar

    Ni interrumpir ni dejar un silencio. Esperar el silencio no basta: es el punto débil de todos los agentes de voz y el centro de nuestro trabajo.

  4. en el momento justo

    La transferencia a una persona

    Cuando un asesor debe tomar el relevo, ASDIC lo dice, con un resumen de dos líneas para que nadie llegue en frío.

  5. en todas partes

    Tres idiomas

    Francés, español, inglés: el mismo modelo, el mismo rendimiento, sin reconstruir un modelo por idioma.

Punto de partida

Lo que medimos y lo que buscamos.

RetoHoy (medido)Objetivo
Persona o contestadordecisión a los 8 s (mediana), 14 s en 9 de cada 10 llamadasmenos de 2 s, menos del 3 % de error
Tiempo de respuesta0,14 s de mediana, 1,32 s 9 de cada 10 veces, sin contar la detección del fin del hablamenos de 0,5 s, interrumpiendo menos del 5 % de las veces
Transferencia1,19 % de las llamadas contestadas, a los 135 s (mediana)más de 9 de cada 10 transferencias consideradas pertinentes
Intención y elegibilidadsin medición sin corpus anotadose fijará tras la referencia
Probabilidad de cierrecalculada en Nodical desde octubre de 2026 con el resultado y la duración de la llamada, a partir de las ventas de cada cliente; aún sin medición publicadaordenar mejor quién firma, gracias a las señales de la conversación; objetivo fijado tras un piloto de un mes
Soberanía0 % de modelo propio100 % para el modelo de comprensión

Objetivos propuestos a partir de las mediciones de septiembre de 2026 y del estado del arte; se validarán con el equipo contratado.

El nombre

Por qué ASDIC.

19172027Europa
1917

La primera máquina que escuchaba para reconocer

El ASDIC es el antepasado del sonar, desarrollado durante la Primera Guerra Mundial con la aportación decisiva del físico francés Paul Langevin. Emite un sonido, escucha el eco y decide en segundos si oye un objetivo real o solo ruido.

2027

El mismo trabajo, sobre una conversación

Nuestro modelo hace lo mismo por teléfono: escucha, distingue de inmediato a una persona de un contestador, detecta una intención real en medio de la conversación y avisa en el momento justo.

Europa

Una tecnología que es nuestra

El modelo, sus pesos y su corpus pertenecen a Nodical. Se entrena en la capacidad de cálculo europea y se aloja en la Unión Europea. Ningún proveedor único puede apagarlo.

Lo que existe

Lo que dicen las mediciones publicadas.

×5 a ×6

El modelo abierto de referencia en reconocimiento del habla se equivoca en el 2,7 % de las palabras en lectura, pero en el 13,8 a 17,6 % en conversación telefónica.

OpenAI, artículo de Whisper (tabla 8)
≈ 4 s

El tiempo medio que anuncia el detector de contestador de Twilio con sus ajustes por defecto, «cercano al 100 %» de acierto en Estados Unidos, menor a nivel internacional. Ninguna cifra publicada para los buzones españoles o franceses.

Twilio, documentación AMD (FAQ)
55,6 %

Las veces que se interrumpe a alguien por error al responder tras 300 ms de silencio. Para bajar al 5 % hay que esperar 1,6 segundos.

LiveKit, banco de pruebas eot-bench

No existe ninguna medición de referencia pública para el teléfono en francés. Construir ese corpus forma parte de la investigación.

Programa

Veinticuatro meses, seis etapas.

  1. Meses 1 a 8

    Datos

    Un corpus de llamadas seudonimizadas, anotado en francés y después en español e inglés. No existe ninguno en acceso abierto para el teléfono en francés.

  2. Meses 2 a 4

    Referencia

    Los modelos del mercado medidos en este corpus: el punto de partida en cifras.

  3. Meses 4 a 14

    Modelo francés

    Diseño y entrenamiento de las cuatro primeras funciones.

  4. Meses 12 a 20

    Multilingüe

    Español e inglés, acentos incluidos.

  5. Meses 10 a 22

    Tiempo real

    Integración en Nodical y pruebas en condiciones reales, en campañas de verdad.

  6. Meses 20 a 24

    Evaluación

    Las mediciones finales, publicadas; la protección del modelo; el despliegue.

Con el apoyo de un laboratorio público de la región de París especializado en tratamiento del habla, en fase de selección. Entrenamiento en la capacidad de cálculo europea.

Qué no hace

Tres líneas que no cruzaremos.

Ninguna voz imitada

ASDIC escucha y entiende. Nunca produce una voz ni aprende a imitarla.

Ninguna decisión sobre la persona

Ayuda al agente a llevar la conversación, y al equipo del cliente a elegir el orden de sus devoluciones de llamada. No toma ninguna decisión que se imponga a la persona llamada, que nunca ve su resultado.

Ningún dato de contacto en los datos

Las llamadas usadas para el entrenamiento se seudonimizan: nombres, números y direcciones se retiran antes de cualquier anotación. Cualquiera puede oponerse con un simple correo.

Para quién

Primero Nodical. Después, cualquier software que deba entender una llamada.

Dentro de Nodical

Los oídos y el criterio del agente

ASDIC sustituye la parte «escuchar y juzgar» de los agentes de voz de Nodical. La voz sigue produciéndose por síntesis de voz.

Como API

Para otros programas

Recepción telefónica, sanidad, servicios públicos, emergencias: cualquier sistema que reciba o haga llamadas en francés, español o inglés.

En Europa

Sin depender de un proveedor

Un modelo alojado en la Unión Europea, con sus pesos y su corpus, para las organizaciones que no pueden enviar sus conversaciones a otro sitio.

Equipo

Buscamos dos ingenieros/as de IA de habla y lenguaje.

El proyecto lo dirige Douglas Demart, presidente de Nodical. Dos ingenieros/as se incorporan al equipo en París: la primera persona en enero de 2027 (modelo francés), la segunda en 2027 (multilingüe y tiempo real). Corpus real de más de 60 000 llamadas al mes, cálculo europeo, laboratorio asociado, posibilidad de publicar.

  1. Enero de 2027 · París

    Ingeniero/a de IA — habla y lenguaje

  2. 2027 · París

    Ingeniero/a de IA — multilingüe y tiempo real

Escribir para candidatarse

¿Tiene llamadas en francés, español o inglés y quiere seguir el proyecto, o contribuir a él?

Basta un correo. Respondemos nosotros mismos y no publicamos nada que no se haya medido.