Saltar al contenido
Xavi Creus

IA

Inferencia

La inferencia es el momento en que un modelo de IA ya entrenado se usa para producir una respuesta o predicción; es lo que pagas cada vez que lo consultas.

Definición

La inferencia es la fase en la que un modelo de IA ya entrenado recibe una entrada, como una pregunta, una imagen o una transacción, y produce una salida: una respuesta, una etiqueta, una predicción. Si el entrenamiento es aprender, la inferencia es trabajar. Cada vez que escribes en un asistente de IA o que un sistema antifraude evalúa un pago, se ejecuta una inferencia. Es la operación que consume recursos en el día a día.

En la empresa, la inferencia es el coste variable de la IA. Los proveedores la cobran por tokens procesados o por llamadas, y su precio se ha reducido de forma drástica año tras año. Por eso conviene distinguir dos decisiones: qué modelo usar, que fija el coste y la calidad por inferencia, y cuántas inferencias hacer, que depende del diseño del proceso. Un buen diseño hace menos llamadas, más cortas y con el modelo más pequeño que resuelva la tarea.

Hoy hay mercado para la inferencia: los mismos modelos abiertos se pueden ejecutar en varios proveedores, en la propia nube de la empresa o incluso en el portátil, con precios y velocidades muy distintos. El malentendido habitual es pensar que la IA es cara por el entrenamiento. Para casi todas las empresas, el entrenamiento lo paga otro; lo que ellas pagan es inferencia. Y la inferencia es hoy una de las partidas tecnológicas que más rápido se abaratan.

En la práctica

Una empresa de atención al cliente ejecuta 2 millones de inferencias al mes para clasificar y responder correos. Al enrutar los casos sencillos a un modelo pequeño y reservar el grande para los complejos, mantiene la calidad y reduce la factura de inferencia a una fracción.

Por qué importa

La inferencia es la línea de tu cuenta de resultados donde vive la IA. Su precio baja cada año, así que un proceso que hoy no compensa puede compensar dentro de doce meses. Conviene revisarlo con la misma frecuencia que otros costes de proveedor.

Preguntas frecuentes

¿Qué diferencia hay entre entrenamiento e inferencia en IA?
El entrenamiento es el proceso, largo y caro, en el que el modelo aprende a partir de grandes cantidades de datos. La inferencia es el uso posterior de ese modelo para responder a cada petición, rápido y barato por unidad. Las empresas casi siempre pagan inferencia y muy raramente entrenamiento.
¿Cuánto cuesta la inferencia de un modelo de IA?
Se cobra por millón de tokens y varía órdenes de magnitud entre un modelo pequeño y uno de primera línea. Para la mayoría de tareas de empresa, el coste por operación es de céntimos o fracciones de céntimo. Lo que decide la factura es el volumen y el diseño del proceso, no el precio unitario.

¿Necesitas que te lo explique para tu empresa?

Una hora conmigo suele bastar para convertir el vocabulario en una decisión.

Reservar una sesión