Herramientas · Agentforce

Cómo controlar el consumo, coste y calidad de Agentforce en producción

portada agentforce 1600

Tema

Control del consumo, coste y calidad de Agentforce en producción

Enfoque

Consumo, coste, calidad y resultado de negocio

Tipo de lectura

Guía práctica

Cuando un agente de Agentforce pasa del piloto a producción, la pregunta deja de ser únicamente “¿funciona?”. Empiezan a importar otras cuestiones: cuánto se utiliza, cuánto consume, dónde falla y, sobre todo, si el valor que genera justifica su coste.

Por eso, controlar Agentforce no debería limitarse a revisar los Flex Credits disponibles. Para tomar buenas decisiones hay que relacionar cuatro dimensiones: consumo, coste, calidad y resultado de negocio.

Un agente barato que resuelve mal no es eficiente. Y uno con mayor consumo puede estar perfectamente justificado si evita trabajo manual, mejora el servicio o permite asumir un mayor volumen de actividad.

Medir antes de escalar

Un piloto demuestra que el agente puede funcionar. Producción debe demostrar cuánto consume, dónde falla y qué resultado empresarial justifica ese consumo.

Del piloto a producción: el verdadero reto

Los pilotos se desarrollan en escenarios relativamente controlados. En producción aparecen excepciones, usuarios reales, integraciones, datos incompletos y conversaciones que no siempre siguen el camino previsto.

También cambia la escala. Un pequeño error puede pasar desapercibido durante una prueba, pero convertirse en un problema cuando se repite cientos de veces.

Por eso, una vez desplegado un agente, conviene hacer un seguimiento continuo de su uso, de su coste, de la calidad con la que resuelve y del valor de negocio que genera. La clave está en analizar estas variables conjuntamente.

Interacción ≠ consumo

Dos conversaciones similares pueden requerir un número muy diferente de acciones. Para comprender el coste hay que analizar qué ejecuta realmente el agente.

Cómo controlar el consumo de Agentforce

Una conversación no equivale necesariamente a un consumo determinado.

En el modelo actual de Flex Credits, las acciones que ejecuta Agentforce generan consumo. Para las acciones estándar o personalizadas de Agentforce basado en texto, Salesforce establece actualmente 20 Flex Credits por acción ejecutada.

Esto significa que dos conversaciones pueden consumir cantidades muy diferentes. Una consulta sencilla puede requerir recuperar un dato, mientras que otra puede consultar varios registros, ejecutar un flujo y actualizar información en Salesforce.

Digital Wallet

Salesforce permite supervisar el consumo mediante Digital Wallet, donde es posible consultar la evolución del uso y configurar alertas cuando se alcanzan determinados umbrales.

En producción conviene controlar, como mínimo:

  • consumo acumulado;
  • evolución del consumo;
  • desviaciones respecto a lo previsto;
  • cambios después de introducir un nuevo agente o caso de uso.

Para análisis más detallados, Salesforce dispone además del AI Agent Generative AI Usage Data Model, que permite relacionar eventos de consumo con agentes, sesiones, interacciones o herramientas utilizadas.

El objetivo es identificar qué agentes o procesos concentran el consumo y entender por qué se produce.

Coste por resultado

El gasto mensual aislado dice poco. Es más útil conocer cuánto cuesta cada resolución o proceso completado correctamente.

Del consumo al coste real

Conocer los créditos utilizados es solo una parte de la ecuación.

Salesforce dispone actualmente de diferentes modalidades comerciales, por lo que el coste exacto debe calcularse siempre teniendo en cuenta las condiciones contratadas por cada empresa.

Desde un punto de vista empresarial, una métrica mucho más útil es el coste por resultado satisfactorio:

Coste atribuible al agente ÷ número de procesos resueltos correctamente

También puede analizarse:

  • coste por interacción;
  • coste por resolución;
  • coste por proceso completado;
  • coste frente al proceso manual anterior.

Además, los Flex Credits no tienen por qué representar todo el coste operativo. Dependiendo del caso de uso pueden existir componentes relacionados con datos, integraciones, canales o mantenimiento.

Por eso es importante contar con una referencia previa: cuánto tiempo y recursos requería este proceso antes de introducir el agente.

Solo comparando ambos escenarios puede empezar a medirse su verdadero impacto.

RESPONDER ≠ RESOLVER

Que un agente responda o ejecute correctamente una acción no significa que haya resuelto la necesidad del usuario. La resolución, los errores y los escalados ayudan a medir su calidad real.

Calidad: responder no significa resolver

Un agente puede ejecutar correctamente sus acciones y, sin embargo, no resolver realmente la necesidad del usuario.

Aquí es donde adquiere especial importancia Agentforce Observability.

Salesforce permite analizar información relacionada con sesiones, interacciones, acciones ejecutadas, errores, latencia, escalados y diferentes métricas de calidad.

Esta trazabilidad ayuda a entender qué ha ocurrido durante una conversación y a identificar dónde se producen los problemas.

Task Resolution

Una de las métricas especialmente útiles es Task Resolution, que evalúa si una tarea ha quedado:

  • totalmente resuelta;
  • parcialmente resuelta;
  • no resuelta.

Esta diferencia es importante porque una ejecución técnicamente correcta no significa necesariamente que el usuario haya conseguido su objetivo.

Por otro lado, Testing Center permite probar y validar el comportamiento de los agentes antes de introducir cambios en producción.

La lógica debería ser sencilla: probar, desplegar, observar y optimizar.

Qué KPIs conviene controlar

No hace falta medir decenas de indicadores. Para empezar, puede utilizarse un modelo sencillo con tres niveles.

Modelo de KPIs: uso, eficiencia, calidad y negocio

Técnico ≠ negocio

Un agente puede funcionar sin errores y aun así no aportar suficiente valor. Calidad técnica y resultado empresarial deben medirse conjuntamente.

Métricas técnicas

Permiten saber si la solución funciona correctamente:

errores · latencia · acciones · sesiones

Métricas del agente

Ayudan a evaluar si está haciendo correctamente su trabajo:

resolución · escalados · abandonos · calidad

Métricas de negocio

Son las que permiten valorar si la inversión merece la pena. Por ejemplo:

coste por resolución · tiempo manual evitado · productividad · impacto comercial o de servicio

Estas últimas métricas deben definirse según cada empresa y combinar los datos de Agentforce con información operativa o financiera.

Una forma sencilla de estructurar el seguimiento sería:

DimensiónQué medir
UsoSesiones, usuarios, volumen
EficienciaFlex Credits, coste, tiempo
CalidadResolución, errores, escalados
NegocioCoste por resultado, productividad, tiempo evitado

Lo importante no es observar cada columna de forma aislada, sino entender la relación entre ellas.

DEL CONSUMO AL RESULTADO

El consumo aislado dice poco. Hay que cruzarlo con resoluciones, escalados, coste y tiempo ahorrado para saber si el agente realmente está generando valor.

Un ejemplo sencillo

Imaginemos una empresa B2B que utiliza Agentforce para atender consultas relacionadas con pedidos. Durante un mes registra, a modo de ejemplo hipotético:

  • 2.000 sesiones;
  • 1.300 consultas resueltas correctamente;
  • 400 escalados a una persona;
  • 300 consultas no resueltas.

Saber cuántos créditos ha consumido es útil, pero no suficiente. La empresa debería calcular cuánto le cuesta cada consulta resuelta correctamente y relacionar después ese coste con el resultado obtenido: el trabajo manual que evita, la mejora en los tiempos de respuesta y el volumen adicional que puede atender con los mismos recursos.

Ese análisis permite decidir si el consumo está justificado o si existen procesos que deben optimizarse.

¿Quieres ver cómo hemos hecho este cálculo?

Este ejemplo está simplificado. En Konozca cruzamos consumo, coste, resolución, escalados y tiempo ahorrado para saber si un agente está generando realmente valor.

GOBIERNO CONTINUO

Un agente en producción debe gestionarse como un producto vivo: medir, analizar, optimizar y decidir cuándo tiene sentido escalar.

Conclusión: Agentforce necesita gobierno continuo

Un agente en producción debería gestionarse como un producto digital vivo, no como una automatización que se configura una vez y se olvida.

Conviene definir:

  1. Qué significa éxito para ese caso de uso.
  2. Qué KPIs se van a controlar.
  3. Quién es responsable del agente y del presupuesto.
  4. Con qué frecuencia se revisará su rendimiento.
  5. Qué desviaciones requieren actuar.
  6. Cuándo tiene sentido optimizar o escalar.
Ciclo de gobierno continuo: Medir, Analizar, Optimizar, Validar, Escalar

El objetivo no es reducir el consumo a cualquier precio. Un agente que consume poco pero no resuelve correctamente aporta poco valor. En cambio, un mayor consumo puede estar justificado si permite automatizar procesos relevantes, aumentar capacidad o mejorar el servicio.

Por eso, más allá del volumen de Flex Credits consumidos, la pregunta final debería ser:

¿Qué valor estamos obteniendo por ese consumo?

En Konozca te ayudamos a definir un modelo de seguimiento que conecte consumo, coste, calidad y resultados de negocio, para detectar qué optimizar y cuándo tiene sentido escalar.

Preguntas frecuentes

Porque el consumo no depende del número de interacciones, sino de los pasos que el agente necesita ejecutar en cada conversación: búsquedas, acciones, llamadas a otros sistemas o reintentos. Por eso conviene analizar el consumo por caso de uso y no quedarse solo en el gasto mensual agregado.

No hace falta medir decenas de indicadores. Con un modelo de tres niveles es suficiente para empezar: uso y eficiencia (errores, latencia, acciones y sesiones), calidad (resolución, escalados, abandonos) y negocio (coste por resolución, tiempo manual evitado, productividad e impacto comercial o de servicio).

Mirando el coste por resultado, no el gasto mensual aislado. Es decir: cuánto cuesta cada consulta resuelta correctamente y qué se obtiene a cambio — trabajo manual evitado, mejora en los tiempos de respuesta y volumen adicional que puede atenderse con los mismos recursos.

Cuando resuelve de forma estable, con una calidad medida y un coste por resolución previsible. Antes de introducir cambios en producción conviene validarlos en Testing Center y, después, mantener el ciclo: probar, desplegar, observar y optimizar.

Síguenos por redes sociales