11 · Feedback: cómo se corrige a la IA
El agente no se afina solo escribiendo mejores reglas: se afina con lo que hace tu equipo en cada chat. Cómo le das ese feedback depende del modo en el que esté trabajando, porque cambia el momento en que podés intervenir.
Modo Cuándo intervenís Cómo le das feedback
Sugerencias y Copiloto por debajo del umbral
Antes de que salga el mensaje
Editás la respuesta propuesta y enviás tu versión, o usás Solicitar cambios.
Autónomo
Después: el mensaje ya se envió
👍 / 👎 sobre el mensaje. El 👎 abre la corrección: el razonamiento y, sobre todo, la respuesta como debería haber sido.
En modo autónomo: el pulgar es tu única palanca
Cuando el agente responde solo, nadie revisa antes. Si nadie califica, el agente repite el mismo error todos los días sin enterarse. Por eso, en autónomo, calificar deja de ser opcional:
👍 Positivo: marcá las respuestas bien resueltas. No es un “me gusta” de cortesía — es lo que le confirma qué estilo y qué nivel de detalle reforzar.
👎 Negativo: abre la corrección, y ahí tenés dos campos — los dos importan, pero no por igual.
Campo Qué corregís
El razonamiento
Cómo pensó el agente antes de responder. Si el razonamiento parte de una premisa equivocada, corregilo: es la lógica que va a reutilizar.
La respuesta como debería haber sido
Lo más importante. El mensaje exacto que tenía que haber mandado. Es lo que el agente va a usar en los próximos casos parecidos.
Un pulgar abajo sin la respuesta corregida no entrena nada: le dice al agente que algo estuvo mal, pero no qué debía decir. Si vas a marcar 👎, escribí la respuesta.
Ese par —razonamiento + respuesta— es exactamente la estructura de un ejemplo de entrenamiento. Corregir desde el chat es armar uno sin salir de la conversación.
Cómo escribir la respuesta corregida
Escribí el mensaje que hubieras mandado vos, listo para enviar. No un comentario sobre lo que hizo mal el agente: eso no se puede reutilizar.
En vez de Escribí
“Está mal” “El envío a Córdoba es 3 a 5 días hábiles, no 24 hs.”
“Muy largo” “Contestá el precio en una línea y recién si preguntan, explicá qué incluye.”
“No entendió” “Cuando piden ‘el más barato’ están pidiendo el plan Starter, no un descuento.”
La prueba rápida: si lo que escribiste se puede copiar y pegar en el chat tal cual, sirve. Si es una instrucción para el agente, no.
El feedback se acumula como ejemplos reales, sin que tengas que reescribir contextos ni reglas. Si el mismo error se repite después de varias correcciones, ahí sí el problema es de fondo: falta un contexto, sobra una instrucción que lo contradice, o hace falta un disparador para que encuentre lo que ya tiene cargado.
Quince segundos por chat, una vez al día. Un agente autónomo sin nadie que lo califique se congela en la calidad del día que lo configuraste. Uno con feedback constante mejora solo, y el trabajo que ahorra crece cada semana. Es la diferencia entre un bot y un agente que aprende de tu operación.
Convertir un chat entero en ejemplo de entrenamiento → — cuando la corrección da para más que un mensaje suelto.
← Campos de datosSiguiente: Vista CRM y Funnels →
Operar