El martes te expliqué qué es un agente. Hoy te muestro uno de verdad, el más aburrido que tengo, para que veas que no hay magia: solo una tarea tediosa que dejé de hacer a mano.

Mi mañana empezaba igual todos los días, como la de muchos emprendedores: abrir el correo y encontrar decenas de mensajes sin leer, todos revueltos. El cliente con algo urgente, la factura de un servicio, un newsletter, una respuesta que llevaba tres días esperando, spam disfrazado de oportunidad. Y antes de poder responder una sola cosa, tenía que ver que era realmente importante. La primera media hora del día se me iba en eso: no en resolver, en ordenar para saber qué resolver.

Lo que monté

Un agente que corre cada mañana, lee lo que llegó nuevo y lo clasifica en tres montones: lo que necesita respuesta hoy, lo que puede esperar, y el ruido. Me deja un resumen corto de unas cinco líneas con lo que de verdad importa, etiqueta la bandeja según esos tres grupos y archiva solo la basura evidente. Llego, leo el resumen, y arranco directo por lo urgente. La media hora de separar se volvió dos minutos de leer.

La parte que no todos cuentan: corre local

Acá está el detalle que para mí no era opcional. Ese agente usa un modelo que corre en mi propia máquina, no una API en la nube. ¿Por qué? Porque en mi correo hay cosas mías y, sobre todo, cosas de mis clientes. Conversaciones, propuestas, datos de sus negocios. Mandar todo eso a un servicio de terceros para que me lo clasifique es exactamente lo que no puedo hacer cuando me confiaron información sensible.

Con un modelo local, el correo se lee y se clasifica sin salir de mi computador, ahora va ganando Gemma 4 pero mañana puede ser otro, recuerda siempre hay que seguir probando. Nadie más lo ve. No es la opción más potente que existe, un modelo grande en la nube clasificaría un poquito mejor, pero para separar urgente de ruido no necesito lo más potente, necesito lo más privado. Y para esta tarea, un modelo chico corriendo local alcanza y sobra.

Lo que NO le dejo hacer

El agente clasifica y resume pero no responde. Por dos cosas principalmente un agente no va a tener el contexto que yo tengo acerca del cliente, que se acordó y no está por escrito, como hablarle, etc, y segundo no puedo perder esa conexión con lo que hago.

La trampa que aprendí a la mala

La primera versión mandaba a "ruido" los correos que parecían suscripciones. Lógico: la mayoría de los mails automáticos de "tu pago", "tu recibo", "renovación" efectivamente son ruido. El problema es que ahí adentro también estaban los cobros reales de servicios que sí pago, herramientas, infraestructura, cosas que es parte del negocio, y los estaba mandando a la pila de ignorar. Un par de esos casi se me pasan.

Por lo que el agente se debe ir ajustando y sobre todo al principio 1 o 2 semanas revisar muy detenidamente los resultados. El ruido de un día es la factura del otro, y solo lo puedes capturar mirando qué está clasificando mal las primeras semanas. Ese ajuste es lo que separa un agente que confías de uno que te esconde una cuenta por pagar.

Cómo lo replicas

No tienes que saber programar para sacarle la idea:

  1. Elige una tarea de ordenar, no de decidir. El triage es perfecto para empezar porque separar no es lo mismo que responder. Deja que el agente ordene; tú decides. La primera automatización no debería tomar ninguna decisión que duela deshacer.

  2. Si hay datos sensibles, mira lo local. No todo tiene que ir a la nube. Cuando manejas información de clientes, un modelo que corre en tu máquina es más lento de armar pero te ahorra el problema de explicar después por qué los datos de tu cliente pasaron por un servidor ajeno.

  3. Calíbralo antes de confiarle. Las primeras semanas revisa qué clasifica mal. Todos los agentes de triage se equivocan al principio; los buenos son los que corregiste, no los que soltaste el día uno.

La regla de una línea: la mejor primera automatización es la más aburrida que tengas — la que ordena tu entrada sin decidir por ti. El correo se me juntaba igual; la diferencia es que ahora llego a una bandeja ordenada en vez de a un cerro, y sin que nada de lo que me confiaron salga de mi máquina.

Las últimas noticias

OpenAI lanzó Presence, su plataforma para que las empresas desplieguen agentes de voz y chat en soporte, ventas y procurement. El número que llama la atención: en la propia línea de soporte de OpenAI, el agente resuelve el 75% de las llamadas sin humano. Pero fíjate en la letra chica — los despliegues los lideran ingenieros de OpenAI, con guardrails y acciones aprobadas de antemano. O sea: ni ellos sueltan un agente a responderle a un cliente sin humanos expertos en el loop. Es justo lo de arriba a otra escala: el agente hace el trabajo pesado, pero alguien sigue firmando la salida.

Keep Reading