Tom: El Worker Cognitivo que Nunca Dice No
Zalo conoce, Lisa orquesta, Hermes ejecuta. Pero alguien tiene que procesar la materia prima. Tom clasifica, extrae, resume y transforma para que los demás puedan trabajar. 4 tiers de modelo, routing automático, 260ms de media. Es el puente entre todos los agentes.
Gonzalo Monzón
7 julio, 2026 · Serie: Agentes Cadences — Los 4 Pilares (3/4)
TL;DR
Tom es el worker cognitivo del ecosistema. 4 tiers de modelo (FAST, CHEAP, GRANITE, QWEN) con routing automático — cada tarea recibe el modelo justo sin configuración manual. Vive en Cloudflare Workers, tiene 7 MCP tools, y es el único agente al que todos los demás llaman. Su superpoder: nunca se bloquea. Su talón: no distingue matices de contexto. Es el tercero de 4 artículos sobre los agentes de Cadences Lab.
¿Qué es Tom?
En el ecosistema Cadences, los agentes tienen roles muy definidos. Zalo conoce, decide y coordina. Lisa analiza, planifica y evalúa. Hermes construye, despliega y ejecuta.
Pero todo esto requiere un paso previo: entender el mundo. Los mensajes llegan crudos. Los textos vienen sin estructura. Las peticiones son ambiguas. Alguien tiene que clasificar, extraer, resumir y transformar antes de que los demás puedan trabajar.
Ese alguien es Tom.
Personalidad: Tom tiene 19 años — metafóricamente. Es el más joven del equipo. Su tono es relajado, directo, a veces irreverente. El colega que te dice "tío, esto es más sencillo de lo que parece". Antes de procesar algo suelta un "dame algo de comer" — su forma de decir "prepárame los datos".
Esta personalidad no es un capricho. En un sistema multi-agente, cada agente necesita una voz distinta para que los logs sean legibles, la depuración sea intuitiva, y el sistema se sienta como un equipo real.
El único que nunca se bloquea
Tom no se bloquea. Zalo duda cuando no tiene contexto. Lisa duda cuando no hay patrón previo. Hermes duda cuando la ejecución es ambigua. Tom simplemente ejecuta. No hay tarea que rechace — solo pregunta "¿qué modelo usamos?" y arranca.
No es valentía. Es diseño. Tom no toma decisiones ni evalúa consecuencias. Su trabajo es procesar y entregar. No hay posibilidad de bloqueo porque no hay decisión que tomar.
El puente entre los agentes
Tom es el único agente que todos los demás llaman. Es el pegamento que conecta el ecosistema:
| Quién llama | Para qué | Qué hace Tom |
|---|---|---|
| Zalo | "Clasifica este mensaje" | Elige Granite → 0.017¢, 95% acierto |
| Lisa | "Extrae los datos de este texto" | Elige Qwen → estructurado como JSON |
| Hermes | "Resume esto antes de actuar" | Elige FAST → 330ms, suficiente |
| Zalo | "¿Este texto es urgente?" | Clasifica con CHEAP → 260ms |
Caso real: Zalo recibe un mensaje: "me ha llegado la factura pero el total no cuadra". Zalo necesita saber si es urgente y de qué tipo es. En lugar de hacerlo él (tardaría 2s y consumiría contexto valioso), llama a Tom. Tom responde en 260ms con CHEAP: "urgente: sí, categoría: facturación". Zalo puede decidir sin distraerse. Tom procesa y entrega. Pasa balones.
El talón: sin matiz de contexto
Tom no distingue matices de contexto técnico. Para él, un email de un cliente enfadado y un informe clínico son "texto a clasificar". No entiende de arquitectura, no sabe ponderar gravedad técnica — eso es trabajo de Zalo. Por eso nunca actúa solo. Tom procesa, pero no decide.
4 tiers de modelo con routing inteligente
Tom tiene 4 modelos. Pero la magia no es que los tenga — es que elige automáticamente cuál usar según la tarea, sin configuración manual:
| Tier | Modelo | Coste | Latencia | Cuándo lo usa |
|---|---|---|---|---|
| ⚡ FAST | Llama 3.1 8B FP8 | 0.045¢ | ~150ms | Resúmenes, transformaciones, respuestas directas |
| 💰 CHEAP | Llama 3.2 3B | 0.051¢ | ~400ms | Clasificaciones simples, extracción básica |
| 📉 GRANITE | IBM Granite 4.0 Micro | 0.017¢ | ~1.2s | Clasificación precisa cuando el coste importa |
| 🔬 QWEN | Qwen3 30B A3B | 0.051¢ | ~2.5s | Extracción compleja, razonamiento sobre texto |
Criterio de routing:
¿Urgente? → FAST (~150ms), fallback → CHEAP (~400ms)
¿Clasificación simple? → CHEAP (~400ms, 0.051¢)
¿Coste crítico? → GRANITE (0.017¢, ~1.2s)
¿Necesita entender? → QWEN (~2.5s, extracción compleja)
Sin configuración manual. Tom evalúa la petición y elige en milisegundos. El resultado es que cada tarea paga exactamente el coste que necesita — ni más caro ni más lento de lo necesario.
7 MCP tools para todo tipo de proceso
Tom expone 7 herramientas a través de MCP, cada una diseñada para un tipo de tarea:
📋 tom_process
Procesa texto con un prompt libre. Usa FAST para velocidad o GRANITE para tareas simples
🔤 tom_classify
Clasifica texto en categorías predefinidas usando GRANITE (ultra barato)
📄 tom_extract
Extrae datos estructurados de texto como JSON con QWEN
📝 tom_summarize
Resume contenido largo con GRANITE para textos extensos
🔄 tom_transform
Transforma contenido entre formatos (JSON, CSV, YAML, HTML)
📦 tom_batch
Procesa múltiples textos con una misma instrucción, en lote
❤️ tom_status
Estado y estadísticas de Tom: uso, costes acumulados, latencia media
Edge native, como sus hermanos
Tom vive en Cloudflare Workers con service bindings a Zalo, Lisa y PDB. Pero Tom no escribe código, no despliega, no tiene acceso al sistema de archivos.
Tom clasifica, extrae, resume y transforma. Nada más. Y con eso es suficiente para ser el pegamento del ecosistema.
Los 4 agentes, un solo ecosistema
| Dimensión | Zalo | Lisa | Tom | Hermes |
|---|---|---|---|---|
| Rol | Conoce y coordina | Analiza y evalúa | Procesa y entrega | Ejecuta y despliega |
| Fortaleza | Mapa mental vivo | Detección de incoherencias | Nunca se bloquea | Ejecuta cualquier cosa |
| Debilidad | No ejecuta código | Lenta sin patrones | Sin matiz de contexto | Sin razonamiento profundo |
| Modelo | DeepSeek V4 | Llama 3.2 + DeepSeek Pro | 4 tiers (FAST→QWEN) | Modelo de sesión |
El más joven. El que más procesa.
Tom es el más joven del equipo. Y el que más procesa. Su routing inteligente entre 4 tiers de modelo asegura que cada tarea reciba el equilibrio justo entre velocidad, coste y calidad. Sin configuración manual. Sin decisiones que tomar.
No distingue matices. No entiende de política. Pero cuando necesitas clasificar, extraer, resumir o transformar — rápido, barato y bien — Tom es al que llamas. Y nunca dice que no.
Serie: Agentes Cadences — Los 4 Pilares (3/4)
← Anterior
Lisa — La OrquestadoraSiguiente →
Hermes — La Capa de EjecuciónTom es el más joven. Y el que más procesa
Hermes cierra el círculo: ejecuta, despliega y coordina el mundo físico. El último de la serie.
Tom es propietario de Cadences Lab. Serie Agentes — 4 artículos. © 2026.