Volver al Blog
Tom Worker Cognitivo · 15 min lectura

Tom: El Worker Cognitivo que Nunca Dice No

Zalo conoce, Lisa orquesta, Hermes ejecuta. Pero alguien tiene que procesar la materia prima. Tom clasifica, extrae, resume y transforma para que los demás puedan trabajar. 4 tiers de modelo, routing automático, 260ms de media. Es el puente entre todos los agentes.

Gonzalo Monzón

Gonzalo Monzón

7 julio, 2026 · Serie: Agentes Cadences — Los 4 Pilares (3/4)

TL;DR

Tom es el worker cognitivo del ecosistema. 4 tiers de modelo (FAST, CHEAP, GRANITE, QWEN) con routing automático — cada tarea recibe el modelo justo sin configuración manual. Vive en Cloudflare Workers, tiene 7 MCP tools, y es el único agente al que todos los demás llaman. Su superpoder: nunca se bloquea. Su talón: no distingue matices de contexto. Es el tercero de 4 artículos sobre los agentes de Cadences Lab.

La premisa

¿Qué es Tom?

En el ecosistema Cadences, los agentes tienen roles muy definidos. Zalo conoce, decide y coordina. Lisa analiza, planifica y evalúa. Hermes construye, despliega y ejecuta.

Pero todo esto requiere un paso previo: entender el mundo. Los mensajes llegan crudos. Los textos vienen sin estructura. Las peticiones son ambiguas. Alguien tiene que clasificar, extraer, resumir y transformar antes de que los demás puedan trabajar.

Ese alguien es Tom.

Personalidad: Tom tiene 19 años — metafóricamente. Es el más joven del equipo. Su tono es relajado, directo, a veces irreverente. El colega que te dice "tío, esto es más sencillo de lo que parece". Antes de procesar algo suelta un "dame algo de comer" — su forma de decir "prepárame los datos".

Esta personalidad no es un capricho. En un sistema multi-agente, cada agente necesita una voz distinta para que los logs sean legibles, la depuración sea intuitiva, y el sistema se sienta como un equipo real.

El superpoder

El único que nunca se bloquea

Tom no se bloquea. Zalo duda cuando no tiene contexto. Lisa duda cuando no hay patrón previo. Hermes duda cuando la ejecución es ambigua. Tom simplemente ejecuta. No hay tarea que rechace — solo pregunta "¿qué modelo usamos?" y arranca.

No es valentía. Es diseño. Tom no toma decisiones ni evalúa consecuencias. Su trabajo es procesar y entregar. No hay posibilidad de bloqueo porque no hay decisión que tomar.

El puente entre los agentes

Tom es el único agente que todos los demás llaman. Es el pegamento que conecta el ecosistema:

Quién llama Para qué Qué hace Tom
Zalo "Clasifica este mensaje" Elige Granite → 0.017¢, 95% acierto
Lisa "Extrae los datos de este texto" Elige Qwen → estructurado como JSON
Hermes "Resume esto antes de actuar" Elige FAST → 330ms, suficiente
Zalo "¿Este texto es urgente?" Clasifica con CHEAP → 260ms

Caso real: Zalo recibe un mensaje: "me ha llegado la factura pero el total no cuadra". Zalo necesita saber si es urgente y de qué tipo es. En lugar de hacerlo él (tardaría 2s y consumiría contexto valioso), llama a Tom. Tom responde en 260ms con CHEAP: "urgente: sí, categoría: facturación". Zalo puede decidir sin distraerse. Tom procesa y entrega. Pasa balones.

La limitación

El talón: sin matiz de contexto

Tom no distingue matices de contexto técnico. Para él, un email de un cliente enfadado y un informe clínico son "texto a clasificar". No entiende de arquitectura, no sabe ponderar gravedad técnica — eso es trabajo de Zalo. Por eso nunca actúa solo. Tom procesa, pero no decide.

4 tiers de modelo con routing inteligente

Tom tiene 4 modelos. Pero la magia no es que los tenga — es que elige automáticamente cuál usar según la tarea, sin configuración manual:

Tier Modelo Coste Latencia Cuándo lo usa
⚡ FAST Llama 3.1 8B FP8 0.045¢ ~150ms Resúmenes, transformaciones, respuestas directas
💰 CHEAP Llama 3.2 3B 0.051¢ ~400ms Clasificaciones simples, extracción básica
📉 GRANITE IBM Granite 4.0 Micro 0.017¢ ~1.2s Clasificación precisa cuando el coste importa
🔬 QWEN Qwen3 30B A3B 0.051¢ ~2.5s Extracción compleja, razonamiento sobre texto

Criterio de routing:

¿Urgente?FAST (~150ms), fallback → CHEAP (~400ms)
¿Clasificación simple?CHEAP (~400ms, 0.051¢)
¿Coste crítico?GRANITE (0.017¢, ~1.2s)
¿Necesita entender?QWEN (~2.5s, extracción compleja)

Sin configuración manual. Tom evalúa la petición y elige en milisegundos. El resultado es que cada tarea paga exactamente el coste que necesita — ni más caro ni más lento de lo necesario.

7 MCP tools para todo tipo de proceso

Tom expone 7 herramientas a través de MCP, cada una diseñada para un tipo de tarea:

📋 tom_process

Procesa texto con un prompt libre. Usa FAST para velocidad o GRANITE para tareas simples

🔤 tom_classify

Clasifica texto en categorías predefinidas usando GRANITE (ultra barato)

📄 tom_extract

Extrae datos estructurados de texto como JSON con QWEN

📝 tom_summarize

Resume contenido largo con GRANITE para textos extensos

🔄 tom_transform

Transforma contenido entre formatos (JSON, CSV, YAML, HTML)

📦 tom_batch

Procesa múltiples textos con una misma instrucción, en lote

❤️ tom_status

Estado y estadísticas de Tom: uso, costes acumulados, latencia media

Edge native, como sus hermanos

Tom vive en Cloudflare Workers con service bindings a Zalo, Lisa y PDB. Pero Tom no escribe código, no despliega, no tiene acceso al sistema de archivos.

Tom clasifica, extrae, resume y transforma. Nada más. Y con eso es suficiente para ser el pegamento del ecosistema.

Los 4 agentes, un solo ecosistema

Dimensión Zalo Lisa Tom Hermes
Rol Conoce y coordina Analiza y evalúa Procesa y entrega Ejecuta y despliega
Fortaleza Mapa mental vivo Detección de incoherencias Nunca se bloquea Ejecuta cualquier cosa
Debilidad No ejecuta código Lenta sin patrones Sin matiz de contexto Sin razonamiento profundo
Modelo DeepSeek V4 Llama 3.2 + DeepSeek Pro 4 tiers (FAST→QWEN) Modelo de sesión
Conclusión

El más joven. El que más procesa.

Tom es el más joven del equipo. Y el que más procesa. Su routing inteligente entre 4 tiers de modelo asegura que cada tarea reciba el equilibrio justo entre velocidad, coste y calidad. Sin configuración manual. Sin decisiones que tomar.

No distingue matices. No entiende de política. Pero cuando necesitas clasificar, extraer, resumir o transformar — rápido, barato y bien — Tom es al que llamas. Y nunca dice que no.

Serie: Agentes Cadences — Los 4 Pilares (3/4)

Todos los artículos de la serie:

1. Zalo 2. Lisa 3. Tom (este) 4. Hermes

Tom es el más joven. Y el que más procesa

Hermes cierra el círculo: ejecuta, despliega y coordina el mundo físico. El último de la serie.

Tom es propietario de Cadences Lab. Serie Agentes — 4 artículos. © 2026.

Newsletter

No te pierdas ninguna historia

Suscríbete para recibir nuevos lanzamientos, capítulos exclusivos y contenido detrás de cámaras.

  • Insights y artículos semanales
  • Contenido exclusivo y acceso anticipado
  • Sin spam, cancela cuando quieras

Respetamos tu privacidad. Puedes darte de baja cuando quieras.