Transparencia editorial

Cómo funciona el pipeline de agentes

Detalle técnico de cada paso, sus filtros automáticos y sus umbrales de decisión. Para la versión resumida, ver Metodología Editorial.

Cada artículo de Estar Informado recorre ocho pasos automáticos —investigación, redacción, edición, control de calidad, verificación de hechos, imagen, maquetación y comprobación final— con tres bucles de reescritura y, en el Curator, tres filtros automáticos que rechazan un borrador sin que ningún modelo llegue a evaluarlo. Ese pipeline automático nunca termina en publicación: siempre entrega el artículo a un editor humano, que es quien decide si sale a la calle.

researcheddraftedrejectededitedrejectedapprovedrejectedlaid_outpublished

El rechazo (rejected) cuelga de tres puntos — tras 3 reintentos fallidos del Editor (antes de edited), del Curator (antes de approved) o del Verificador, que opera sobre un artículo ya approved y, si rechaza, exige que la reescritura vuelva a superar Editor y Curator antes de reintentar — si cualquiera de los dos la rechaza en ese punto, el artículo se descarta de inmediato, sin volver a su propio bucle de 3 intentos. Nunca ocurre después de maquetar: pasado laid_out el único destino posible es published.

Los 8 pasos

1
Researcheragents/researcher.ts

Busca en la web y estructura hasta 5 temas candidatos con fuentes verificadas.

BúsquedaTavilysolo consultas genéricas (perspectiva + plantilla fija), nunca el contenido de un artículo ni datos de quienes visitan el sitio — detalle en Política de Privacidad
MotorCloudflare Workers AI (GPT-OSS-120B)Cerebras GPT-OSS-120BGroq Llama 3.3 70BCerebras Zai GLM-4.7

Filtros automáticos, antes de estructurar con el modelo

  • Ventana temporal de 7 días, ampliada a 14 y 30 en reintentos si no hay temas viables — salvo en economía y empresa, donde queda fija en 7 días sin ampliar nunca. Es deliberado, no un descuido: una cifra de mercado o un anuncio corporativo pierde vigencia editorial en días, así que ampliar la ventana arriesga citar como actual un dato ya desfasado.
  • Cada URL debe responder y superar un guard anti-SSRF, incluso tras redirección
  • Descarta dominios especulativos o de baja autoridad salvo que no quede ninguna fuente alternativa
  • Cada tema final exige al menos 2 fuentes de dominios distintos y descarta URLs genéricas (portadas, secciones)
  • Excluye temas que solapan con los últimos 30 artículos ya publicados o en curso
OKElige el tema con mayor relevancia entre los que tienen diversidad de fuentes → pasa a Writer
STOP3 intentos agotados sin tema viable → el pipeline se detiene, sin artículo
2
Writeragents/writer.ts

Redacta 1500–2000 palabras en español, en Markdown, con citación numerada en dos niveles (inline + sección de referencias).

MotorCloudflare Workers AI (GPT-OSS-120B)Cerebras GPT-OSS-120BGroq Llama 3.3 70BCerebras Zai GLM-4.7

Reglas del prompt, verificadas después por Editor

  • Prohibido alucinar: toda cifra, cita o nombre debe existir literalmente en las fuentes proporcionadas
  • Solo español — sin anglicismos ni marcado de énfasis decorativo
  • Cada afirmación lleva su número de fuente pegado, y una sección de referencias numerada al final
  • Reglas editoriales por dominio: rigor factual, vigencia de los datos, distinción entre proyección y dato real, terminología técnica exacta por sector
OKBorrador completo → Editor
3
Editoragents/editor.ts

Control de calidad de redacción sobre el borrador del Writer.

MotorGroq Llama 3.3 70BCerebras Zai GLM-4.7Cloudflare Workers AI (GPT-OSS-120B)Cerebras GPT-OSS-120B

Verificación previa — cualquier fallo rechaza directo

  • Fecha de redacción declarada, sección de referencias completa, proyecciones en condicional
  • URLs directas al contenido citado, atribución directa a la fuente primaria
  • Verbos temporales correctos, discrepancias entre fuentes declaradas, magnitudes cuantificadas

Limpieza mecánica al aprobar — no depende del modelo

  • Backticks sueltos envolviendo una palabra o frase corta (`alineación`, `Zero Trust`) se eliminan por código antes de que el artículo pase a Curator — el modelo tiende a marcar así el vocabulario que se le pide integrar, y ese marcado se renderiza como código en el artículo publicado si no se limpia. Los bloques de código genuinos no se tocan.

Rúbrica, puntuada de 0 a 10

  • 8 criterios centrales siempre puntúan: rigor factual, apertura, estructura, tono, fuentes y citas, extensión mínima real, idioma, conclusión
  • 2 criterios contextuales puntúan 8 por defecto si no aplican: precisión técnica, perspectiva internacional
Aprueba solo si la media de los criterios centrales es ≥ 6.5 y ninguno baja de 4
APROBADOCurator
RECHAZADO→ vuelve a Writer con feedback específico; se reintenta hasta 3 veces
STOP4º rechazo → el artículo se descarta definitivamente
4
Curatoragents/curator.ts

Director editorial — última línea de calidad antes de maquetar. Solo llega aquí si supera los filtros de abajo.

MotorGroq Llama 3.3 70BCerebras Zai GLM-4.7Cloudflare Workers AI (GPT-OSS-120B)Cerebras GPT-OSS-120B

Filtros automáticos, nunca delegados al modelo

  • Menos de 2 fuentes validadas → rechazo automático a Writer
  • Todas las fuentes del mismo dominio → rechazo automático a Writer
  • Cualquier palabra prohibida detectada → rechazo automático a Writer, sin excepción

Rúbrica, puntuada de 0 a 10

  • 7 criterios centrales: rigor, valor editorial, relevancia, capacidad de retener al lector, profundidad analítica, ética y equilibrio, idioma
  • 3 criterios contextuales, puntúan 8 si no aplican: precisión técnica por dominio, tono medido, perspectiva geográfica
Publica solo si la media de los criterios centrales es ≥ 6.5 y ninguno baja de 4
APROBADO→ generación de imagen, luego Layout
→ WRITERReescritura completa cuando el rigor, el valor editorial o la profundidad son insuficientes
→ EDITORMejora dirigida cuando el contenido vale pero necesita más análisis o estructura
STOP4º rechazo → el artículo se descarta definitivamente
5
Verificadoragents/verificador.ts

Última puerta antes de maquetación: contrasta cada afirmación verificable del artículo contra el contenido completo de las fuentes citadas y, para normas o plazos regulatorios, contra una búsqueda fresca posterior a la fecha de esas fuentes. Corre con una cadena de modelos deliberadamente distinta a la que redactó el artículo — Editor y Curator ya evaluaron con ese mismo tipo de modelo y, confirmado en producción, no detectan sus propias fabricaciones.

BúsquedaTavilysolo para normas/plazos regulatorios detectados en el texto, buscando cambios de estado posteriores a las fuentes citadas — mismo proveedor y mismas salvedades que en Researcher
MotorGroq Llama 3.3 70BCerebras Zai GLM-4.7Cloudflare Workers AI (GPT-OSS-120B)Cerebras GPT-OSS-120B

Lint de salida — bloqueante, sin necesidad de modelo

  • Marcadores de plantilla sin resolver, placeholders o campos de ficha (custodia de cifra, estado jurídico) sin rellenar filtrados al texto
  • Llaves o corchetes sueltos fuera de un enlace o bloque de código, comillas sin cerrar
  • Sustitución de anglicismos aplicada dentro de un título o nombre de medio en la sección de Referencias
  • La misma afirmación exacta atribuida a dos números de referencia distintos

Siete criterios — el fallo de cualquiera, por sí solo, basta para rechazar

  • Vigencia temporal: un proceso regulatorio, legislativo o judicial descrito como pendiente cuando la búsqueda fresca muestra que ya avanzó a otra etapa
  • Proyección vs. dato real: una cifra presentada como estimación cuando ya existe un dato definitivo posterior
  • Verificación regulatoria: un plazo normativo dado por vigente sin comprobar enmiendas, aplazamientos o derogaciones recientes
  • Prueba de conexión: la tesis del artículo vincula dos hechos por coincidencia (nombre, fecha, sector) en vez de una relación causal confirmada por las fuentes
  • Fidelidad de atribución: cualquier afirmación atribuida a una fuente que no aparece, literalmente, en el contenido real de esa fuente — fabricación, la categoría más grave
  • Custodia de cifras y normas ancla: toda cifra o norma en titular, entradilla o conclusión debe resolverse a una cita literal de la fuente, con sujeto, objeto y marco temporal íntegros
  • Bloques sin cita: cualquier epígrafe sin una sola referencia numérica en todo su contenido
APROBADO→ generación de imagen, luego Layout
RECHAZADO→ vuelve a Writer con feedback; la reescritura debe volver a superar Editor y Curator antes de reintentar la verificación
STOP3er rechazo, o Editor/Curator rechazan la reescritura que motivó el verificador → el artículo se descarta definitivamente, sin más reintentos
6
Generación de imagenagents/image-generator.ts

Efecto lateral tras la aprobación del Curator — nunca bloquea el pipeline.

MotorNVIDIA FLUX.2 Klein 4B
  • El prompt visual lo redacta el propio Writer en inglés y se le añade siempre la instrucción de no incluir texto, letras ni logotipos en la imagen

Divulgación de imagen sintética — art. 50(2) del Reglamento de IA

  • El aviso "contenido generado por IA" que ve el lector en cada artículo cubre el texto (art. 50(4)-(5)). Para la imagen, además de esa divulgación visible, cada imagen se marca de forma legible por máquina antes de almacenarse: se incrusta en el PNG un paquete de metadatos XMP con el valor estándar IPTC Digital Source Type = trainedAlgorithmicMedia, que identifica el archivo como generado por un modelo de IA ante cualquier herramienta o plataforma que lea metadatos de origen (exiftool, verificadores C2PA, lectores IPTC).
  • El marcado técnico legible por máquina que exige el art. 50(2) es, en rigor, obligación del proveedor del modelo generativo (NVIDIA / Black Forest Labs), no del medio que lo utiliza; la obligación propia de Estar Informado como usuario profesional es la divulgación visible del art. 50(4). Aun así aplicamos el marcado por nuestra cuenta como medida de transparencia adicional.
OKImagen generada y adjuntada al artículo
FALLBACK2 intentos como máximo; si fallan, el artículo continúa sin imagen — no es un filtro de calidad
7
Layoutagents/layout-agent.ts

Convierte el Markdown a HTML de forma determinista y genera los metadatos SEO con un modelo de lenguaje.

MotorCloudflare Workers AI (GPT-OSS-120B)Cerebras GPT-OSS-120BGroq Llama 3.3 70BCerebras Zai GLM-4.7
  • No es un filtro de calidad: nunca rechaza, solo transforma y conserva el estado de aprobado del Curator
OKHTML y metadatos listos → Publisher
8
Publisheragents/publisher.ts

Último paso automático del pipeline: verifica que los campos obligatorios estén completos y encola para revisión humana. Nunca publica por sí mismo.

EN COLACampos completos → el artículo queda a la espera de revisión humana. El pipeline automático termina aquí.
STOPFalta algún campo obligatorio → error, no se encola
H
Publicación manualagents/publisher.ts · forcePublish()

El único camino que existe en todo el sistema para marcar un artículo como publicado. Siempre requiere una acción humana explícita — no hay temporizador, contador ni condición que lo dispare solo.

Se dispara con

  • El comando de publicación manual que ejecuta el editor humano
  • El botón «Publicar» del panel de redacción interno
PUBLICADOÚnico punto del sistema que puede marcar un artículo como publicado.

Estados terminales

approved

Salida normal y única del pipeline automático. Espera indefinidamente aquí hasta que un editor lo publique.

published

Solo se alcanza por la acción manual descrita arriba. Ningún otro proceso escribe este estado.

rejected

Al superar el límite de reescrituras en el Editor o el Curator. Definitivo dentro de ese ciclo.

Condiciones globales

Reglas que gobiernan el pipeline entero, no un paso concreto.

Publicación

Siempre manual. No queda ninguna condición, contador ni marca en el sistema que publique un artículo sin que una persona lo decida explícitamente.

Límite de reescrituras

Cada bucle de rechazo —el del Editor, el del Curator y el del Verificador— se detiene a la 3ª reescritura fallida; el artículo se descarta.

Política de palabras

Listas bilingües de vocabulario prohibido y preferido. Las prohibidas son línea roja: su sola presencia rechaza el artículo de forma automática en el Curator.

Fuentes prioritarias

15 medios de referencia (El País, Reuters, Financial Times, Bloomberg, The Economist, entre otros). Al menos 2 fuentes por tema deben salir de esta lista cuando no hay instrucciones editoriales específicas activas.

Asignación de perspectiva

8 categorías fijas: CISO, CIO, gobernanza de IA, historia, ciencia, empresa, seguridad y economía.

Sin entrenamiento con nuestro contenido

Cloudflare, Groq y NVIDIA lo confirman por escrito en su Data Processing Addendum (DPA), vigente también en su plan gratuito o self-serve. Cerebras lo confirma igual de explícitamente, pero en sus Términos de Uso — no dispone aún de un DPA formal aparte. Tavily es distinto: su plan gratuito no incluye DPA y su política permite usar consultas para mejorar sus modelos, pero solo recibe términos de búsqueda genéricos, nunca el contenido de un artículo — detalle completo en Política de Privacidad.

Registro de actividad

Cada agente registra su decisión, un extracto del prompt/respuesta y su duración en una tabla interna, no accesible públicamente. Se conserva 180 días y se elimina automáticamente después. No es una exigencia del Reglamento de IA para este pipeline (esa obligación de registro automático, art. 12 y 19, aplica a sistemas de alto riesgo) — se mantiene igualmente como práctica de trazabilidad. Detalle en Política de Privacidad.

Divulgación conforme al Reglamento de IA de la UE

Esta página amplía, con el detalle técnico completo, el enfoque de transparencia del artículo 50 del Reglamento (UE) 2024/1689 (Ley de IA) que ya describe Metodología Editorial. Para notificar una inexactitud o pedir aclaraciones sobre el proceso, escribe a contacto.