Transparencia editorial
Cómo funciona el pipeline de agentes
Detalle técnico de cada paso, sus filtros automáticos y sus umbrales de decisión. Para la versión resumida, ver Metodología Editorial.
Cada artículo de Estar Informado recorre ocho pasos automáticos —investigación, redacción, edición, control de calidad, verificación de hechos, imagen, maquetación y comprobación final— con tres bucles de reescritura y, en el Curator, tres filtros automáticos que rechazan un borrador sin que ningún modelo llegue a evaluarlo. Ese pipeline automático nunca termina en publicación: siempre entrega el artículo a un editor humano, que es quien decide si sale a la calle.
El rechazo (rejected) cuelga de tres puntos — tras 3 reintentos fallidos del Editor (antes de edited), del Curator (antes de approved) o del Verificador, que opera sobre un artículo ya approved y, si rechaza, exige que la reescritura vuelva a superar Editor y Curator antes de reintentar — si cualquiera de los dos la rechaza en ese punto, el artículo se descarta de inmediato, sin volver a su propio bucle de 3 intentos. Nunca ocurre después de maquetar: pasado laid_out el único destino posible es published.
Los 8 pasos
Busca en la web y estructura hasta 5 temas candidatos con fuentes verificadas.
Filtros automáticos, antes de estructurar con el modelo
- Ventana temporal de 7 días, ampliada a 14 y 30 en reintentos si no hay temas viables — salvo en economía y empresa, donde queda fija en 7 días sin ampliar nunca. Es deliberado, no un descuido: una cifra de mercado o un anuncio corporativo pierde vigencia editorial en días, así que ampliar la ventana arriesga citar como actual un dato ya desfasado.
- Cada URL debe responder y superar un guard anti-SSRF, incluso tras redirección
- Descarta dominios especulativos o de baja autoridad salvo que no quede ninguna fuente alternativa
- Cada tema final exige al menos 2 fuentes de dominios distintos y descarta URLs genéricas (portadas, secciones)
- Excluye temas que solapan con los últimos 30 artículos ya publicados o en curso
Redacta 1500–2000 palabras en español, en Markdown, con citación numerada en dos niveles (inline + sección de referencias).
Reglas del prompt, verificadas después por Editor
- Prohibido alucinar: toda cifra, cita o nombre debe existir literalmente en las fuentes proporcionadas
- Solo español — sin anglicismos ni marcado de énfasis decorativo
- Cada afirmación lleva su número de fuente pegado, y una sección de referencias numerada al final
- Reglas editoriales por dominio: rigor factual, vigencia de los datos, distinción entre proyección y dato real, terminología técnica exacta por sector
Control de calidad de redacción sobre el borrador del Writer.
Verificación previa — cualquier fallo rechaza directo
- Fecha de redacción declarada, sección de referencias completa, proyecciones en condicional
- URLs directas al contenido citado, atribución directa a la fuente primaria
- Verbos temporales correctos, discrepancias entre fuentes declaradas, magnitudes cuantificadas
Limpieza mecánica al aprobar — no depende del modelo
- Backticks sueltos envolviendo una palabra o frase corta (`alineación`, `Zero Trust`) se eliminan por código antes de que el artículo pase a Curator — el modelo tiende a marcar así el vocabulario que se le pide integrar, y ese marcado se renderiza como código en el artículo publicado si no se limpia. Los bloques de código genuinos no se tocan.
Rúbrica, puntuada de 0 a 10
- 8 criterios centrales siempre puntúan: rigor factual, apertura, estructura, tono, fuentes y citas, extensión mínima real, idioma, conclusión
- 2 criterios contextuales puntúan 8 por defecto si no aplican: precisión técnica, perspectiva internacional
Director editorial — última línea de calidad antes de maquetar. Solo llega aquí si supera los filtros de abajo.
Filtros automáticos, nunca delegados al modelo
- Menos de 2 fuentes validadas → rechazo automático a Writer
- Todas las fuentes del mismo dominio → rechazo automático a Writer
- Cualquier palabra prohibida detectada → rechazo automático a Writer, sin excepción
Rúbrica, puntuada de 0 a 10
- 7 criterios centrales: rigor, valor editorial, relevancia, capacidad de retener al lector, profundidad analítica, ética y equilibrio, idioma
- 3 criterios contextuales, puntúan 8 si no aplican: precisión técnica por dominio, tono medido, perspectiva geográfica
Última puerta antes de maquetación: contrasta cada afirmación verificable del artículo contra el contenido completo de las fuentes citadas y, para normas o plazos regulatorios, contra una búsqueda fresca posterior a la fecha de esas fuentes. Corre con una cadena de modelos deliberadamente distinta a la que redactó el artículo — Editor y Curator ya evaluaron con ese mismo tipo de modelo y, confirmado en producción, no detectan sus propias fabricaciones.
Lint de salida — bloqueante, sin necesidad de modelo
- Marcadores de plantilla sin resolver, placeholders o campos de ficha (custodia de cifra, estado jurídico) sin rellenar filtrados al texto
- Llaves o corchetes sueltos fuera de un enlace o bloque de código, comillas sin cerrar
- Sustitución de anglicismos aplicada dentro de un título o nombre de medio en la sección de Referencias
- La misma afirmación exacta atribuida a dos números de referencia distintos
Siete criterios — el fallo de cualquiera, por sí solo, basta para rechazar
- Vigencia temporal: un proceso regulatorio, legislativo o judicial descrito como pendiente cuando la búsqueda fresca muestra que ya avanzó a otra etapa
- Proyección vs. dato real: una cifra presentada como estimación cuando ya existe un dato definitivo posterior
- Verificación regulatoria: un plazo normativo dado por vigente sin comprobar enmiendas, aplazamientos o derogaciones recientes
- Prueba de conexión: la tesis del artículo vincula dos hechos por coincidencia (nombre, fecha, sector) en vez de una relación causal confirmada por las fuentes
- Fidelidad de atribución: cualquier afirmación atribuida a una fuente que no aparece, literalmente, en el contenido real de esa fuente — fabricación, la categoría más grave
- Custodia de cifras y normas ancla: toda cifra o norma en titular, entradilla o conclusión debe resolverse a una cita literal de la fuente, con sujeto, objeto y marco temporal íntegros
- Bloques sin cita: cualquier epígrafe sin una sola referencia numérica en todo su contenido
Efecto lateral tras la aprobación del Curator — nunca bloquea el pipeline.
- El prompt visual lo redacta el propio Writer en inglés y se le añade siempre la instrucción de no incluir texto, letras ni logotipos en la imagen
Divulgación de imagen sintética — art. 50(2) del Reglamento de IA
- El aviso "contenido generado por IA" que ve el lector en cada artículo cubre el texto (art. 50(4)-(5)). Para la imagen, además de esa divulgación visible, cada imagen se marca de forma legible por máquina antes de almacenarse: se incrusta en el PNG un paquete de metadatos XMP con el valor estándar IPTC Digital Source Type = trainedAlgorithmicMedia, que identifica el archivo como generado por un modelo de IA ante cualquier herramienta o plataforma que lea metadatos de origen (exiftool, verificadores C2PA, lectores IPTC).
- El marcado técnico legible por máquina que exige el art. 50(2) es, en rigor, obligación del proveedor del modelo generativo (NVIDIA / Black Forest Labs), no del medio que lo utiliza; la obligación propia de Estar Informado como usuario profesional es la divulgación visible del art. 50(4). Aun así aplicamos el marcado por nuestra cuenta como medida de transparencia adicional.
Convierte el Markdown a HTML de forma determinista y genera los metadatos SEO con un modelo de lenguaje.
- No es un filtro de calidad: nunca rechaza, solo transforma y conserva el estado de aprobado del Curator
Último paso automático del pipeline: verifica que los campos obligatorios estén completos y encola para revisión humana. Nunca publica por sí mismo.
El único camino que existe en todo el sistema para marcar un artículo como publicado. Siempre requiere una acción humana explícita — no hay temporizador, contador ni condición que lo dispare solo.
Se dispara con
- El comando de publicación manual que ejecuta el editor humano
- El botón «Publicar» del panel de redacción interno
Estados terminales
Salida normal y única del pipeline automático. Espera indefinidamente aquí hasta que un editor lo publique.
Solo se alcanza por la acción manual descrita arriba. Ningún otro proceso escribe este estado.
Al superar el límite de reescrituras en el Editor o el Curator. Definitivo dentro de ese ciclo.
Condiciones globales
Reglas que gobiernan el pipeline entero, no un paso concreto.
Publicación
Siempre manual. No queda ninguna condición, contador ni marca en el sistema que publique un artículo sin que una persona lo decida explícitamente.
Límite de reescrituras
Cada bucle de rechazo —el del Editor, el del Curator y el del Verificador— se detiene a la 3ª reescritura fallida; el artículo se descarta.
Política de palabras
Listas bilingües de vocabulario prohibido y preferido. Las prohibidas son línea roja: su sola presencia rechaza el artículo de forma automática en el Curator.
Fuentes prioritarias
15 medios de referencia (El País, Reuters, Financial Times, Bloomberg, The Economist, entre otros). Al menos 2 fuentes por tema deben salir de esta lista cuando no hay instrucciones editoriales específicas activas.
Asignación de perspectiva
8 categorías fijas: CISO, CIO, gobernanza de IA, historia, ciencia, empresa, seguridad y economía.
Sin entrenamiento con nuestro contenido
Cloudflare, Groq y NVIDIA lo confirman por escrito en su Data Processing Addendum (DPA), vigente también en su plan gratuito o self-serve. Cerebras lo confirma igual de explícitamente, pero en sus Términos de Uso — no dispone aún de un DPA formal aparte. Tavily es distinto: su plan gratuito no incluye DPA y su política permite usar consultas para mejorar sus modelos, pero solo recibe términos de búsqueda genéricos, nunca el contenido de un artículo — detalle completo en Política de Privacidad.
Registro de actividad
Cada agente registra su decisión, un extracto del prompt/respuesta y su duración en una tabla interna, no accesible públicamente. Se conserva 180 días y se elimina automáticamente después. No es una exigencia del Reglamento de IA para este pipeline (esa obligación de registro automático, art. 12 y 19, aplica a sistemas de alto riesgo) — se mantiene igualmente como práctica de trazabilidad. Detalle en Política de Privacidad.
Divulgación conforme al Reglamento de IA de la UE
Esta página amplía, con el detalle técnico completo, el enfoque de transparencia del artículo 50 del Reglamento (UE) 2024/1689 (Ley de IA) que ya describe Metodología Editorial. Para notificar una inexactitud o pedir aclaraciones sobre el proceso, escribe a contacto.