jsonscraper

AWS CloudWatch Omni incorpora trazas de agentes a la vista de operaciones de aplicaciones

CloudWatch Omni combina trazas de agentes, evaluaciones y telemetría de aplicaciones, pero los equipos deben configurar los flujos de datos, los permisos y los presupuestos.

AWS anunció CloudWatch Omni el 22 de septiembre de 2026 y lo presentó como disponible de forma general el 23 de septiembre. Las fechas corresponden a dos acontecimientos distintos: el anuncio y el inicio de la disponibilidad general. Omni reúne la observabilidad de aplicaciones y agentes de IA en una experiencia, con una interfaz web independiente y extensiones para IDE, además de la integración con CloudWatch, según el anuncio de AWS.

Esta combinación aborda un punto ciego en producción: una solicitud de un agente puede completarse sin un error de servicio convencional y, aun así, generar una respuesta deficiente o elegir la herramienta equivocada. La propuesta de AWS es que los equipos puedan inspeccionar las trazas y evaluaciones de agentes junto con la telemetría de las aplicaciones. La pregunta práctica es si esas señales serán útiles en un espacio de trabajo compartido y qué datos, accesos y costos implica dirigirlas allí.

El producto va más allá de las trazas de agentes

Omni es una ampliación de CloudWatch, no un reemplazo. AWS afirma que las alarmas, los paneles, las API y los flujos de trabajo de la consola de CloudWatch existentes siguen funcionando. La telemetría que ya se envía a CloudWatch puede aparecer en Omni sin necesidad de reconfiguración; otras cargas de trabajo instrumentadas pueden enviar datos mediante el protocolo OpenTelemetry (OTLP). AWS también describe el descubrimiento de servicios y la asignación de dependencias, así como espacios que pueden reunir telemetría de varias cuentas y regiones cuando se configuran para ese fin, según la documentación de CloudWatch Omni.

La experiencia no se limita a la consola de administración de AWS. AWS ofrece una interfaz web independiente con inicio de sesión único, además de extensiones para VS Code, Cursor y Kiro. La nota de lanzamiento del 23 de septiembre indica que el producto está disponible de forma general en Este de EE. UU. (Norte de Virginia), Oeste de EE. UU. (Oregón) y Europa (Irlanda). Antes de incluir Omni en un diseño de producción, los equipos deberían comprobar la disponibilidad en las regiones que necesitan.

Para agentes, AWS describe funciones de exploración de trazas, evaluación y experimentación con marcos como OpenAI Agents SDK, LangGraph, CrewAI, Vercel AI SDK y Strands. Para investigar aplicaciones, los usuarios pueden hacer preguntas en lenguaje natural o explorar la telemetría directamente; AWS afirma que las funciones de investigación asistidas por IA se basan en DevOps Agent. La publicación de lanzamiento para aplicaciones también indica que DevOps Agent está habilitado de forma predeterminada en cada sesión de investigación de Omni; los administradores deberían tener en cuenta este comportamiento al evaluar el flujo de trabajo.

Por qué podría importar reunir estas señales

La supervisión convencional puede mostrar si un servicio responde, cuánto tarda y si devuelve errores. Es posible que no revele que un agente malinterpretó una solicitud, eligió una herramienta inadecuada o dio una respuesta incorrecta. Consultar el resultado de una evaluación junto con la traza y las señales de la aplicación podría ayudar a un equipo a rastrear un problema de calidad a través de la ejecución del agente.

Se trata de un posible beneficio operativo, no de un resultado de rendimiento demostrado. Los materiales de lanzamiento de AWS describen el flujo de trabajo combinado, pero no demuestran que permita resolver incidentes más rápido que las herramientas existentes. Los equipos tendrán que comprobar si las evaluaciones y las investigaciones de Omni son útiles con sus propias cargas de trabajo.

OpenTelemetry puede facilitar el envío de telemetría desde instrumentación existente, pero un protocolo común no hace que las plataformas de observabilidad sean intercambiables. La especificación de OTLP define cómo se transmite la telemetría; aun así, los equipos deben comprobar de qué señales, consultas y funciones específicas de la plataforma dependen sus flujos de trabajo.

La centralización requiere configuración

Omni puede reunir datos de varias cuentas y regiones, pero los equipos no deberían dar por sentado que habilitar la interfaz agrega automáticamente la telemetría de todas las cuentas. La documentación de configuración de AWS explica cómo crear dominios y espacios y, después, configurar la incorporación de telemetría de varias cuentas a un espacio. Los datos existentes de CloudWatch pueden consultarse sin volver a instrumentar los sistemas, pero la organización debe configurar los accesos y el flujo de datos que necesita, tal como se indica en la guía de configuración de Omni.

Esta diferencia importa tanto para la implementación como para los costos. La página de precios de AWS desglosa los cargos por incorporar telemetría, almacenarla y analizarla. También describe cargos por copias centralizadas adicionales; según los precios publicados, la primera copia centralizada es gratuita. Los costos de las consultas dependen de los datos analizados y de las asignaciones; las evaluaciones de agentes se facturan según las tarifas de Amazon Bedrock AgentCore Evaluations. Por tanto, una estimación útil debe tener en cuenta el volumen, la retención, los patrones de consulta, las copias y la frecuencia de las evaluaciones, no solo el número de agentes.

Es necesario revisar el contenido de las trazas y los accesos

Las trazas de agentes pueden incluir instrucciones, respuestas, documentos recuperados e información personal. AWS afirma que Omni no detecta ni oculta automáticamente la información de identificación personal. Sus directrices sobre datos sensibles recomiendan decidir dónde se aplica el filtrado; ocultar los datos al capturarlos es la opción que evita que el contenido sensible salga de la aplicación.

AWS también afirma que no utiliza el contenido de los clientes para entrenar modelos fundacionales ni para mejorar Omni. Eso no significa que el contenido no se procese en otros servicios: algunas funciones envían datos a servicios como Bedrock o AgentCore, y AWS documenta la inferencia entre regiones para las funciones de IA. Los datos se almacenan en la región del espacio, pero las solicitudes de IA pueden procesarse en otro lugar dentro de la misma zona geográfica. Los equipos deberían revisar la política de uso de datos de AWS y los detalles de inferencia entre regiones, sobre todo si sus políticas restringen dónde puede procesarse el contenido de las trazas.

Los controles de acceso merecen el mismo escrutinio que la canalización de telemetría. AWS afirma que, de forma predeterminada, los miembros de un espacio pueden leer toda su telemetría; los ámbitos de datos permiten limitar qué filas de registros y trazas puede ver cada miembro. Sin embargo, esos ámbitos no ocultan los campos de una fila, por lo que no sustituyen la eliminación de contenido que algunos usuarios no deberían ver, según la documentación sobre los límites de acceso de los miembros.

Una forma mesurada de evaluar Omni

Para los equipos que ya usan CloudWatch, una prueba acotada puede mostrar si la vista compartida de aplicaciones y agentes de Omni ayuda en un flujo de trabajo real. Antes de enviar trazas de producción, conviene identificar las señales necesarias, configurar el filtrado, definir el acceso por cuenta y región y estimar los costos de incorporación, almacenamiento, análisis y evaluación. Después, se pueden comparar las investigaciones generadas y los resultados de las evaluaciones con los procedimientos de respuesta a incidentes actuales.

Para las organizaciones que utilizan otras plataformas de observabilidad, el lanzamiento es una razón para evaluar el flujo de trabajo, no para migrar por sí solo. Omni acerca las señales de calidad de los agentes a las operaciones de aplicaciones, pero su valor dependerá de la utilidad de las investigaciones, de la adecuación de sus controles y de la economía del flujo de datos.

Analítica de rendimiento de Speedcurve
Luke Chesser