Amazon CloudWatch Container Insights now supports collection of GPU metrics at sub-minute frequencies for AI and ML workloads running on Amazon EKS. Customers can configure the metric sample rate in seconds, enabling more granular monitoring of GPU resource utilization.
This enhancement enables customers to effectively monitor GPU-intensive workloads that run for less than 60 seconds, such as ML inference jobs that consume GPU resources for short durations. By increasing the sampling frequency, customers can maintain detailed visibility into short-lived GPU workloads. Sub-minute GPU metrics are sent to CloudWatch once per minute. This granular monitoring helps customers optimize their GPU resource utilization, troubleshoot performance issues, and ensure efficient operation of their containerized GPU applications.
Sub-Minute GPU metrics in Container Insights is available in all AWS Commercial Regions and the AWS GovCloud (US) Regions.
To learn more about Sub-Minute GPU metrics in Container Insights, visit the NVIDIA GPU metrics page in the Amazon CloudWatch User Guide. Sub-Minute GPU metrics in Container Insights are available for no addition cost. For Container Insights pricing, see the Amazon CloudWatch Pricing Page.
Categories: general:products/aws-govcloud-us,general:products/amazon-cloudwatch,marketing:marchitecture/management-and-governance
Source: Amazon Web Services
Latest Posts
- MC1459744: Power Pages Pre-Production Release 9.8.8.x Brings Updated Website Host and Performance Fixes

- MC1459765: Power Pages Rolls Out Early Upgrade to Version 9.8.8.x with Performance and Security Fixes

- Amazon Bedrock announces reduced pricing for OpenAI GPT-5.6 Sol

- Agents, Workers – Choose OAuth scopes for Wrangler and the Cloudflare API MCP server







