Kubesense

AWS

Every AWS resource type KubeSense discovers and every metric it collects, with the provider-side query detail behind each one.

Overview

KubeSense collects 591 metrics across 44 resource types from AWS, reading them from Amazon CloudWatch, plus Amazon RDS Performance Insights for database internals.

Collection is read-only and agentless: resources are discovered through the provider's own management APIs, and nothing is installed in your AWS account. Every metric below is requested only for the resource types you enable.

Resources collected

30 resource types are available, 29 of them with metrics. Each row is one toggle on the integration's Resource Types selector; see Resource & Metric Collection for connecting the account itself.

Discovered as lists the entity kinds a toggle produces — the kinds you filter on in the Infrastructure explorer. One toggle can yield several, which is why the 44 metric tables below outnumber the toggles here.

Resource typeToggle keyDiscovered asMetrics
EC2 Instancesec2Ec2InstanceYes
RDS DatabasesrdsRdsInstance, RdsClusterYes
ElastiCacheelasticacheElastiCacheClusterYes
Load Balancers (ELB/ALB/NLB)elbLoadBalancer, LbListener, LbTargetServer, LoadBalancerTargetGroupYes
ECSecsEcsCluster, EcsService, EcsContainerInstance, EcsTaskDefinition, EcsTask, EcsContainerYes
EKS ClusterseksEksClusterYes
Lambda FunctionslambdaLambdaFunctionYes
S3 Bucketss3S3BucketYes
SNS TopicssnsSnsTopicYes
SQS QueuessqsSqsQueueYes
Kinesis StreamskinesisKinesisStreamYes
Firehose StreamsfirehoseFirehoseStreamYes
Lex BotslexLexBotYes
WAF Web ACLswafWafWebAclYes
MSK (Kafka)mskMskClusterYes
EBS VolumesebsEbsVolumeYes
VPC Topologyvpc_topologyVpc, Network, Subnet, VRouter, RoutingTable, NatGateway, PeerConnection, VInterface, IpAddress, FloatingIp, AvailabilityZoneInventory only
API Gatewayapi_gatewayApiGatewayApiYes
CloudFrontcloudfrontCloudFrontDistributionYes
Route 53route53Route53HostedZoneYes
DynamoDBdynamodbDynamoDbTableYes
Step Functionsstep_functionsStepFunctionsStateMachineYes
EventBridgeeventbridgeEventBridgeBusYes
RedshiftredshiftRedshiftClusterYes
DocumentDBdocumentdbDocumentDbClusterYes
NeptuneneptuneNeptuneClusterYes
OpenSearchopensearchOpenSearchDomainYes
Transit Gatewaytransit_gatewayTransitGatewayYes
SageMakersagemakerSageMakerEndpointYes
Auto Scaling GroupsasgAutoScalingGroupYes

Browse discovered resources

Discovered AWS resources appear under Infrastructure > Cloud Infrastructure on the Cloud Explorer tab, grouped under the AWS provider.

Cloud Explorer — ECS clusters discovered in AWS

The Resources panel on the left lists the entity kinds produced by the toggles you enabled — the Discovered as column above. Select one to list its resources; the count beside the heading reflects the current filters.

The result table shows the fields that identify a resource — name, account, region, cluster, environment, and status — and the Filters panel below narrows the list by any indexed field, with the match count beside each value. Use the search box at the top to filter the selected resource type by name or field.

Entity kinds from an Inventory only toggle, such as the VPC topology kinds, appear here like any other but have no Metrics tab behind them.

Resource details

Select a resource to open its detail panel beside the list. The header identifies the resource — its provider ID, name, creation time, account, region, environment, and current status — and the arrows step to the next or previous resource without closing the panel.

The panel's tabs depend on what KubeSense has for that resource:

TabContents
MetricsOne chart per metric collected for this resource type, at the configured tier, over the selected time range. Each has a View in Explorer link to open that series in Data Explorer
ProcessesProcesses reported by the host, with PID, CPU, and memory
LogsLog lines correlated to this resource
TracesTraces correlated to this resource
RawThe resource record as KubeSense stores it
MetadataProvider tags and discovered attributes

The charts on the Metrics tab are the metrics listed for that resource type in Metrics by resource type below, at whichever tier the integration is configured for.

ECS container and task metrics

The EcsContainer metrics below are collected at a finer grain than the rest of ECS, and under different conditions. Two things decide whether you see them.

They require Container Insights with enhanced observability. Plain Container Insights is not enough: without the enhanced opt-in (available from December 2024), AWS publishes no container-level series at all, and KubeSense discovers nothing to collect. Enable it on the ECS cluster, not in KubeSense. Nothing needs configuring on the KubeSense side to find them — the collector lists what CloudWatch actually publishes rather than guessing, so a cluster without enhanced observability costs no API calls.

They come at two grains. CloudWatch publishes the same container metrics against several dimension sets, and KubeSense collects them as follows:

GrainCollectedWhat it answers
Per service and containerAlwaysHow one container of a service behaves on average across its tasks
Per task and containerOpt-inHow one individual task behaves — whether a single task is hot while its peers are idle

The per-service grain is the default because its series count is fixed by the number of container definitions. The per-task grain is opt-in because its series count follows the number of running tasks, which changes on every deploy: each new task is a new series, and each is billed per metric on every collection cycle. Turn it on for the services where one task diverging from its peers is a real failure mode, not across an estate.

To enable it, add per_task to the ECS metric extras on the integration. Per-cluster collection is capped, and the cap is reported in the controller logs if a cluster exceeds it.

Where these appear: Container metrics are shown on the container itself, not on the service. From a service, open its Tasks tab, select a task, then its Containers tab — the container's Metrics tab carries the CPU, memory, network and storage series listed below. With the per-task grain enabled, each task's containers report their own values; without it, every task of a service shows that service's container average.

Metrics by resource type

Tiers are set per resource type on the integration: Core is the default, and Expanded is a superset adding deeper per-service detail. A metric that depends on an optional provider feature — Enhanced Monitoring on RDS, Container Insights on ECS and EKS, Atlas Search, the Prometheus plugin on Kong — returns nothing until that feature is enabled, and KubeSense simply records nothing for it.

ALB target group

Resource type LoadBalancerTargetGroup — 10 metrics.

MetricNamespaceDimensionStatisticUnitTier
HealthyHostCountAWS/ApplicationELBTargetGroupAverageCountCore
UnHealthyHostCountAWS/ApplicationELBTargetGroupAverageCountCore
RequestCountPerTargetAWS/ApplicationELBTargetGroupSumCountCore
HTTPCode_Target_2XX_CountAWS/ApplicationELBTargetGroupSumCountExpanded
HTTPCode_Target_3XX_CountAWS/ApplicationELBTargetGroupSumCountExpanded
HTTPCode_Target_4XX_CountAWS/ApplicationELBTargetGroupSumCountExpanded
HTTPCode_Target_5XX_CountAWS/ApplicationELBTargetGroupSumCountExpanded
TargetResponseTimeAWS/ApplicationELBTargetGroupAverageSecondsExpanded
TargetConnectionErrorCountAWS/ApplicationELBTargetGroupSumCountExpanded
TargetTLSNegotiationErrorCountAWS/ApplicationELBTargetGroupSumCountExpanded

API Gateway HTTP API

Resource type ApiGatewayHttpApi — 6 metrics.

MetricNamespaceDimensionStatisticUnitTier
CountAWS/ApiGatewayApiIdSumCountCore
4xxAWS/ApiGatewayApiIdSumCountCore
5xxAWS/ApiGatewayApiIdSumCountCore
LatencyAWS/ApiGatewayApiIdAverageMillisecondsCore
IntegrationLatencyAWS/ApiGatewayApiIdAverageMillisecondsExpanded
DataProcessedAWS/ApiGatewayApiIdSumBytesExpanded

API Gateway REST API

Resource type ApiGatewayApi — 7 metrics.

MetricNamespaceDimensionStatisticUnitTier
CountAWS/ApiGatewayApiNameSumCountCore
4XXErrorAWS/ApiGatewayApiNameSumCountCore
5XXErrorAWS/ApiGatewayApiNameSumCountCore
LatencyAWS/ApiGatewayApiNameAverageMillisecondsCore
IntegrationLatencyAWS/ApiGatewayApiNameAverageMillisecondsCore
CacheHitCountAWS/ApiGatewayApiNameSumCountExpanded
CacheMissCountAWS/ApiGatewayApiNameSumCountExpanded

API Gateway WebSocket API

Resource type ApiGatewayWsApi — 7 metrics.

MetricNamespaceDimensionStatisticUnitTier
ConnectCountAWS/ApiGatewayApiIdSumCountCore
MessageCountAWS/ApiGatewayApiIdSumCountCore
ClientErrorAWS/ApiGatewayApiIdSumCountCore
ExecutionErrorAWS/ApiGatewayApiIdSumCountCore
IntegrationErrorAWS/ApiGatewayApiIdSumCountCore
IntegrationLatencyAWS/ApiGatewayApiIdAverageMillisecondsExpanded
DataProcessedAWS/ApiGatewayApiIdSumBytesExpanded

Application Load Balancer

Resource type LoadBalancer — 21 metrics.

MetricNamespaceDimensionStatisticUnitTier
RequestCountAWS/ApplicationELBLoadBalancerSumCountCore
TargetResponseTimeAWS/ApplicationELBLoadBalancerAverageSecondsCore
HTTPCode_Target_4XX_CountAWS/ApplicationELBLoadBalancerSumCountCore
HTTPCode_Target_5XX_CountAWS/ApplicationELBLoadBalancerSumCountCore
ActiveConnectionCountAWS/ApplicationELBLoadBalancerSumCountExpanded
NewConnectionCountAWS/ApplicationELBLoadBalancerSumCountExpanded
RejectedConnectionCountAWS/ApplicationELBLoadBalancerSumCountExpanded
ProcessedBytesAWS/ApplicationELBLoadBalancerSumBytesExpanded
HTTPCode_ELB_4XX_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
HTTPCode_ELB_5XX_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
HTTPCode_ELB_502_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
HTTPCode_ELB_503_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
HTTPCode_ELB_504_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
TargetConnectionErrorCountAWS/ApplicationELBLoadBalancerSumCountExpanded
TargetTLSNegotiationErrorCountAWS/ApplicationELBLoadBalancerSumCountExpanded
ClientTLSNegotiationErrorCountAWS/ApplicationELBLoadBalancerSumCountExpanded
ConsumedLCUsAWS/ApplicationELBLoadBalancerAverageCountExpanded
HTTPCode_Target_2XX_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
HTTPCode_Target_3XX_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
HTTP_Redirect_CountAWS/ApplicationELBLoadBalancerSumCountExpanded
HTTP_Fixed_Response_CountAWS/ApplicationELBLoadBalancerSumCountExpanded

Auto Scaling group

Resource type AutoScalingGroup — 13 metrics.

MetricNamespaceDimensionStatisticUnitTier
GroupMinSizeAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupMaxSizeAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupDesiredCapacityAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupInServiceInstancesAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupPendingInstancesAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupStandbyInstancesAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupTerminatingInstancesAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupTotalInstancesAWS/AutoScalingAutoScalingGroupNameAverageCountCore
GroupInServiceCapacityAWS/AutoScalingAutoScalingGroupNameAverageCountExpanded
GroupPendingCapacityAWS/AutoScalingAutoScalingGroupNameAverageCountExpanded
GroupStandbyCapacityAWS/AutoScalingAutoScalingGroupNameAverageCountExpanded
GroupTerminatingCapacityAWS/AutoScalingAutoScalingGroupNameAverageCountExpanded
GroupTotalCapacityAWS/AutoScalingAutoScalingGroupNameAverageCountExpanded

Classic Load Balancer

Resource type ClassicLoadBalancer — 13 metrics.

MetricNamespaceDimensionStatisticUnitTier
RequestCountAWS/ELBLoadBalancerNameSumCountCore
LatencyAWS/ELBLoadBalancerNameAverageSecondsCore
HTTPCode_ELB_5XXAWS/ELBLoadBalancerNameSumCountCore
HTTPCode_Backend_5XXAWS/ELBLoadBalancerNameSumCountCore
HealthyHostCountAWS/ELBLoadBalancerNameAverageCountCore
UnHealthyHostCountAWS/ELBLoadBalancerNameAverageCountCore
HTTPCode_ELB_4XXAWS/ELBLoadBalancerNameSumCountExpanded
HTTPCode_Backend_2XXAWS/ELBLoadBalancerNameSumCountExpanded
HTTPCode_Backend_3XXAWS/ELBLoadBalancerNameSumCountExpanded
HTTPCode_Backend_4XXAWS/ELBLoadBalancerNameSumCountExpanded
SurgeQueueLengthAWS/ELBLoadBalancerNameMaximumCountExpanded
SpilloverCountAWS/ELBLoadBalancerNameSumCountExpanded
BackendConnectionErrorsAWS/ELBLoadBalancerNameSumCountExpanded

CloudFront distribution

Resource type CloudFrontDistribution — 14 metrics.

MetricNamespaceDimensionStatisticUnitTier
RequestsAWS/CloudFrontDistributionIdSumCountCore
BytesDownloadedAWS/CloudFrontDistributionIdSumBytesCore
BytesUploadedAWS/CloudFrontDistributionIdSumBytesCore
4xxErrorRateAWS/CloudFrontDistributionIdAveragePercentCore
5xxErrorRateAWS/CloudFrontDistributionIdAveragePercentCore
TotalErrorRateAWS/CloudFrontDistributionIdAveragePercentCore
401ErrorRateAWS/CloudFrontDistributionIdAveragePercentExpanded
403ErrorRateAWS/CloudFrontDistributionIdAveragePercentExpanded
404ErrorRateAWS/CloudFrontDistributionIdAveragePercentExpanded
502ErrorRateAWS/CloudFrontDistributionIdAveragePercentExpanded
503ErrorRateAWS/CloudFrontDistributionIdAveragePercentExpanded
504ErrorRateAWS/CloudFrontDistributionIdAveragePercentExpanded
OriginLatencyAWS/CloudFrontDistributionIdAverageMillisecondsExpanded
CacheHitRateAWS/CloudFrontDistributionIdAveragePercentExpanded

Data Firehose stream

Resource type FirehoseStream — 20 metrics.

MetricNamespaceDimensionStatisticUnitTier
IncomingRecordsAWS/FirehoseDeliveryStreamNameSumCountCore
IncomingBytesAWS/FirehoseDeliveryStreamNameSumBytesCore
DeliveryToS3.RecordsAWS/FirehoseDeliveryStreamNameSumCountCore
DeliveryToS3.SuccessAWS/FirehoseDeliveryStreamNameAveragePercentCore
DeliveryToS3.BytesAWS/FirehoseDeliveryStreamNameSumBytesExpanded
DeliveryToS3.DataFreshnessAWS/FirehoseDeliveryStreamNameAverageSecondsExpanded
DescribeDeliveryStream.LatencyAWS/FirehoseDeliveryStreamNameAverageMillisecondsExpanded
PutRecord.BytesAWS/FirehoseDeliveryStreamNameSumBytesExpanded
PutRecord.LatencyAWS/FirehoseDeliveryStreamNameAverageMillisecondsExpanded
PutRecord.RequestsAWS/FirehoseDeliveryStreamNameSumCountExpanded
ThrottledRecordsAWS/FirehoseDeliveryStreamNameSumCountExpanded
PutRecordBatch.BytesAWS/FirehoseDeliveryStreamNameSumBytesExpanded
PutRecordBatch.RecordsAWS/FirehoseDeliveryStreamNameSumCountExpanded
PutRecordBatch.LatencyAWS/FirehoseDeliveryStreamNameAverageMillisecondsExpanded
PutRecordBatch.RequestsAWS/FirehoseDeliveryStreamNameSumCountExpanded
BytesPerSecondLimitAWS/FirehoseDeliveryStreamNameAverageBytes/SecondExpanded
RecordsPerSecondLimitAWS/FirehoseDeliveryStreamNameAverageCount/SecondExpanded
PutRequestsPerSecondLimitAWS/FirehoseDeliveryStreamNameAverageCount/SecondExpanded
KMSKeyAccessDeniedAWS/FirehoseDeliveryStreamNameSumCountExpanded
KMSKeyNotFoundAWS/FirehoseDeliveryStreamNameSumCountExpanded

DocumentDB cluster

Resource type DocumentDbCluster — 24 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/DocDBDBClusterIdentifierAveragePercentCore
DatabaseConnectionsAWS/DocDBDBClusterIdentifierAverageCountCore
FreeableMemoryAWS/DocDBDBClusterIdentifierAverageBytesCore
VolumeBytesUsedAWS/DocDBDBClusterIdentifierAverageBytesCore
ReadIOPSAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
WriteIOPSAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
ReadLatencyAWS/DocDBDBClusterIdentifierAverageMillisecondsExpanded
WriteLatencyAWS/DocDBDBClusterIdentifierAverageMillisecondsExpanded
ReadThroughputAWS/DocDBDBClusterIdentifierAverageBytes/SecondExpanded
WriteThroughputAWS/DocDBDBClusterIdentifierAverageBytes/SecondExpanded
DBClusterReplicaLagMaximumAWS/DocDBDBClusterIdentifierMaximumMillisecondsExpanded
BufferCacheHitRatioAWS/DocDBDBClusterIdentifierAveragePercentExpanded
BackupRetentionPeriodStorageUsedAWS/DocDBDBClusterIdentifierAverageBytesExpanded
TotalBackupStorageBilledAWS/DocDBDBClusterIdentifierAverageBytesExpanded
OpcountersInsertAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
OpcountersQueryAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
OpcountersUpdateAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
OpcountersDeleteAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
DocumentsInsertedAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
DocumentsReturnedAWS/DocDBDBClusterIdentifierAverageCount/SecondExpanded
NetworkThroughputAWS/DocDBDBClusterIdentifierAverageBytes/SecondExpanded
VolumeReadIOPsAWS/DocDBDBClusterIdentifierAverageCountExpanded
VolumeWriteIOPsAWS/DocDBDBClusterIdentifierAverageCountExpanded
DiskQueueDepthAWS/DocDBDBClusterIdentifierAverageCountExpanded

DynamoDB table

Resource type DynamoDbTable — 11 metrics.

MetricNamespaceDimensionStatisticUnitTier
ConsumedReadCapacityUnitsAWS/DynamoDBTableNameSumCountCore
ConsumedWriteCapacityUnitsAWS/DynamoDBTableNameSumCountCore
ThrottledRequestsAWS/DynamoDBTableNameSumCountCore
ProvisionedReadCapacityUnitsAWS/DynamoDBTableNameAverageCountExpanded
ProvisionedWriteCapacityUnitsAWS/DynamoDBTableNameAverageCountExpanded
ReadThrottleEventsAWS/DynamoDBTableNameSumCountExpanded
WriteThrottleEventsAWS/DynamoDBTableNameSumCountExpanded
ConditionalCheckFailedRequestsAWS/DynamoDBTableNameSumCountExpanded
TransactionConflictAWS/DynamoDBTableNameSumCountExpanded
AgeOfOldestUnreplicatedRecordAWS/DynamoDBTableNameMaximumMillisecondsExpanded
TimeToLiveDeletedItemCountAWS/DynamoDBTableNameSumCountExpanded

DynamoDB table (per operation)

Resource type DynamoDbTableOperation — 3 metrics.

MetricNamespaceDimensionStatisticUnitTier
SuccessfulRequestLatencyAWS/DynamoDBTableNameAverageMillisecondsCore
SystemErrorsAWS/DynamoDBTableNameSumCountCore
ReturnedItemCountAWS/DynamoDBTableNameSumCountCore

EBS volume

Resource type EbsVolume — 11 metrics.

MetricNamespaceDimensionStatisticUnitTier
VolumeReadBytesAWS/EBSVolumeIdSumBytesCore
VolumeWriteBytesAWS/EBSVolumeIdSumBytesCore
VolumeReadOpsAWS/EBSVolumeIdSumCountCore
VolumeWriteOpsAWS/EBSVolumeIdSumCountCore
VolumeQueueLengthAWS/EBSVolumeIdAverageCountExpanded
VolumeIdleTimeAWS/EBSVolumeIdSumSecondsExpanded
VolumeTotalReadTimeAWS/EBSVolumeIdSumSecondsExpanded
VolumeTotalWriteTimeAWS/EBSVolumeIdSumSecondsExpanded
BurstBalanceAWS/EBSVolumeIdAveragePercentExpanded
VolumeConsumedReadWriteOpsAWS/EBSVolumeIdSumCountExpanded
VolumeThroughputPercentageAWS/EBSVolumeIdAveragePercentExpanded

EBS volume (Nitro instances)

Resource type EbsVolumeNitro — 7 metrics.

MetricNamespaceDimensionStatisticUnitTier
VolumeAvgReadLatencyAWS/EBSVolumeIdAverageMicrosecondsCore
VolumeAvgWriteLatencyAWS/EBSVolumeIdAverageMicrosecondsCore
VolumeAvgIOPSAWS/EBSVolumeIdAverageCount/SecondCore
VolumeAvgThroughputAWS/EBSVolumeIdAverageBytes/SecondCore
VolumeIOPSExceededCheckAWS/EBSVolumeIdMaximumCountCore
VolumeThroughputExceededCheckAWS/EBSVolumeIdMaximumCountCore
VolumeStalledIOCheckAWS/EBSVolumeIdMaximumCountCore

EC2 instance

Resource type Ec2Instance — 22 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/EC2InstanceIdAveragePercentCore
NetworkInAWS/EC2InstanceIdSumBytesCore
NetworkOutAWS/EC2InstanceIdSumBytesCore
DiskReadBytesAWS/EC2InstanceIdSumBytesCore
DiskWriteBytesAWS/EC2InstanceIdSumBytesCore
StatusCheckFailedAWS/EC2InstanceIdMaximumCountExpanded
StatusCheckFailed_InstanceAWS/EC2InstanceIdMaximumCountExpanded
StatusCheckFailed_SystemAWS/EC2InstanceIdMaximumCountExpanded
NetworkPacketsInAWS/EC2InstanceIdSumCountExpanded
NetworkPacketsOutAWS/EC2InstanceIdSumCountExpanded
DiskReadOpsAWS/EC2InstanceIdSumCountExpanded
DiskWriteOpsAWS/EC2InstanceIdSumCountExpanded
EBSReadBytesAWS/EC2InstanceIdSumBytesExpanded
EBSWriteBytesAWS/EC2InstanceIdSumBytesExpanded
EBSReadOpsAWS/EC2InstanceIdSumCountExpanded
EBSWriteOpsAWS/EC2InstanceIdSumCountExpanded
EBSIOBalance%AWS/EC2InstanceIdAveragePercentExpanded
EBSByteBalance%AWS/EC2InstanceIdAveragePercentExpanded
CPUCreditUsageAWS/EC2InstanceIdAverageCountExpanded
CPUCreditBalanceAWS/EC2InstanceIdAverageCountExpanded
CPUSurplusCreditBalanceAWS/EC2InstanceIdAverageCountExpanded
CPUSurplusCreditsChargedAWS/EC2InstanceIdAverageCountExpanded

ECS cluster

Resource type EcsCluster — 14 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/ECSClusterNameAveragePercentCore
MemoryUtilizationAWS/ECSClusterNameAveragePercentCore
ContainerInstanceCountECS/ContainerInsightsClusterNameAverageCountCore
TaskCountECS/ContainerInsightsClusterNameAverageCountCore
ServiceCountECS/ContainerInsightsClusterNameAverageCountCore
CPUReservationAWS/ECSClusterNameAveragePercentExpanded
MemoryReservationAWS/ECSClusterNameAveragePercentExpanded
CpuUtilizedECS/ContainerInsightsClusterNameAverageCountExpanded
MemoryUtilizedECS/ContainerInsightsClusterNameAverageMegabytesExpanded
NetworkRxBytesECS/ContainerInsightsClusterNameSumBytesExpanded
NetworkTxBytesECS/ContainerInsightsClusterNameSumBytesExpanded
CpuReservedECS/ContainerInsightsClusterNameAverageCountExpanded
MemoryReservedECS/ContainerInsightsClusterNameAverageMegabytesExpanded
EphemeralStorageReservedECS/ContainerInsightsClusterNameAverageGigabytesExpanded

ECS container

Resource type EcsContainer — 10 metrics.

MetricNamespaceDimensionStatisticUnitTier
ContainerCpuUtilizationECS/ContainerInsightsContainerNameAveragePercentCore
ContainerMemoryUtilizationECS/ContainerInsightsContainerNameAveragePercentCore
ContainerCpuUtilizedECS/ContainerInsightsContainerNameAverageCountCore
ContainerMemoryUtilizedECS/ContainerInsightsContainerNameAverageMegabytesCore
ContainerNetworkRxBytesECS/ContainerInsightsContainerNameSumBytesCore
ContainerNetworkTxBytesECS/ContainerInsightsContainerNameSumBytesCore
ContainerStorageReadBytesECS/ContainerInsightsContainerNameSumBytesCore
ContainerStorageWriteBytesECS/ContainerInsightsContainerNameSumBytesCore
RestartCountECS/ContainerInsightsContainerNameSumCountCore
UnHealthyContainerHealthStatusECS/ContainerInsightsContainerNameMaximumCountCore

ECS service

Resource type EcsService — 15 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/ECSServiceNameAveragePercentCore
MemoryUtilizationAWS/ECSServiceNameAveragePercentCore
DesiredTaskCountECS/ContainerInsightsServiceNameAverageCountExpanded
PendingTaskCountECS/ContainerInsightsServiceNameAverageCountExpanded
RunningTaskCountECS/ContainerInsightsServiceNameAverageCountExpanded
StorageReadBytesECS/ContainerInsightsServiceNameSumBytesExpanded
StorageWriteBytesECS/ContainerInsightsServiceNameSumBytesExpanded
DeploymentCountECS/ContainerInsightsServiceNameAverageCountExpanded
CpuUtilizedECS/ContainerInsightsServiceNameAverageCountExpanded
MemoryUtilizedECS/ContainerInsightsServiceNameAverageMegabytesExpanded
NetworkRxBytesECS/ContainerInsightsServiceNameSumBytesExpanded
NetworkTxBytesECS/ContainerInsightsServiceNameSumBytesExpanded
CpuReservedECS/ContainerInsightsServiceNameAverageCountExpanded
MemoryReservedECS/ContainerInsightsServiceNameAverageMegabytesExpanded
TaskSetCountECS/ContainerInsightsServiceNameAverageCountExpanded

ECS task definition

Resource type EcsTaskDefinition — 5 metrics.

MetricNamespaceDimensionStatisticUnitTier
CpuUtilizedECS/ContainerInsightsTaskDefinitionFamilyAverageCountCore
MemoryUtilizedECS/ContainerInsightsTaskDefinitionFamilyAverageMegabytesCore
EphemeralStorageUtilizedECS/ContainerInsightsTaskDefinitionFamilyAverageGigabytesExpanded
CpuReservedECS/ContainerInsightsTaskDefinitionFamilyAverageCountExpanded
MemoryReservedECS/ContainerInsightsTaskDefinitionFamilyAverageMegabytesExpanded

EKS cluster

Resource type EksCluster — 11 metrics.

MetricNamespaceDimensionStatisticUnitTier
cluster_node_countContainerInsightsClusterNameAverageCountCore
cluster_failed_node_countContainerInsightsClusterNameAverageCountCore
pod_cpu_utilizationContainerInsightsClusterNameAveragePercentCore
pod_memory_utilizationContainerInsightsClusterNameAveragePercentCore
node_cpu_utilizationContainerInsightsClusterNameAveragePercentExpanded
node_memory_utilizationContainerInsightsClusterNameAveragePercentExpanded
node_filesystem_utilizationContainerInsightsClusterNameAveragePercentExpanded
node_network_total_bytesContainerInsightsClusterNameSumBytesExpanded
pod_number_of_running_containersContainerInsightsClusterNameAverageCountExpanded
service_number_of_running_podsContainerInsightsClusterNameAverageCountExpanded
namespace_number_of_running_podsContainerInsightsClusterNameAverageCountExpanded

ElastiCache cluster

Resource type ElastiCacheCluster — 19 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/ElastiCacheCacheClusterIdAveragePercentCore
CurrConnectionsAWS/ElastiCacheCacheClusterIdAverageCountCore
CacheHitsAWS/ElastiCacheCacheClusterIdSumCountCore
CacheMissesAWS/ElastiCacheCacheClusterIdSumCountCore
EngineCPUUtilizationAWS/ElastiCacheCacheClusterIdAveragePercentExpanded
DatabaseMemoryUsagePercentageAWS/ElastiCacheCacheClusterIdAveragePercentExpanded
BytesUsedForCacheAWS/ElastiCacheCacheClusterIdAverageBytesExpanded
SwapUsageAWS/ElastiCacheCacheClusterIdAverageBytesExpanded
NetworkBytesInAWS/ElastiCacheCacheClusterIdSumBytesExpanded
NetworkBytesOutAWS/ElastiCacheCacheClusterIdSumBytesExpanded
NewConnectionsAWS/ElastiCacheCacheClusterIdSumCountExpanded
EvictionsAWS/ElastiCacheCacheClusterIdSumCountExpanded
ReclaimedAWS/ElastiCacheCacheClusterIdSumCountExpanded
ReplicationLagAWS/ElastiCacheCacheClusterIdAverageSecondsExpanded
ReplicationBytesAWS/ElastiCacheCacheClusterIdSumBytesExpanded
CurrItemsAWS/ElastiCacheCacheClusterIdAverageCountExpanded
GetTypeCmdsAWS/ElastiCacheCacheClusterIdSumCountExpanded
SetTypeCmdsAWS/ElastiCacheCacheClusterIdSumCountExpanded
KeyBasedCmdsAWS/ElastiCacheCacheClusterIdSumCountExpanded

EventBridge bus

Resource type EventBridgeBus — 12 metrics.

MetricNamespaceDimensionStatisticUnitTier
InvocationsAWS/EventsRuleNameSumCountCore
FailedInvocationsAWS/EventsRuleNameSumCountCore
MatchedEventsAWS/EventsRuleNameSumCountCore
TriggeredRulesAWS/EventsRuleNameSumCountCore
ThrottledRulesAWS/EventsRuleNameSumCountExpanded
InvocationAttemptsAWS/EventsRuleNameSumCountExpanded
SuccessfulInvocationAttemptsAWS/EventsRuleNameSumCountExpanded
DeadLetterInvocationsAWS/EventsRuleNameSumCountExpanded
InvocationsSentToDlqAWS/EventsRuleNameSumCountExpanded
InvocationsFailedToBeSentToDlqAWS/EventsRuleNameSumCountExpanded
IngestionToInvocationCompleteLatencyAWS/EventsRuleNameAverageMillisecondsExpanded
IngestionToInvocationSuccessLatencyAWS/EventsRuleNameAverageMillisecondsExpanded

Kinesis Data Stream

Resource type KinesisStream — 15 metrics.

MetricNamespaceDimensionStatisticUnitTier
GetRecords.IteratorAgeMillisecondsAWS/KinesisStreamNameMaximumMillisecondsCore
IncomingRecordsAWS/KinesisStreamNameSumCountCore
IncomingBytesAWS/KinesisStreamNameSumBytesCore
GetRecords.BytesAWS/KinesisStreamNameSumBytesExpanded
GetRecords.RecordsAWS/KinesisStreamNameSumCountExpanded
GetRecords.SuccessAWS/KinesisStreamNameAveragePercentExpanded
GetRecords.LatencyAWS/KinesisStreamNameAverageMillisecondsExpanded
PutRecords.BytesAWS/KinesisStreamNameSumBytesExpanded
PutRecords.SuccessfulRecordsAWS/KinesisStreamNameSumCountExpanded
PutRecords.FailedRecordsAWS/KinesisStreamNameSumCountExpanded
PutRecords.ThrottledRecordsAWS/KinesisStreamNameSumCountExpanded
PutRecords.SuccessAWS/KinesisStreamNameAveragePercentExpanded
PutRecords.LatencyAWS/KinesisStreamNameAverageMillisecondsExpanded
ReadProvisionedThroughputExceededAWS/KinesisStreamNameSumCountExpanded
WriteProvisionedThroughputExceededAWS/KinesisStreamNameSumCountExpanded

Lambda function

Resource type LambdaFunction — 18 metrics.

MetricNamespaceDimensionStatisticUnitTier
InvocationsAWS/LambdaFunctionNameSumCountCore
ErrorsAWS/LambdaFunctionNameSumCountCore
DurationAWS/LambdaFunctionNameAverageMillisecondsCore
ThrottlesAWS/LambdaFunctionNameSumCountCore
ConcurrentExecutionsAWS/LambdaFunctionNameMaximumCountExpanded
ProvisionedConcurrentExecutionsAWS/LambdaFunctionNameMaximumCountExpanded
ProvisionedConcurrencyInvocationsAWS/LambdaFunctionNameSumCountExpanded
ProvisionedConcurrencySpilloverInvocationsAWS/LambdaFunctionNameSumCountExpanded
ProvisionedConcurrencyUtilizationAWS/LambdaFunctionNameAveragePercentExpanded
DeadLetterErrorsAWS/LambdaFunctionNameSumCountExpanded
DestinationDeliveryFailuresAWS/LambdaFunctionNameSumCountExpanded
IteratorAgeAWS/LambdaFunctionNameMaximumMillisecondsExpanded
OffsetLagAWS/LambdaFunctionNameMaximumCountExpanded
AsyncEventsReceivedAWS/LambdaFunctionNameSumCountExpanded
AsyncEventAgeAWS/LambdaFunctionNameMaximumMillisecondsExpanded
AsyncEventsDroppedAWS/LambdaFunctionNameSumCountExpanded
PostRuntimeExtensionsDurationAWS/LambdaFunctionNameAverageMillisecondsExpanded
RecursiveInvocationsDroppedAWS/LambdaFunctionNameSumCountExpanded

MSK broker

Resource type MskBroker — 21 metrics.

MetricNamespaceDimensionStatisticUnitTier
CpuUserAWS/KafkaBroker IDAveragePercentCore
CpuSystemAWS/KafkaBroker IDAveragePercentCore
CpuIdleAWS/KafkaBroker IDAveragePercentCore
MemoryUsedAWS/KafkaBroker IDAverageBytesCore
KafkaDataLogsDiskUsedAWS/KafkaBroker IDAveragePercentCore
BytesInPerSecAWS/KafkaBroker IDAverageBytes/SecondCore
BytesOutPerSecAWS/KafkaBroker IDAverageBytes/SecondCore
MessagesInPerSecAWS/KafkaBroker IDAverageCount/SecondCore
ConnectionCountAWS/KafkaBroker IDAverageCountCore
UnderReplicatedPartitionsAWS/KafkaBroker IDSumCountCore
CpuIoWaitAWS/KafkaBroker IDAveragePercentExpanded
MemoryFreeAWS/KafkaBroker IDAverageBytesExpanded
HeapMemoryAfterGCAWS/KafkaBroker IDAveragePercentExpanded
KafkaAppLogsDiskUsedAWS/KafkaBroker IDAveragePercentExpanded
RootDiskUsedAWS/KafkaBroker IDAveragePercentExpanded
LeaderCountAWS/KafkaBroker IDSumCountExpanded
PartitionCountAWS/KafkaBroker IDSumCountExpanded
UnderMinIsrPartitionCountAWS/KafkaBroker IDSumCountExpanded
ZooKeeperRequestLatencyMsMeanAWS/KafkaBroker IDAverageMillisecondsExpanded
NetworkRxPacketsAWS/KafkaBroker IDSumCountExpanded
NetworkTxPacketsAWS/KafkaBroker IDSumCountExpanded

MSK cluster

Resource type MskCluster — 4 metrics.

MetricNamespaceDimensionStatisticUnitTier
ActiveControllerCountAWS/KafkaCluster NameSumCountCore
OfflinePartitionsCountAWS/KafkaCluster NameSumCountCore
GlobalPartitionCountAWS/KafkaCluster NameSumCountCore
GlobalTopicCountAWS/KafkaCluster NameSumCountCore

Neptune cluster

Resource type NeptuneCluster — 15 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/NeptuneDBClusterIdentifierAveragePercentCore
GremlinWebSocketOpenConnectionsAWS/NeptuneDBClusterIdentifierSumCountCore
FreeableMemoryAWS/NeptuneDBClusterIdentifierAverageBytesCore
GremlinRequestsPerSecAWS/NeptuneDBClusterIdentifierSumCountCore
SparqlRequestsPerSecAWS/NeptuneDBClusterIdentifierSumCountExpanded
OpenCypherRequestsPerSecAWS/NeptuneDBClusterIdentifierSumCountExpanded
MainRequestQueuePendingRequestsAWS/NeptuneDBClusterIdentifierAverageCountExpanded
BackupRetentionPeriodStorageUsedAWS/NeptuneDBClusterIdentifierAverageBytesExpanded
TotalBackupStorageBilledAWS/NeptuneDBClusterIdentifierAverageBytesExpanded
ClusterReplicaLagAWS/NeptuneDBClusterIdentifierAverageMillisecondsExpanded
ClusterReplicaLagMaximumAWS/NeptuneDBClusterIdentifierMaximumMillisecondsExpanded
BufferCacheHitRatioAWS/NeptuneDBClusterIdentifierAveragePercentExpanded
OpenCypherBoltOpenConnectionsAWS/NeptuneDBClusterIdentifierSumCountExpanded
GremlinServerErrorsPerSecAWS/NeptuneDBClusterIdentifierAverageCount/SecondExpanded
TotalServerErrorsPerSecAWS/NeptuneDBClusterIdentifierAverageCount/SecondExpanded

Network Load Balancer

Resource type NetworkLoadBalancer — 11 metrics.

MetricNamespaceDimensionStatisticUnitTier
ActiveFlowCountAWS/NetworkELBLoadBalancerAverageCountCore
NewFlowCountAWS/NetworkELBLoadBalancerSumCountCore
ProcessedBytesAWS/NetworkELBLoadBalancerSumBytesCore
TCP_ELB_Reset_CountAWS/NetworkELBLoadBalancerSumCountCore
TCP_Target_Reset_CountAWS/NetworkELBLoadBalancerSumCountCore
TCP_Client_Reset_CountAWS/NetworkELBLoadBalancerSumCountExpanded
ConsumedLCUsAWS/NetworkELBLoadBalancerAverageCountExpanded
PeakBytesPerSecondAWS/NetworkELBLoadBalancerMaximumBytes/SecondExpanded
PeakPacketsPerSecondAWS/NetworkELBLoadBalancerMaximumCount/SecondExpanded
PortAllocationErrorCountAWS/NetworkELBLoadBalancerSumCountExpanded
ProcessedPacketsAWS/NetworkELBLoadBalancerSumCountExpanded

NLB target group

Resource type NetworkLoadBalancerTargetGroup — 2 metrics.

MetricNamespaceDimensionStatisticUnitTier
HealthyHostCountAWS/NetworkELBTargetGroupAverageCountCore
UnHealthyHostCountAWS/NetworkELBTargetGroupAverageCountCore

OpenSearch domain

Resource type OpenSearchDomain — 36 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/ESDomainNameAveragePercentCore
JVMMemoryPressureAWS/ESDomainNameAveragePercentCore
ClusterStatus.redAWS/ESDomainNameMaximumCountCore
ClusterStatus.yellowAWS/ESDomainNameMaximumCountCore
SearchLatencyAWS/ESDomainNameAverageMillisecondsCore
IndexingLatencyAWS/ESDomainNameAverageMillisecondsCore
SearchRateAWS/ESDomainNameSumCountExpanded
IndexingRateAWS/ESDomainNameSumCountExpanded
SearchableDocumentsAWS/ESDomainNameAverageCountExpanded
DeletedDocumentsAWS/ESDomainNameAverageCountExpanded
FreeStorageSpaceAWS/ESDomainNameAverageMegabytesExpanded
ClusterUsedSpaceAWS/ESDomainNameAverageMegabytesExpanded
NodesAWS/ESDomainNameAverageCountExpanded
MasterCPUUtilizationAWS/ESDomainNameAveragePercentExpanded
MasterJVMMemoryPressureAWS/ESDomainNameAveragePercentExpanded
MasterReachableFromNodeAWS/ESDomainNameMaximumCountExpanded
AutomatedSnapshotFailureAWS/ESDomainNameMaximumCountExpanded
ThreadpoolSearchQueueAWS/ESDomainNameAverageCountExpanded
ThreadpoolWriteQueueAWS/ESDomainNameAverageCountExpanded
ThreadpoolSearchRejectedAWS/ESDomainNameSumCountExpanded
ThreadpoolWriteRejectedAWS/ESDomainNameSumCountExpanded
ClusterIndexWritesBlockedAWS/ESDomainNameMaximumCountExpanded
ClusterStatus.greenAWS/ESDomainNameMaximumCountExpanded
Shards.activeAWS/ESDomainNameAverageCountExpanded
Shards.unassignedAWS/ESDomainNameAverageCountExpanded
5xxAWS/ESDomainNameSumCountExpanded
JVMGCYoungCollectionCountAWS/ESDomainNameSumCountExpanded
JVMGCYoungCollectionTimeAWS/ESDomainNameAverageMillisecondsExpanded
JVMGCOldCollectionCountAWS/ESDomainNameSumCountExpanded
JVMGCOldCollectionTimeAWS/ESDomainNameAverageMillisecondsExpanded
OldGenJVMMemoryPressureAWS/ESDomainNameAveragePercentExpanded
CoordinatingWriteRejectedAWS/ESDomainNameSumCountExpanded
PrimaryWriteRejectedAWS/ESDomainNameSumCountExpanded
ReplicaWriteRejectedAWS/ESDomainNameSumCountExpanded
KMSKeyErrorAWS/ESDomainNameMaximumCountExpanded
KMSKeyInaccessibleAWS/ESDomainNameMaximumCountExpanded

RDS / Aurora cluster

Resource type RdsCluster — 3 metrics.

MetricNamespaceDimensionStatisticUnitTier
VolumeBytesUsedAWS/RDSDBClusterIdentifierAverageBytesCore
VolumeReadIOPsAWS/RDSDBClusterIdentifierAverageCountCore
VolumeWriteIOPsAWS/RDSDBClusterIdentifierAverageCountCore

RDS instance

Resource type RdsInstance — 52 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/RDSDBInstanceIdentifierAveragePercentCore
FreeStorageSpaceAWS/RDSDBInstanceIdentifierAverageBytesCore
DatabaseConnectionsAWS/RDSDBInstanceIdentifierAverageCountCore
FreeableMemoryAWS/RDSDBInstanceIdentifierAverageBytesCore
ReadIOPSAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
WriteIOPSAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
ReadLatencyAWS/RDSDBInstanceIdentifierAverageSecondsExpanded
WriteLatencyAWS/RDSDBInstanceIdentifierAverageSecondsExpanded
ReadThroughputAWS/RDSDBInstanceIdentifierAverageBytes/SecondExpanded
WriteThroughputAWS/RDSDBInstanceIdentifierAverageBytes/SecondExpanded
DiskQueueDepthAWS/RDSDBInstanceIdentifierAverageCountExpanded
NetworkReceiveThroughputAWS/RDSDBInstanceIdentifierAverageBytes/SecondExpanded
NetworkTransmitThroughputAWS/RDSDBInstanceIdentifierAverageBytes/SecondExpanded
ReplicaLagAWS/RDSDBInstanceIdentifierAverageSecondsExpanded
AuroraReplicaLagAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
SwapUsageAWS/RDSDBInstanceIdentifierAverageBytesExpanded
DeadlocksAWS/RDSDBInstanceIdentifierSumCount/SecondExpanded
BurstBalanceAWS/RDSDBInstanceIdentifierAveragePercentExpanded
BinLogDiskUsageAWS/RDSDBInstanceIdentifierAverageBytesExpanded
DBLoadAWS/RDSDBInstanceIdentifierAverageCountExpanded
DBLoadCPUAWS/RDSDBInstanceIdentifierAverageCountExpanded
DBLoadNonCPUAWS/RDSDBInstanceIdentifierAverageCountExpanded
EBSByteBalance%AWS/RDSDBInstanceIdentifierAveragePercentExpanded
EBSIOBalance%AWS/RDSDBInstanceIdentifierAveragePercentExpanded
MaximumUsedTransactionIDsAWS/RDSDBInstanceIdentifierAverageCountExpanded
CPUCreditUsageAWS/RDSDBInstanceIdentifierAverageCountExpanded
CPUCreditBalanceAWS/RDSDBInstanceIdentifierAverageCountExpanded
TransactionLogsDiskUsageAWS/RDSDBInstanceIdentifierAverageBytesExpanded
TransactionLogsGenerationAWS/RDSDBInstanceIdentifierAverageBytes/SecondExpanded
ReplicationSlotDiskUsageAWS/RDSDBInstanceIdentifierAverageBytesExpanded
OldestReplicationSlotLagAWS/RDSDBInstanceIdentifierAverageBytesExpanded
EngineUptimeAWS/RDSDBInstanceIdentifierAverageSecondsExpanded
FreeLocalStorageAWS/RDSDBInstanceIdentifierAverageBytesExpanded
BufferCacheHitRatioAWS/RDSDBInstanceIdentifierAveragePercentExpanded
CheckpointLagAWS/RDSDBInstanceIdentifierAverageSecondsExpanded
AuroraReplicaLagMaximumAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
AuroraReplicaLagMinimumAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
CommitLatencyAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
CommitThroughputAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
DDLLatencyAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
DDLThroughputAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
DMLLatencyAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
DMLThroughputAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
SelectLatencyAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
SelectThroughputAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
InsertLatencyAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
InsertThroughputAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
UpdateLatencyAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
UpdateThroughputAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
DeleteLatencyAWS/RDSDBInstanceIdentifierAverageMillisecondsExpanded
DeleteThroughputAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded
QueriesAWS/RDSDBInstanceIdentifierAverageCount/SecondExpanded

Redshift cluster

Resource type RedshiftCluster — 12 metrics.

MetricNamespaceDimensionStatisticUnitTier
CPUUtilizationAWS/RedshiftClusterIdentifierAveragePercentCore
DatabaseConnectionsAWS/RedshiftClusterIdentifierAverageCountCore
HealthStatusAWS/RedshiftClusterIdentifierAverageNoneCore
PercentageDiskSpaceUsedAWS/RedshiftClusterIdentifierAveragePercentCore
NetworkReceiveThroughputAWS/RedshiftClusterIdentifierAverageBytes/SecondExpanded
NetworkTransmitThroughputAWS/RedshiftClusterIdentifierAverageBytes/SecondExpanded
ReadThroughputAWS/RedshiftClusterIdentifierAverageBytes/SecondExpanded
WriteThroughputAWS/RedshiftClusterIdentifierAverageBytes/SecondExpanded
ReadLatencyAWS/RedshiftClusterIdentifierAverageSecondsExpanded
WriteLatencyAWS/RedshiftClusterIdentifierAverageSecondsExpanded
CommitQueueLengthAWS/RedshiftClusterIdentifierAverageCountExpanded
MaintenanceModeAWS/RedshiftClusterIdentifierMaximumCountExpanded

Redshift cluster (query latency)

Resource type RedshiftClusterLatency — 2 metrics.

MetricNamespaceDimensionStatisticUnitTier
QueriesCompletedPerSecondAWS/RedshiftClusterIdentifierAverageCount/SecondExpanded
QueryDurationAWS/RedshiftClusterIdentifierAverageMicrosecondsExpanded

Route 53 health check

Resource type Route53HealthCheck — 6 metrics.

MetricNamespaceDimensionStatisticUnitTier
HealthCheckStatusAWS/Route53HealthCheckIdMinimumNoneCore
HealthCheckPercentageHealthyAWS/Route53HealthCheckIdAveragePercentCore
ConnectionTimeAWS/Route53HealthCheckIdAverageMillisecondsExpanded
TimeToFirstByteAWS/Route53HealthCheckIdAverageMillisecondsExpanded
SSLHandshakeTimeAWS/Route53HealthCheckIdAverageMillisecondsExpanded
ChildHealthCheckHealthyCountAWS/Route53HealthCheckIdAverageCountExpanded

Route 53 hosted zone

Resource type Route53HostedZone — 3 metrics.

MetricNamespaceDimensionStatisticUnitTier
DNSQueriesAWS/Route53HostedZoneIdSumCountCore
DNSSECInternalFailureAWS/Route53HostedZoneIdMaximumCountExpanded
DNSSECKeySigningKeysNeedingActionAWS/Route53HostedZoneIdMaximumCountExpanded

S3 bucket

Resource type S3Bucket — 18 metrics.

MetricNamespaceDimensionStatisticUnitTier
BucketSizeBytesAWS/S3BucketNameAverageBytesCore
NumberOfObjectsAWS/S3BucketNameAverageCountCore
AllRequestsAWS/S3BucketNameSumCountExpanded
GetRequestsAWS/S3BucketNameSumCountExpanded
PutRequestsAWS/S3BucketNameSumCountExpanded
DeleteRequestsAWS/S3BucketNameSumCountExpanded
HeadRequestsAWS/S3BucketNameSumCountExpanded
PostRequestsAWS/S3BucketNameSumCountExpanded
ListRequestsAWS/S3BucketNameSumCountExpanded
SelectRequestsAWS/S3BucketNameSumCountExpanded
FirstByteLatencyAWS/S3BucketNameAverageMillisecondsExpanded
TotalRequestLatencyAWS/S3BucketNameAverageMillisecondsExpanded
BytesDownloadedAWS/S3BucketNameSumBytesExpanded
BytesUploadedAWS/S3BucketNameSumBytesExpanded
4xxErrorsAWS/S3BucketNameSumCountExpanded
5xxErrorsAWS/S3BucketNameSumCountExpanded
SelectBytesScannedAWS/S3BucketNameSumBytesExpanded
SelectBytesReturnedAWS/S3BucketNameSumBytesExpanded

SageMaker endpoint

Resource type SageMakerEndpoint — 14 metrics.

MetricNamespaceDimensionStatisticUnitTier
InvocationsAWS/SageMakerEndpointNameSumCountCore
InvocationsPerInstanceAWS/SageMakerEndpointNameSumCountCore
ModelLatencyAWS/SageMakerEndpointNameAverageMicrosecondsCore
OverheadLatencyAWS/SageMakerEndpointNameAverageMicrosecondsCore
Invocation4XXErrorsAWS/SageMakerEndpointNameSumCountCore
Invocation5XXErrorsAWS/SageMakerEndpointNameSumCountCore
InvocationModelErrorsAWS/SageMakerEndpointNameSumCountCore
CPUUtilization/aws/sagemaker/EndpointsEndpointNameAveragePercentExpanded
MemoryUtilization/aws/sagemaker/EndpointsEndpointNameAveragePercentExpanded
GPUUtilization/aws/sagemaker/EndpointsEndpointNameAveragePercentExpanded
GPUMemoryUtilization/aws/sagemaker/EndpointsEndpointNameAveragePercentExpanded
DiskUtilization/aws/sagemaker/EndpointsEndpointNameAveragePercentExpanded
ModelSetupTimeAWS/SageMakerEndpointNameAverageMicrosecondsExpanded
InvocationsPerCopyAWS/SageMakerEndpointNameSumCountExpanded

SNS topic

Resource type SnsTopic — 9 metrics.

MetricNamespaceDimensionStatisticUnitTier
NumberOfMessagesPublishedAWS/SNSTopicNameSumCountCore
NumberOfNotificationsDeliveredAWS/SNSTopicNameSumCountCore
NumberOfNotificationsFailedAWS/SNSTopicNameSumCountCore
NumberOfNotificationsFilteredOutAWS/SNSTopicNameSumCountExpanded
NumberOfNotificationsFilteredOut-NoMessageAttributesAWS/SNSTopicNameSumCountExpanded
NumberOfNotificationsFilteredOut-InvalidAttributesAWS/SNSTopicNameSumCountExpanded
NumberOfNotificationsRedrivenToDlqAWS/SNSTopicNameSumCountExpanded
NumberOfNotificationsFailedToRedriveToDlqAWS/SNSTopicNameSumCountExpanded
PublishSizeAWS/SNSTopicNameAverageBytesExpanded

SQS queue

Resource type SqsQueue — 9 metrics.

MetricNamespaceDimensionStatisticUnitTier
NumberOfMessagesSentAWS/SQSQueueNameSumCountCore
ApproximateNumberOfMessagesVisibleAWS/SQSQueueNameAverageCountCore
NumberOfMessagesDeletedAWS/SQSQueueNameSumCountCore
ApproximateAgeOfOldestMessageAWS/SQSQueueNameMaximumSecondsExpanded
ApproximateNumberOfMessagesNotVisibleAWS/SQSQueueNameAverageCountExpanded
ApproximateNumberOfMessagesDelayedAWS/SQSQueueNameAverageCountExpanded
NumberOfMessagesReceivedAWS/SQSQueueNameSumCountExpanded
NumberOfEmptyReceivesAWS/SQSQueueNameSumCountExpanded
SentMessageSizeAWS/SQSQueueNameAverageBytesExpanded

Step Functions state machine

Resource type StepFunctionsStateMachine — 7 metrics.

MetricNamespaceDimensionStatisticUnitTier
ExecutionsStartedAWS/StatesStateMachineArnSumCountCore
ExecutionsSucceededAWS/StatesStateMachineArnSumCountCore
ExecutionsFailedAWS/StatesStateMachineArnSumCountCore
ExecutionsTimedOutAWS/StatesStateMachineArnSumCountCore
ExecutionTimeAWS/StatesStateMachineArnAverageMillisecondsCore
ExecutionsAbortedAWS/StatesStateMachineArnSumCountExpanded
ExecutionThrottledAWS/StatesStateMachineArnSumCountExpanded

Transit Gateway

Resource type TransitGateway — 8 metrics.

MetricNamespaceDimensionStatisticUnitTier
BytesInAWS/TransitGatewayTransitGatewaySumBytesCore
BytesOutAWS/TransitGatewayTransitGatewaySumBytesCore
PacketsInAWS/TransitGatewayTransitGatewaySumCountCore
PacketsOutAWS/TransitGatewayTransitGatewaySumCountCore
PacketDropCountBlackholeAWS/TransitGatewayTransitGatewaySumCountCore
PacketDropCountNoRouteAWS/TransitGatewayTransitGatewaySumCountExpanded
BytesDropCountBlackholeAWS/TransitGatewayTransitGatewaySumBytesExpanded
BytesDropCountNoRouteAWS/TransitGatewayTransitGatewaySumBytesExpanded

WAF web ACL

Resource type WafWebAcl — 10 metrics.

MetricNamespaceDimensionStatisticUnitTier
AllowedRequestsAWS/WAFV2WebACLSumCountCore
BlockedRequestsAWS/WAFV2WebACLSumCountCore
CountedRequestsAWS/WAFV2WebACLSumCountCore
PassedRequestsAWS/WAFV2WebACLSumCountCore
RequestsWithValidCaptchaTokenAWS/WAFV2WebACLSumCountExpanded
RequestsWithValidChallengeTokenAWS/WAFV2WebACLSumCountExpanded
CaptchaRequestsAWS/WAFV2WebACLSumCountExpanded
ChallengeRequestsAWS/WAFV2WebACLSumCountExpanded
CaptchasSolvedAWS/WAFV2WebACLSumCountExpanded
ChallengesSolvedAWS/WAFV2WebACLSumCountExpanded

RDS Performance Insights

Resource type PerformanceInsights — 41 metrics.

Collected from Performance Insights rather than CloudWatch, and filtered per instance against the metrics that instance actually publishes. The db.* series follow PostgreSQL vocabulary and vary by engine; the os.* series require Enhanced Monitoring to be enabled on the instance. The aggregate is part of the metric name: .avg is the average over the interval and .max its peak.

MetricUnitTier
db.Transactions.xact_commit.avgCount/SecondCore
db.Transactions.xact_rollback.avgCount/SecondCore
db.Transactions.active_transactions.avgCountCore
db.Transactions.blocked_transactions.avgCountCore
db.Transactions.max_used_xact_ids.maxCountCore
db.SQL.tup_inserted.avgCount/SecondCore
db.SQL.tup_updated.avgCount/SecondCore
db.SQL.tup_deleted.avgCount/SecondCore
db.SQL.tup_returned.avgCount/SecondCore
db.SQL.tup_fetched.avgCount/SecondCore
db.state.active_count.avgCountCore
db.state.idle_count.avgCountCore
db.state.idle_in_transaction_count.avgCountCore
db.state.idle_in_transaction_aborted_count.avgCountCore
db.state.idle_in_transaction_max_time.maxMillisecondsCore
db.IO.blks_read.avgCount/SecondCore
db.Cache.blks_hit.avgCount/SecondCore
db.Concurrency.deadlocks.avgCount/SecondCore
db.User.numbackends.avgCountCore
os.cpuUtilization.total.avgPercentCore
os.cpuUtilization.user.avgPercentCore
os.cpuUtilization.system.avgPercentCore
os.cpuUtilization.wait.avgPercentCore
os.cpuUtilization.idle.avgPercentCore
os.cpuUtilization.steal.avgPercentCore
os.cpuUtilization.irq.avgPercentCore
os.cpuUtilization.nice.avgPercentCore
os.memory.free.avgKilobytesCore
os.memory.active.avgKilobytesCore
os.memory.cached.avgKilobytesCore
os.memory.buffers.avgKilobytesCore
os.network.rx.avgBytes/SecondCore
os.network.tx.avgBytes/SecondCore
os.loadAverageMinute.one.avgCountCore
os.loadAverageMinute.five.avgCountCore
os.loadAverageMinute.fifteen.avgCountCore
os.tasks.running.avgCountCore
os.tasks.blocked.avgCountCore
os.tasks.total.avgCountCore
os.swap.free.avgKilobytesCore
os.swap.cached.avgKilobytesCore