Cloud Cost Recommendations

Resumen

Cloud Cost Recommendations proporciona recomendaciones para reducir su gasto en la nube optimizando el uso de sus recursos en la nube. Datadog genera un conjunto de recomendaciones combinando sus datos de observabilidad con los datos de facturación de su proveedor de nube subyacente para identificar recursos en la nube huérfanos, heredados o sobreaprovisionados.

Las recomendaciones se ejecutan a diario y se actualizan automáticamente en su cuenta tan pronto como se publican las recomendaciones.

Pestaña de resumen con ahorros mensuales potenciales, ahorros anuales potenciales y el número total de casos abiertos en la página de Cloud Cost Recommendations

Puede ver la lógica detallada para cada tipo de recomendación, junto con métricas de observabilidad o datos de costos mostrados en esta página.

Las recomendaciones admiten Tag Pipelines, lo que le permite filtrar, agrupar y analizar las recomendaciones utilizando las etiquetas estandarizadas de su organización. Cualquier regla de etiqueta configurada en [Tag Pipelines] se aplica automáticamente a las recomendaciones y se normaliza.

Categorías de recomendaciones

A continuación se presentan las categorías de Cloud Cost Recommendations disponibles y sus descripciones.

Categoría de RecomendaciónDescripción
TerminarRecursos con señales de que el recurso no se utiliza o señales de muy baja utilización. Considere terminar o eliminar estos recursos para reducir sus costos.
MigrarRecursos con señales de utilización moderadamente baja u otras ineficiencias. Considere ajustar el tipo de instancia u otros parámetros.
DownsizeRecursos que están subutilizados o sobreaprovisionados. Considere ajustar el tamaño u otros parámetros para reducir costos.
ComprarRecursos con cargos bajo demanda y tiempo de actividad extendido. La compra de una reserva o un Plan de Ahorros puede reducir el costo amortizado del recurso.
ConfigureRecursos con opciones de configuración que se pueden ajustar para reducir costos sin cambiar la capacidad o terminar el recurso.

Requisitos previos

Los siguientes son los requisitos necesarios para recibir Cloud Cost Recommendations:

Configuración

Para cada cuenta de nube de la que desee recibir recomendaciones:

  1. Configure Cloud Cost Management para enviar datos de facturación a Datadog.
    • Para Azure, esto requiere utilizar el método de Registro de Aplicaciones para recolectar datos de facturación.
  2. Habilite la recolección de recursos para recomendaciones.
    • Para AWS, habilite la recolección de recursos en la pestaña Resource Collection del AWS integration tile.
    • Para Azure, habilite la recolección de recursos con la integración apropiada. Si su organización está en el sitio de Datadog US3, el Azure Native Integration habilita esto automáticamente a través de la recolección de métricas. Para todos los demás sitios, se requiere habilitar la recolección de recursos dentro del Azure integration tile.
    • Para GCP, habilite la recolección de recursos en la pestaña Resource Collection del Google Cloud Platform integration tile.
  3. Instale el Datadog Agent (requerido para Downsize recommendations).

Nota: Cloud Cost Recommendations admite la facturación en monedas que no sean USD de los clientes.

Estados de recomendaciones

Asigne un estado a cada recomendación para rastrear el progreso de la optimización de costos en sus equipos. Los estados persisten cuando las recomendaciones se regeneran diariamente. No necesita volver a clasificar las mismas recomendaciones.

EstadoDescripción
Open(Predeterminado) La recomendación no ha sido clasificada.
In ProgressSe está trabajando para abordar esta recomendación.
CompletedLa acción recomendada se ha tomado o ya no es relevante.
DismissedNo se planea trabajo para esta recomendación durante el período especificado al descartarla.

Filtrar recomendaciones por estado

Utilice las pestañas de estado en la parte superior de la Cloud Cost Recommendations página para filtrar la lista por estado. Las pestañas disponibles son Open, In Progress, Completed y Dismissed. Cada pestaña muestra el total estimado de ahorros para las recomendaciones en ese estado.

Rastrear ahorros por estado

Cada pestaña de estado muestra el total estimado de ahorros para las recomendaciones en ese estado:

  • Open: Ahorros potenciales de recomendaciones que no han sido clasificadas.
  • In Progress: Ahorros estimados de recomendaciones con trabajo en curso.
  • Completed: Ahorros realizados de recomendaciones donde se ha tomado la acción recomendada.
  • Dismissed: Ahorros estimados de recomendaciones que han sido desestimadas.

Cambiar el estado de una recomendación

Puede cambiar el estado de una recomendación de tres maneras:

  • Actualización masiva: Seleccione una o más recomendaciones en Active Recommendations, luego elija un estado en la barra de herramientas sobre la tabla para aplicarlo a todas las recomendaciones seleccionadas.
  • Desde la tabla: Utilice el menú desplegable de estado en la columna Status para seleccionar un nuevo estado directamente de la lista de recomendaciones.
  • Desde el panel lateral: Haga clic en una recomendación para abrir el panel lateral, luego utilice el menú desplegable de estado para seleccionar un nuevo estado.

Acciones sobre recomendaciones

Puede actuar sobre las recomendaciones para ahorrar dinero y optimizar costos. Cloud Cost Recommendations soportan Jira, 1-click Workflow Automation y Datadog Case Management. Las recomendaciones de volúmenes EBS y GP2 EBS no utilizados también soportan 1-click Workflow Automation. Consulte los siguientes detalles para cada opción de toma de acción:

  • Jira: Cree problemas de Jira directamente desde el panel lateral de recomendaciones o seleccionando múltiples recomendaciones en la lista Active Recommendations y haciendo clic en Create Jira issue. Los problemas creados están etiquetados y enlazan de vuelta a la recomendación en Datadog.

    Para filtrar recomendaciones por estado de Jira, utilice las siguientes opciones de consulta:

    • @jira_issues.issue_key:* - Muestre solo las recomendaciones con un problema de Jira
    • -@jira_issues.issue_key:* - Muestre solo las recomendaciones sin un problema de Jira
    • jira_issues.issue_key:ABC* - Filtre por prefijo de proyecto específico de Jira
  • Bits Code correcciones de código: Las correcciones de código están disponibles para recomendaciones aplicables de S3 y DynamoDB, así como para la recomendación de Downsize Kubernetes Deployment. En estas situaciones, Bits Code crea pull requests listos para producción para implementar cambios en los recursos de la nube y optimizaciones de costos en Terraform o Helm charts, respectivamente. Set up Bits Code para usar esta función.

  • 1-click Workflow Automation actions: Las acciones están disponibles para un conjunto limitado de recomendaciones, permitiendo a los usuarios ejecutar las acciones sugeridas, como hacer clic en Delete EBS Volume, directamente dentro de Cloud Cost Management.

  • Cost Optimization Automation: Configure automatizaciones que actúen sobre las recomendaciones de manera continua en un horario recurrente. Las automatizaciones están limitadas a cuentas, regiones y etiquetas específicas e incluyen salvaguardias como instantáneas previas a la acción y aprobación humana opcional a través de Slack o Microsoft Teams.

  • Datadog Case Management: Los usuarios pueden ir al panel lateral de recomendaciones y hacer clic en Create Case para generar un caso para gestionar y tomar acción sobre las recomendaciones.

  • Descartar: Utilice Dismiss en el panel lateral de recomendaciones para ocultar una recomendación durante un período de tiempo elegido y proporcionar una razón. Las recomendaciones descartadas se mueven a la pestaña Dismissed

Descripciones de recomendaciones y recursos

Categoría de recomendaciónProveedor de nubeTipo de recursoTipo de recomendaciónDescripción de la recomendaciónRequisitos previos de la recomendación
ConfigureAnthropicAnthropic API KeyEnable Anthropic Prompt CachingIdentifica las claves de API de Anthropic sin uso de almacenamiento en caché de solicitudes y recomienda habilitar el almacenamiento en caché de solicitudes para reducir los costos de tokens de entrada.Anthropic integration
MigrateAWSAuto Scaling GroupMigrate ASG Legacy InstancesUn grupo de Auto Scaling que incluye tipos de instancias heredadas.
DownsizeAWSAuto Scaling GroupReduce Minimum CapacityUn grupo de Auto Scaling con una capacidad mínima de instancias que puede ser reducida.Datadog Agent
TerminateAWSCloudTrail TrailDelete unnecessary CloudTrail trailsLos registros de CloudTrail con eventos pagados pueden ser eliminados para reducir costos.
TerminateAWSDynamoDB TableDelete DynamoDB Global Secondary IndexEl Índice Secundario Global (GSI) de una tabla de DynamoDB tiene 0 lecturas consumidas.
TerminateAWSDynamoDB TableDelete DynamoDB TableUna tabla de DynamoDB tiene 0 lecturas consumidas y 0 escrituras no replicadas consumidas.
TerminateAWSDynamoDB TableDelete Extra On-Demand BackupsUna tabla de DynamoDB tiene cargos por más de 2 copias de seguridad bajo demanda.
DownsizeAWSDynamoDB TableDownsize DynamoDB CapacityUna tabla de DynamoDB provisionada que utiliza menos del 80% de su capacidad de lectura y escritura en más del 80% del tiempo.
MigrateAWSDynamoDB TableMigrate DynamoDB to Infrequent Access Table ClassMigrar a la clase de tabla de Acceso Infrecuente (IA) ofrece más ahorros potenciales en tarifas de almacenamiento en comparación con los costos adicionales de tarifas de capacidad.
MigrateAWSDynamoDB TableMigrate DynamoDB to On-Demand Capacity ModeUna tabla de DynamoDB provisionada tiene un consumo de capacidad de lectura y escritura por hora por debajo del 18% al menos una vez en las últimas dos semanas.
MigrateAWSDynamoDB TableMigrate DynamoDB to Provisioned Capacity ModeUna tabla de DynamoDB bajo demanda tiene un consumo de capacidad de lectura y escritura por hora que siempre es mayor al 18%.
MigrateAWSDynamoDB TableMigrate DynamoDB to Standard Table ClassMigrar a la clase de tabla Estándar ofrece ahorros potenciales en tarifas de capacidad en comparación con los costos adicionales de tarifas de almacenamiento, o utiliza el nivel gratuito de la clase de tabla Estándar para almacenamiento.
TerminateAWSEBS SnapshotDelete Old EBS SnapshotsInstantáneas de EBS que tienen al menos 90 días de antigüedad y pueden ser eliminadas.
DownsizeAWSEBS VolumeDownsize EBS Volume Provisioned IOPSUn volumen EBS que utiliza menos del 80% de los IOPS provisionados para lecturas y escrituras.Amazon EC2 integration
DownsizeAWSEBS VolumeDownsize EBS Volume Provisioned ThroughputUn volumen EBS que utiliza menos del umbral configurado del rendimiento provisionado para lecturas y escrituras.Amazon EC2 integration
DownsizeAWSEBS VolumeDownsize EBS Volume Storage CapacityUn volumen EBS con menos del 20% de su capacidad de almacenamiento utilizada.Amazon EC2 integration
MigrateAWSEBS VolumeMigrate EBS Volume from GP2 to GP3Volúmenes EBS que son GP2 y pueden ser actualizados a GP3 para reducción de costos y mejora del rendimiento.
MigrateAWSEBS VolumeMigrate EBS Volume from IO1 to GP3Volúmenes EBS que son IO1 y pueden ser actualizados a GP3 para reducción de costos y mejora del rendimiento.
TerminateAWSEBS VolumeTerminate Unattached EBS VolumeVolumen que no está adjunto a una instancia EC2.
TerminateAWSEBS VolumeTerminate Unused EBS VolumeVolumen que no tiene actividad de lectura o escritura.
TerminateAWSElastic IPDelete Idle Elastic IPDirecciones IP elásticas con cargos inactivos en su informe de costos y uso de AWS.
DownsizeAWSEC2 InstanceDownsize EC2 InstanceInstancias EC2 con utilización de CPU y memoria inferior a los recursos disponibles de la siguiente instancia más pequeña en la familia. Sin el Agente de Datadog, esta recomendación se genera utilizando métricas de CloudWatch.Datadog Agent
MigrateAWSEC2 InstanceMigrate EC2 InstanceInstancias EC2 de una generación anterior que pueden ser actualizadas a un tipo de instancia más nuevo.
MigrateAWSEC2 InstanceMigrate EC2 Instance to Graviton TypeInstancias EC2 que pueden ser migradas a un tipo de instancia Graviton equivalente.
TerminateAWSEC2 InstanceTerminate EC2 InstanceInstancias EC2 con utilización de CPU y memoria por debajo de un umbral personalizable. Sin el Agente de Datadog, esta recomendación se genera utilizando métricas de CloudWatch.Datadog Agent
TerminateAWSEC2 InstanceTerminate EC2 Instance with Stuck NodeInstancias EC2 que alojan nodos de Kubernetes que están atascados en la fase pendiente, indicando que el nodo no está funcionando correctamente.Datadog Agent
TerminateAWSECR RepositoryDelete ECR RepositoryRepositorio ECR sin actividad de extracción que puede ser eliminado para reducir costos.
DownsizeAWSECS Task DefinitionDownsize ECS Task SizeUna tarea de ECS que utiliza menos del 50% de su CPU o memoria solicitada.Container Monitoring
TerminateAWSElastiCache ClusterTerminate ElastiCache ClusterUn clúster de ElastiCache Redis sin aciertos de caché y sin replicación o un clúster de Memcached sin aciertos de caché.
TerminateAWSOpenSearch DomainDelete OpenSearch DomainDominio de OpenSearch sin actividad de solicitud.
TerminateAWSClassic Load BalancerTerminate Classic Load BalancerUn Classic Elastic Load Balancer sin conexiones activas que no está adjunto a una instancia EC2.
TerminateAWSLoad BalancerTerminate Application Load BalancerUn Application Load Balancer sin tráfico procesado.
TerminateAWSLoad BalancerTerminate Network Load BalancerUn Network Load Balancer con 0 bytes procesados.
DownsizeAWSLambdaDownsize Lambda Provisioned ConcurrencyFunción de AWS Lambda con una concurrencia provisionada sobreasignada.
TerminateAWSCloudWatch Log GroupDelete Lambda CloudWatch Logs and write permissionsEliminar los permisos de escritura para los registros de CloudWatch de Lambda para evitar registros innecesarios adicionales.
DownsizeAWSCloudWatch Log GroupSet CloudWatch Logs Retention PolicyReducir los costos de almacenamiento de los registros de CloudWatch estableciendo políticas de retención adecuadas.
TerminateAWSMQ BrokerTerminate MQ BrokerUn broker de MQ con 0 conexiones.
DownsizeAWSRDS InstanceDownsize RDS Instance Provisioned IOPSInstancias de RDS utilizando menos del 80% de IOPS provisionados en las últimas dos semanas.
MigrateAWSRDS InstanceMigrate RDS Instance EngineUn RDS que ejecuta una versión de motor que ya no es compatible y que incurre en cargos por soporte extendido.
MigrateAWSRDS InstanceMigrate RDS Instance to GravitonInstancias de RDS que pueden ser migradas a un tipo de instancia equivalente de Graviton.
TerminateAWSRDS InstanceTerminate Unused RDS InstanceInstancia de RDS con 0 conexiones a la base de datos y 0 retraso de réplicas.
TerminateAWSRedshift ClusterTerminate Redshift ClusterClúster de Redshift con 0 conexiones a la base de datos.
MigrateAWSS3 BucketClean up old versions to reduce storage costsUn bucket con versionado habilitado tiene costos de almacenamiento significativos por versiones antiguas de objetos.Storage Management
TerminateAWSS3 BucketDelete S3 noncurrent version objectsUn bucket estándar de S3 sin un ciclo de vida de expiración de versiones no actuales y que no sirve un sitio web contiene bytes de almacenamiento de versiones no actuales mayores a 30 días.Storage Lens
TerminateAWSS3 BucketDelete abandoned S3 multipart uploadsBuckets de S3 con cargas multipart incompletas mayores a 7 días que están consumiendo espacio de almacenamiento.Storage Lens
MigrateAWSS3 BucketReduce small file count to reduce storage costsUn bucket tiene un porcentaje significativo de archivos pequeños en clases de almacenamiento de acceso poco frecuente, aumentando los costos de almacenamiento debido al tamaño mínimo de facturación.
TerminateAWSS3 BucketTerminate S3 BucketUn bucket de S3 con costos de almacenamiento mínimos y sin solicitudes GET o PUT.
MigrateAWSS3 BucketTransition S3 IA and Glacier objects to Intelligent-TieringUn bucket tiene altos cargos por eliminación anticipada.
MigrateAWSS3 BucketTransition S3 Standard objects to Intelligent TieringLos costos de un bucket son casi totalmente en almacenamiento estándar por GB, pero las solicitudes GET indican que pocos objetos son accedidos.
MigrateAWSS3 BucketTransition S3 objects to Infrequent Access by PrefixLos costos de un prefijo de bucket son casi totalmente en almacenamiento estándar por GB, pero las solicitudes GET indican que pocos objetos en el prefijo son accedidos.Storage Management
DownsizeAWSVPC NAT GatewayReduce NAT Gateway Cross-Zone TransfersLos recursos que necesitan una puerta de enlace NAT deben usar una que esté en la misma zona de disponibilidad, o pueden incurrir en cargos innecesarios por transferencia entre zonas.
DownsizeAWSVPC NAT GatewayReduce NAT Gateway Within-VPC TransfersLos recursos en la misma VPC deben evitar comunicarse entre sí a través de una puerta de enlace NAT porque eso incurre en cargos innecesarios por procesamiento de puerta de enlace NAT.NPM
TerminateAWSVPC NAT GatewayTerminate NAT GatewayUna puerta de enlace NAT que no tiene bytes enviados a través de ella.
TerminateAzureAKS ClusterTerminate AKS ClusterUn clúster de AKS con menos del 5% de uso de CPU.
DownsizeAzureContainer AppDownsize Container AppUna Container App tiene más réplicas mínimas de las necesarias.
TerminateAzureLoad BalancerDelete Load BalancerUn Load Balancer con 0 bytes transferidos.
TerminateAzureManaged DiskDelete Unattached Managed DiskEl disco administrado está desconectado y puede ser eliminado.
TerminateAzureManaged DiskDelete Unused Managed DiskDisco administrado sin operaciones de lectura/escritura, que puede ser eliminado.
DownsizeAzureManaged DiskDownsize Managed Disk IOPSDisco administrado que utiliza menos del umbral configurado de IOPS provisionados.
DownsizeAzureManaged DiskDownsize Managed Disk ThroughputDisco administrado que utiliza menos del umbral configurado de rendimiento provisionado.
TerminateAzureMySQL DatabaseTerminate Database for MySQLServidor de base de datos sin conexiones, que puede ser terminado.
TerminateAzureSQL ServerTerminate SQL ServerServidor SQL sin conexiones, que puede ser terminado.
DownsizeAzureSQL Server DatabaseDownsize SQL Server Database DTUBase de datos de SQL Server con bajo uso de DTU que puede ser reducida.
TerminateAzureSQL Server DatabaseTerminate SQL Server DatabaseBase de datos de SQL Server sin conexiones exitosas y con CPU muy mínima, que puede ser terminada.
DownsizeAzureVM InstanceDownsize Azure VM InstanceInstancia de VM que puede ser reducida a un tipo de instancia más pequeño.Datadog Agent
TerminateAzureVM InstanceTerminate Azure VM InstanceInstancia de VM con menos del 5% de CPU de usuario y más del 90% de memoria utilizable.Datadog Agent
DownsizeAWSDatabricks ClusterDownsize Databricks All-PurposeIdentifica clústeres de Databricks sobredimensionados y sugiere reducir el tamaño a tipos de instancia más pequeños para reducir costos.
DownsizeAzureDatabricks ClusterDownsize Databricks All-PurposeIdentifica clústeres de Databricks sobredimensionados y sugiere reducir el tamaño a tipos de instancia más pequeños para reducir costos.
DownsizeGCPDatabricks ClusterDownsize Databricks All-PurposeIdentifica clústeres de Databricks sobredimensionados y sugiere reducir el tamaño a tipos de instancia más pequeños para reducir costos.
DownsizeAWSDatabricks ClusterDownsize Databricks JobIdentifica trabajos de Databricks sobredimensionados y sugiere reducir el tamaño a tipos de instancia más pequeños para reducir costos.
DownsizeAzureDatabricks ClusterDownsize Databricks JobIdentifica trabajos de Databricks sobredimensionados y sugiere reducir el tamaño a tipos de instancia más pequeños para reducir costos.
DownsizeGCPDatabricks ClusterDownsize Databricks JobIdentifica trabajos de Databricks sobredimensionados y sugiere reducir el tamaño a tipos de instancia más pequeños para reducir costos.
TerminateGCPCompute AddressDelete Unused Compute IP AddressLas direcciones IP de cómputo no utilizadas pueden ser eliminadas.
TerminateGCPCompute DiskDelete Unattached Compute DiskDiscos de cómputo que están desconectados y pueden ser eliminados.
TerminateGCPCompute DiskDelete Unused Compute DiskDiscos de cómputo que no están en uso y pueden ser eliminados.
TerminateGCPCompute Global AddressDelete Unused Compute Global IP AddressLas direcciones IP globales de cómputo no utilizadas pueden ser eliminadas.
DownsizeGCPCompute InstanceDownsize Compute InstanceInstancia de cómputo con bajo uso de CPU y memoria que puede ser reducida a un tipo de instancia más pequeño.Datadog Agent
TerminateGCPCompute InstanceTerminate Compute InstanceInstancia de cómputo con bajo uso de CPU, alta memoria disponible y actividad de red mínima.Datadog Agent
DownsizeGCPCompute Instance GroupReduce Minimum CapacityUn escalador de grupo de instancias de cómputo con una capacidad mínima de instancias que puede ser reducida.
DownsizeGCPCloudSQL InstanceDownsize CloudSQL DatabaseInstancias de CloudSQL que están sobreaprovisionadas y pueden ser reducidas.
TerminateGCPCloudSQL InstanceTerminate CloudSQL InstanceInstancias de CloudSQL con uso mínimo que pueden ser terminadas.
TerminateGCPStorage BucketDelete Noncurrent Cloud Storage ObjectsBuckets de Cloud Storage que se benefician de reglas de ciclo de vida para eliminar automáticamente versiones de objetos no actuales.
MigrateGCPStorage BucketTransition Cloud Storage Bucket to AutoclassLos objetos en el bucket de almacenamiento pueden ser migrados automáticamente a niveles de archivo para obtener mejores tarifas.
DownsizeAWSKubernetes ClusterReduce Cluster IdleClústeres de Kubernetes con alta inactividad en CPU o memoria.Datadog Agent
DownsizeAzureKubernetes ClusterReduce Cluster IdleClústeres de Kubernetes con alta inactividad en CPU o memoria.Datadog Agent
DownsizeGCPKubernetes ClusterReduce Cluster IdleClústeres de Kubernetes con alta inactividad en CPU o memoria.Datadog Agent
DownsizeAWSKubernetes DeploymentDownsize DeploymentLos contenedores están utilizando solo una fracción de su CPU o memoria solicitada.Datadog Agent
DownsizeAzureKubernetes DeploymentDownsize DeploymentLos contenedores están utilizando solo una fracción de su CPU o memoria solicitada.Datadog Agent
DownsizeGCPKubernetes DeploymentDownsize DeploymentLos contenedores están utilizando solo una fracción de su CPU o memoria solicitada.Datadog Agent

Lectura adicional