aws-observability
aws/agent-toolkit-for-aws
Создает, настраивает, отлаживает и оптимизирует систему мониторинга AWS с использованием CloudWatch (Logs Insights, Metrics, Alarms, Dashboards, EMF), X-Ray, CloudTrail и ADOT. Рассматривает синтаксис запросов Log Insights (поля, фильтры, статистику, разбор, шаблоны, соединение, подзапросы), настройку сигналов тревоги (метрики, составные сигналы, обнаружение аномалий, обработку отсутствующих данных), проектирование информационных панелей, настраиваемые метрики (PutMetricData, EMF, фильтры метрик), трассировку X-Ray (ADOT, правила выборки, аннотации и метаданные), настройку коллектора ADOT и CloudT
...Расширить всеО aws-observability
AWS Observability предоставляет экспертные знания в данной области для создания, настройки, отладки и оптимизации наблюдаемости в AWS с учетом метрик, журналов и трассировок. Он охватывает возможности платформы CloudWatch — Logs Insights, Metrics, Alarms, Dashboards и EMF — а также трассировку X-Ray, операционный аудит CloudTrail и коллектор AWS Distro for OpenTelemetry (ADOT). Конкретные области включают синтаксис запросов Log Insights (поля, фильтры, статистику, разбор, шаблоны, соединение, подзапросы), настройку сигналов тревоги (метрики, составные сигналы, обнаружение аномалий, обработка отсутствующих данных), проектирование панелей мониторинга, пользовательские метрики с помощью PutMetricData, EMF и фильтров метрик, а также правила выборки X-Ray и различия между аннотациями и метаданными.
Используйте этот навык, если в задаче упоминаются CloudWatch, Log Insights, сигналы тревоги, INSUFFICIENT_DATA, информационные панели, пользовательские метрики, EMF, X-Ray, трассировки, выборка данных, CloudTrail, «кто удалил», ADOT, OpenTelemetry, наблюдаемость, мониторинг, синтетические тесты, «канарейки» или устранение неполадок в работе сигналов тревоги. Данный навык явно не охватывает настройку ведения журналов приложений, драйверы журналов контейнеров или обнаружение угроз безопасности. Он наиболее эффективно работает в сочетании с сервером AWS MCP, который позволяет агенту запускать команды CLI, запрашивать данные из CloudWatch и напрямую проверять конфигурации, хотя все рекомендации применимы и при стандартном доступе к AWS CLI.
Этот навык организован в виде таблицы маршрутизации, которая сопоставляет каждую потребность пользователя с конкретным справочным файлом: log-insights.md для запросов, alarms.md для конфигурации сигналов тревоги и значений по умолчанию, metrics.md для пользовательских метрик и EMF, tracing.md — для X-Ray и ADOT, dashboards.md — для дизайна виджетов и обмена данными между учетными записями и регионами, troubleshooting.md (который открывается с перечнем пяти наиболее распространённых способов устранения неполадок), synthetics.md — для ограничений «канарейки» и типичных сбоев, а также cloudtrail.md — для операционного аудита с использованием S3 и Athena. Включены два готовых к использованию ресурса: alarm-template.ts — шаблон CDK, основанный на передовых практиках, для мониторинга Lambda с помощью сигналов тревоги и панели инструментов, и otel-config.yaml — конфигурация коллектора ADOT для трассировок X-Ray и метрик CloudWatch EMF. Поскольку справочные файлы содержат версии среды выполнения, значения квот и матрицы функций, которые могут изменяться, в руководстве рекомендуется сверять значения, требующие высокой точности, с актуальной документацией AWS, прежде чем использовать их в производственной среде.
Часто задаваемые вопросы
Какие сервисы AWS поддерживает этот навык?
Он охватывает CloudWatch (Logs Insights, Metrics, Alarms, Dashboards, EMF), трассировку X-Ray, операционный аудит CloudTrail и коллектор ADOT (OpenTelemetry) для метрик, журналов и трассировок.
Когда не следует использовать этот навык?
Не используйте его для настройки ведения журналов приложений, драйверов журналов контейнеров или обнаружения угроз безопасности. Эти области явно выходят за рамки его применения.
Нужен ли сервер AWS MCP для его использования?
Нет. Он работает лучше всего с сервером AWS MCP, который позволяет запускать команды CLI и проверять конфигурации напрямую, но все рекомендации также применимы при использовании стандартного доступа к AWS CLI.
Где искать информацию для устранения неполадки, при которой сигнал тревоги застрял в состоянии INSUFFICIENT_DATA?
Начните с файла troubleshooting.md, в котором приведены пять наиболее распространенных способов устранения неполадок, а подробную информацию о настройках, включая обработку отсутствующих данных для сигналов тревоги по метрикам, составным сигналам и обнаружению аномалий, можно найти в файле alarms.md.
Включены ли готовые шаблоны?
Да. В комплекте есть файл alarm-template.ts — шаблон CDK, разработанный с учётом передовых практик для мониторинга Lambda с помощью сигналов тревоги и панели мониторинга, а также файл otel-config.yaml — конфигурация коллектора ADOT для трассировок X-Ray и метрик CloudWatch EMF.
Все файлы
11файловreferences/alarms.md 10,9КБ Просмотреть references/log-insights.md 6,9КБ Просмотреть references/tracing.md 8,9КБ Просмотреть assets/alarm-template.ts 3,9КБ Просмотреть references/cloudtrail.md 3,9 КБ Просмотреть references/metrics.md 7,4КБ Просмотр references/troubleshooting.md 6,7КБ Просмотр assets/otel-config.yaml 1,4КБ Просмотр references/dashboards.md 5,8КБ Просмотр references/synthetics.md 6,5КБ Просмотр SKILL.md 4,1 КБ ПросмотрOverview
Domain expertise for AWS observability across metrics, logs, and traces, covering the full lifecycle: enabling/onboarding a service to Application Signals using ADOT (AWS Distro for OpenTelemetry) auto-instrumentation SDKs and ServiceEvents — making the service show up in Application Signals — on EC2, ECS, EKS, and Lambda in Python, Node.js, Java, and .NET.
Works best with the AWS MCP server — enables running CLI commands, querying CloudWatch, and validating configurations directly. All guidance also works with standard AWS CLI access.
Note: Reference files contain specific runtime versions, quota values, and feature matrices that may change. When precision matters (e.g., deploying to production, choosing a runtime, or checking a quota), confirm values against current AWS documentation rather than relying solely on the values in these files.
Routing
| User need | Action |
|---|---|
| Enabling/onboarding a service to Application Signals (auto-instrumentation) | Read application-signals-onboarding.md |
| Propagating ServiceEvents git/deployment metadata through CI/CD | Read application-signals-cicd-metadata.md |
| Per-platform/per-language enablement steps | Read the matching references/appsignals-guides/<platform>-<language>.md (e.g. eks-python.md) |
| Writing Log Insights queries | Read log-insights.md |
| Configuring alarms (metric, composite, anomaly) | Read alarms.md |
| Publishing custom metrics or using EMF | Read metrics.md |
| Setting up X-Ray tracing or ADOT | Read tracing.md |
| Building dashboards | Read dashboards.md |
| Debugging observability issues | Read troubleshooting.md — starts with the 5 most common fixes |
| Debugging canary failures | Read synthetics.md — see Common failures table |
| CloudTrail operational auditing | Read cloudtrail.md |
| Setting up Lambda monitoring with CDK | Use alarm-template.ts as a starting point |
| Creating synthetic canaries | Read synthetics.md |
| Configuring ADOT collector | Use otel-config.yaml as a starting point |
| Debugging a running service with breakpoints/snapshots — Dynamic Instrumentation (modifies live services and capture live data) | Read dynamic-instrumentation.md in full before acting. Confirm with the user before any create/delete, and narrate before significant actions: observation → hypothesis → proposed action → expected result. Diagnosing running-service root cause from source/code inspection. Source inspection alone identifies hypotheses, not confirmed root causes. Keep suspected causes tentative until runtime evidence confirms them. |
| Spans multiple areas | Read the most specific reference first, then consult others as needed |
Files
| File | Content |
|---|---|
| application-signals-onboarding.md | Enable Application Signals auto-instrumentation: EKS add-on, CloudWatch Agent IAM, OTLP endpoints, ServiceEvents env vars, Dynamic Instrumentation — two-tier scope by platform/language |
| application-signals-cicd-metadata.md | ServiceEvents git & deployment metadata propagation through CI/CD (the 5 OTEL_AWS_SERVICE_EVENTS_* vars) |
references/appsignals-guides/ (e.g. eks-python.md) | 16 per-platform × per-language enablement guides (EC2/ECS/EKS/Lambda × Python/Node.js/Java/.NET) |
| alarms.md | Metric, composite, anomaly detection alarms — configuration, constraints, recommended defaults |
| log-insights.md | Complete query syntax, commands, functions, known issues, reusable query library |
| metrics.md | Custom metrics, EMF spec, metric filters, high-resolution, retention |
| tracing.md | X-Ray → ADOT migration, sampling rules, annotations vs metadata, collector config |
| dashboards.md | Widget types, cross-account/region, dynamic labels, sharing |
| troubleshooting.md | Error → cause → fix for all observability services |
| cloudtrail.md | Operational auditing, event types, S3+Athena queries |
| synthetics.md | Canary runtime/blueprint constraints, VPC networking, common failures |
| alarm-template.ts | Best-practice CDK Lambda monitoring (alarms + dashboard) |
| otel-config.yaml | ADOT collector config for X-Ray traces + CloudWatch EMF metrics |
| dynamic-instrumentation.md | Dynamic Instrumentation debugging loop — breakpoints/probes on live code, snapshot capture + correlation analysis, create/delete gating, snapshot PII handling. Runs via scripts/di_instrumentation.py + scripts/di_snapshots.py. |
Все файлы
0 файловУстановить aws-observability
Скачайте файлы навыков и распакуйте их в каталог .claude/skills/.
Скачать ZIPКлонируйте репозиторий и скопируйте файлы навыка в свой проект.
git clone https://github.com/aws/agent-toolkit-for-aws/blob/main/skills/core-skills/aws-observability/SKILL.md # Copy SKILL.md to your .claude/skills/ directory
Копировать





Дом
