Представьте: сайт тормозит, пользователи жалуются, а вы не понимаете, в чём дело. Стандартные логи и метрики сервера не показывают, какой именно SQL-запрос выполняется 3 секунды или почему контроллер зависает на 2 секунды. APM (Application Performance Monitoring) решает эту проблему — он отслеживает производительность на уровне кода. В одном из проектов на Laravel мы обнаружили, что медленный запрос к orders таблице занимал 3.2 секунды из-за отсутствия индекса. APM показал это через 5 минут после установки. Мы настраиваем APM, чтобы вы видели полную картину: от HTTP-запроса до ответа базы данных. APM даёт ответы на вопросы: какой эндпоинт самый медленный? какая функция жрёт процессор? где происходит утечка памяти? С APM вы не гадаете — вы знаете. Наш опыт включает внедрение для 20+ проектов с нагрузкой до 1 млн запросов в день — 5+ лет на рынке.
Какие проблемы решает APM?
- Медленные SQL-запросы. Один неоптимизированный запрос может добавлять секунды к времени ответа. APM показывает полный стек вызовов и время выполнения каждого запроса.
- N+1 запросы ORM. Типичная проблема Laravel и Django: цикл по коллекции порождает сотни запросов к базе. Трассировки выявляют это мгновенно.
- Узкие места в коде. Flamegraph профилирования показывает, какая функция потребляет больше всего процессора или памяти.
- Ошибки и исключения. APM автоматически собирает stack trace и связывает с конкретным запросом.
Как работает трассировка запросов?
Каждый входящий HTTP-запрос получает уникальный идентификатор (trace ID). На каждом этапе — контроллер, сервис, ORM, SQL, Redis — создаются спаны. Спаны содержат время начала, длительность, статус и атрибуты (например, SQL-текст). Все спаны объединяются в трассировку, которая визуализируется как waterfall-диаграмма. Мы используем сэмплирование (10–20% запросов), чтобы не перегружать продакшен.
Какие метрики производительности контролировать?
Ключевые метрики для оценки качества работы приложения:
| Метрика | Целевое значение | Описание |
|---|---|---|
| p95 latency | < 500 мс | Время ответа для 95% запросов |
| Error rate | < 0.1% | Доля запросов с ошибками |
| Apdex | > 0.95 | Доля быстрых запросов |
Эти SLO-метрики помогают объективно оценить, как приложение справляется с нагрузкой.
Почему OpenTelemetry — лучший выбор?
OpenTelemetry — это вендор-нейтральный стандарт сбора трассировок и метрик. Один SDK отправляет данные в любую APM-систему: Jaeger, Zipkin, Datadog, New Relic, Grafana Tempo. Вы не зависите от одного вендора и можете сменить бэкенд без переписывания кода.
// bootstrap/telemetry.php use OpenTelemetry\API\Globals; use OpenTelemetry\SDK\Trace\TracerProviderFactory; use OpenTelemetry\Contrib\Otlp\OtlpHttpSpanExporter; $exporter = OtlpHttpSpanExporter::fromConnectionString( 'http://otel-collector:4318', 'myapp', '1.0.0' ); $tracerProvider = (new TracerProviderFactory())->create($exporter); Globals::registerInitializer(fn() => $tracerProvider); Мы подключаем middleware для трассировки HTTP-запросов и слушатели для SQL-запросов. Всё это работает без изменения бизнес-логики.
import { NodeSDK } from '@opentelemetry/sdk-node'; import { OTLPTraceExporter } from '@opentelemetry/exporter-trace-otlp-http'; import { getNodeAutoInstrumentations } from '@opentelemetry/auto-instrumentations-node'; const sdk = new NodeSDK({ resource: new Resource({ 'service.name': 'myapp-api', 'service.version': process.env.APP_VERSION || '1.0.0', }), traceExporter: new OTLPTraceExporter({ url: 'http://otel-collector:4318/v1/traces', }), instrumentations: [getNodeAutoInstrumentations({ '@opentelemetry/instrumentation-express': { enabled: true }, '@opentelemetry/instrumentation-pg': { enabled: true }, '@opentelemetry/instrumentation-redis': { enabled: true }, })], }); sdk.start(); Гарантируем, что инструментация не влияет на производительность продакшена — мы используем сэмплирование (например, 10% запросов).
Что входит в настройку APM?
- Анализ инфраструктуры — определяем точки сбора данных: HTTP, SQL, Redis, очереди.
- Установка OpenTelemetry SDK — настройка для вашего стека (PHP, Node.js, Python, Go).
- Интеграция с бэкендом — подключение Grafana Tempo, Sentry Performance или другого инструмента.
- Создание дашбордов — визуализация latency, error rate, Apdex, SLO.
- Настройка алертов — оповещения при превышении порогов (p95 > 1 с, error rate > 1%).
- Документация и обучение — описание архитектуры сбора и инструкции для команды.
Сроки реализации
| Задача | Срок |
|---|---|
| Sentry Performance (быстрый старт) | 0.5 дня |
| OpenTelemetry + Grafana Tempo (self-hosted) | 3–4 дня |
| Datadog/New Relic APM | 1–2 дня |
| Полная инструментация (HTTP + DB + Redis + очереди) | 2–3 дня |
| SLO дашборды и алерты | +1–2 дня |
Стоимость рассчитывается индивидуально в зависимости от сложности. Мы оцениваем проект бесплатно.
Почему стоит внедрить APM?
Без APM вы тратите часы на поиск узких мест. С ним — получаете готовые дашборды и алерты за пару дней. APM сокращает время поиска узких мест в 10 раз по сравнению с ручным анализом логов. Наш опыт внедрения включает проекты с высокой нагрузкой (миллионы запросов в день). Мы гарантируем, что настройка прозрачна и не требует изменений в бизнес-логике. APM окупается за счёт сокращения времени на отладку и повышения стабильности приложения.
Свяжитесь с нами, чтобы мы оценили ваш проект. Закажите настройку APM под ключ — получите полный контроль над производительностью. Получите консультацию по настройке APM для вашего проекта — мы оценим сложность и предложим оптимальное решение.







