Application Performance Monitoring (APM)

느린 요청과 오류의 원인을 서비스에서 코드까지 추적하세요

Guance APM은 분산 트레이싱, 서비스 맵, 엔드포인트 지연 시간, 오류, 연속 프로파일링(Continuous Profiling), 로그, 인프라, 배포 및 변경 이벤트를 연결합니다. 영향을 받은 요청에서 시작해 서비스와 의존성을 따라 근거를 확인하고, 수정 후 복구 여부까지 같은 조사 흐름에서 검증할 수 있습니다.

느린 요청과 오류의 원인을 서비스에서 코드까지 추적하세요

Guance 도입 후 네트워크 및 서버 리소스, 애플리케이션 서비스, 프런트엔드 페이지와 POS 단말기까지 엔드투엔드 거래 경로를 연결해 전체 구간의 성능을 실시간으로 모니터링할 수 있게 되었습니다. 알림이 발생하면 어느 구간에서 성능 병목, 사용자 경험 저하 또는 로그 이상이 발생했는지 즉시 확인할 수 있어 팀이 여러 관점에서 문제를 좁히고 실제 성능 개선으로 이어갈 수 있습니다.

———— Wu Hongqin · Meiyijia 데이터·IT 시스템 기술 총괄

APM으로 해결할 수 있는 문제

느리거나 실패한 요청을 모든 관련 신호와 함께 조사하세요

개발, SRE, 플랫폼 팀이 서비스 상태와 개별 요청을 같은 관점에서 확인할 수 있습니다. 지연 또는 오류 변화에서 대표 트레이스를 열고 로그, 리소스 상태, 데이터베이스 작업, 프로파일, 배포 정보로 바로 이동하세요.

실제 조사 흐름

느린 요청에서 원인이 되는 서비스, 의존성, 코드 경로까지

APM은 사용자에게 영향을 주는 요청을 찾고 트레이스, 로그, 리소스, 프로파일링 근거로 팀이 수정하고 검증할 수 있는 원인 후보까지 범위를 좁힙니다.

대표적인 느린 트레이스 또는 실패한 트레이스를 엽니다

증거응답 시간, 오류 상태, 서비스 경로, 스팬 소요 시간

결론가장 느린 스팬과 처음 이상이 나타난 의존 서비스를 찾습니다

데이터 경로

언어 Agent / OpenTelemetry → 서비스, 엔드포인트, 트레이스 → 로그, 인프라, 프로파일링 컨텍스트

적합한 시나리오

마이크로서비스, 분산 시스템, 핵심 비즈니스 요청 경로를 운영하는 개발, SRE, 플랫폼 팀에 적합합니다.

요구 사항

애플리케이션 Agent 또는 OpenTelemetry 계측이 필요합니다. 실제 프런트엔드 경험은 RUM을, 더 깊은 리소스 분석은 인프라 모니터링을 함께 사용하세요.

오류율이 상승했다면 영향을 받은 서비스와 의존성을 구분하세요
서비스 및 엔드포인트 화면에서 요청량, 지연 분포, 오류, 하위 의존성을 비교합니다. 환경, 버전, 리전, 태그별로 나눠 전체 회귀인지 특정 워크로드 문제인지 판단할 수 있습니다.
문서 보기
오류율이 상승했다면 영향을 받은 서비스와 의존성을 구분하세요
반복되는 지연과 오류를 SLO와 실행 가능한 모니터로 전환하세요
반복되는 지연과 오류를 SLO와 실행 가능한 모니터로 전환하세요
처리량, 지연, 오류, 가용성 신호로 모니터와 서비스 목표를 만들고, 영향을 받은 서비스, 환경, 트레이스, 근거 데이터를 포함한 인시던트를 담당 팀에 전달합니다.
문서 보기
기존 Agent와 OpenTelemetry를 활용해 계측을 다시 만들지 마세요
DataKit 통합, 주요 언어 Agent, OpenTelemetry 트레이스를 수집합니다. 서비스, 환경, 버전, 리소스 속성을 유지해 새로운 텔레메트리도 같은 조사 모델에 연결합니다.
문서 보기
기존 Agent와 OpenTelemetry를 활용해 계측을 다시 만들지 마세요

자주 묻는 질문

Application Performance Monitoring(APM)이란 무엇인가요?

APM은 서비스 요청, 지연 시간, 처리량, 오류, 의존성, 코드 실행을 지속적으로 측정합니다. Guance는 이러한 신호를 로그, 인프라, RUM, 배포 정보와 연결해 여러 도구에서 상황을 다시 조합하지 않고도 운영 문제를 조사할 수 있게 합니다.

Guance APM으로 느린 요청을 어떻게 조사하나요?

느린 엔드포인트나 서비스에서 해당 트레이스를 열고 스팬의 소요 시간과 상태를 비교합니다. 이어서 관련 로그, 인프라, 데이터베이스 작업, 프로파일링 데이터를 확인해 원인이 될 수 있는 서비스, 의존성, 리소스 또는 코드 병목을 근거에 따라 좁힙니다.

APM 데이터를 로그 및 인프라와 연결할 수 있나요?

네. 트레이스, 서비스, 환경, 호스트, 컨테이너, Kubernetes의 공통 속성을 통해 애플리케이션 요청을 주변 로그 및 리소스 상태와 연결할 수 있습니다.

OpenTelemetry와 주요 언어 Agent를 지원하나요?

네. Guance는 OpenTelemetry 데이터를 수집하고 DataKit 및 호환 수집기를 통해 주요 언어와 프레임워크를 지원합니다. 구체적인 설정은 런타임과 수집 아키텍처에 따라 달라집니다.

APM과 인프라 모니터링은 어떻게 다른가요?

인프라 모니터링은 호스트, 컨테이너, 클러스터, 클라우드 리소스의 상태와 용량을 설명합니다. APM은 요청이 서비스와 코드를 통과하는 과정을 설명합니다. 함께 사용하면 사용자 영향이 애플리케이션 로직, 의존성, 리소스 압박 중 어디에서 발생했는지 판단할 수 있습니다.

더 살펴보기

리소스 및 관련 자료

제품 문서, 관련 솔루션 및 기술 가이드에서 다음 단계를 선택하세요.

관련 글

제품 가이드, 문제 해결 워크플로 및 기술 모범 사례

애플리케이션 성능 더 알아보기

APM을 데이터베이스, 로그, OpenTelemetry, 플랫폼, 요금 정보와 함께 살펴보세요.

시작하기 > 문서 보기 > 요금 보기 >