메인 콘텐츠로 건너뛰기
endpoint-performance-monitoring-tanium.jpg
IT 운영

7 엔드포인트 성능 모니터링 모범 사례

다음 모범 사례를 따르시면, 직원의 일상 업무에 지장을 주지 않으면서도 성능을 최적화할 수 있으며, 보안 취약점 및 기타 운영 위험에 더 신속하게 대응할 수 있는 이점을 누릴 수 있습니다.

어떤 조직이든 그 생산성은 직원들의 컴퓨터 성능에 달려 있습니다.

해당 컴퓨터의 작동 속도가 느려지거나 시스템이 다운되면, 직원의 업무 생산성이 저하되고 조직의 전반적인 민첩성도 떨어지게 됩니다.

이처럼 많은 것이 위험에 처해 있는 상황에서, 성능 모니터링 은 인력과 기술을 최대한 활용하고자 하는 모든 조직에 있어 필수적인 기능입니다.

조직 이 직원용 컴퓨터, 서버 및 기타 장치 와 같은 엔드포인트의 성능을 효과적이고 효율적으로 모니터링할 수 있도록 하는 7가지 모범 사례를 소개합니다.

1. 모든 유형의 엔드포인트를 모니터링합니다

일을 간단하게 처리하고 싶은 유혹이 들기 마련이다. 조직 내 엔드포인트의 90 %가 Windows 컴퓨터라고 가정해 봅시다. Windows 컴퓨터를 모니터링하기 위해 도구에 투자하고 관련 프로세스를 구축합니다.

물론, 리눅스 서버도 있지만, 사람들의 사무실 칸막이 안이나 홈 오피스에는 설치되어 있지 않습니다. 그리고 일부 임원들은 자신의 맥을 무척 좋아합니다. 그 기계들이 잘 작동할 거라고 믿게 될 거예요. 어쨌든 불평하는 사람은 아무도 없으니까요. 게다가 Windows 컴퓨터를 얼마나 훌륭하게 관리하고 있는지 보여주는 차트도 많이 가지고 계시네요.

하지만 그 밖의 다른 종점들도 중요합니다. 또한 성능 문제가 발생하면, 직접적이든 간접적이든 수많은 다른 사용자에게 영향을 미칠 수 있습니다. (CFO의 맥이 고장 나서 구매 승인을 할 수 없게 되면, 많은 사람들이 그 여파를 겪게 될 것입니다.)

그러니 어떤 방식이든, 조직 내의 모든 유형의 엔드포인트(Windows, macOS, Linux)를 모니터링할 수 있는 도구와 프로세스를 반드시 마련해 두십시오.

Tanium 콘솔에서 엔드포인트 데이터를 조사합니다.
Tanium 콘솔에서 엔드포인트 데이터를 조사합니다.

2. 모든 엔드포인트를 모니터링합니다(네, 의 모든 엔드포인트까지 모두 포함합니다).

조직 내 모든 유형의 엔드포인트를 모니터링할 수 있는 도구를 갖추고 있다 하더라도, 일부 또는 상당수의 엔드포인트를 여전히 간과하고 있을 가능성이 높습니다. 제가 이렇게 말하는 이유는, 기업을 방문해 성과 모니터링 관행을 평가할 때 대개 성과 모니터링 보고서에서 엔드포인트의 약 10-20 %가 누락되어 있는 것을 발견하기 때문입니다.

이는 엔드포인트의 10-20 %가 성능 저하 위험에 처해 있어, 해당 엔드포인트를 사용하는 직원들이 좌절감을 느끼고 생산성이 떨어질 수 있음을 의미합니다.

어떤 방식이든, 조직 내 모든 엔드포인트를 확실히 모니터링할 수 있도록 도구와 프로세스를 구축하십시오.

3. 전체적인 그림을 파악하세요

모든 엔드포인트를 찾아내는 것은 별개의 문제입니다. IT 및 사업부 책임자들이 관리 대상인 모든 엔드포인트에 대한 “전체 현황”을 파악할 수 있도록 하는 것은 또 다른 문제입니다.

효과적인 성과 모니터링을 위해서는 대개 전체적인 상황을 파악해야 합니다. 즉, 대시보드를 통해 예를 들어 시카고 지사는 문제가 없지만, 신시내티 지사에서는 어젯밤 애플리케이션 업그레이드 이후 메모리 오류로 인해 엔드포인트가 다운되고 있다는 사실을 한눈에 확인할 수 있어야 합니다.

전사적인 성능을 모니터링하려면, 전사적인 관점은 물론 성능 문제가 발생하는 개별 엔드포인트에 대한 세부적인 정보도 확인할 수 있도록 해야 합니다.

4. 최종 사용자에게는 간단하게 유지하세요

많은 조직에서 직원이 헬프데스크에 성능 문제를 신고하면, 그 직원의 업무에 대한 방해는 이제 막 시작될 뿐입니다. 대부분의 성능 모니터링 플랫폼에서는 IT 엔지니어가 문제 해결을 위해 직원의 업무를 방해하거나 그 업무와 병행해야 합니다.

해당 직원은 자신의 엔드포인트에 새로운 진단 또는 원격 제어 애플리케이션을 설치해 달라는 요청을 수락해야 할 수도 있습니다. 해당 문제에 대한 조사는 직원의 업무의 일환으로 진행되는 공식적인 업무가 중단될 때까지는 시작되지 못할 수도 있습니다. 문제가 간헐적으로 발생했고, 이는 직원이 수행하던 어떤 활동에서 비롯된 것이라면, 문제 해결을 위한 최적의 기회는 이미 놓쳐버린 셈이다.

더 나은 방법은 없을까요? 엔지니어가 사용자의 작업을 방해하지 않고도 엔드포인트에서 어떤 일이 일어나고 있는지 파악할 수 있게 해주는 도구를 사용하십시오. 엔지니어들이 직원이 직접 손을 대거나, 클라이언트를 설치하거나, 대화 상자를 하나하나 클릭하거나, 전화로 한 시간씩 시간을 낭비할 필요 없이 프로세스, 메모리 사용량 및 기타 주요 데이터를 점검할 수 있도록 하십시오.

속도 관련 문제 해결
속도 관련 문제 해결

5. 현지에서 기록하고, 전 세계적으로 문제 해결

수많은 성능 모니터링 플랫폼이 침입형 조사 기법에 의존하는 이유 중 하나는, 엔지니어가 실제로 네트워크를 통해 엔드포인트에 연결하기 전까지는 엔드포인트 활동에 대한 데이터에 거의 또는 전혀 접근할 수 없기 때문이다.

이 방식에는 두 가지 주요 단점이 있습니다. 첫째, 사용자의 작업을 방해하고, 둘째, 엔지니어가 접근할 수 있는 데이터의 범위를 제한합니다. 문제가 간헐적으로 발생하거나, 몇 시간 또는 며칠 전에 발생한 다른 활동과 어떤 식으로든 연관되어 있는 경우, 조사 담당 엔지니어는 이러한 단서를 놓칠 가능성이 높습니다.

또 다른 방법은 엔드포인트가 성능 데이터를 로컬에 기록하도록 하여, 엔지니어가 문제를 조사할 때 로컬 데이터 저장소에서 즉시 풍부한 데이터를 찾아 활용할 수 있도록 하는 것입니다.

데이터가 이미 수집된 상태이므로, 엔지니어들은 데이터를 수집하기 위해 사용자의 작업을 방해할 필요가 없습니다. 또한 데이터가 로컬에 저장되므로, 엔지니어들은 모든 엔드포인트가 상세한 메트릭을 중앙 관리 콘솔로 지속적으로 전송할 필요 없이 해당 데이터에 접근할 수 있습니다.

그러나 네트워크를 통해 전송되는 방대한 양의 데이터로 인해 트래픽 정체가 발생하지 않더라도, 엔지니어들은 로컬 LAN이나 WAN, 헬프데스크 센터, 보안 운영 센터(SOC), 심지어 재택 사무실 등 어느 장소에서든 엔드포인트의 문제를 해결할 수 있습니다.

그 결과, 문제 해결에 도움이 되는 더 나은 정보를 얻을 수 있고, 문제 해결 속도가 빨라지며, 최종 사용자와 엔지니어 모두에게 더 편리한 상호작용이 가능해집니다.

6. 사내 개발팀을 도와주세요

엔드포인트 성능에 대한 상세한 정보를 수집하고 공유함으로써, IT 운영 팀은 사내 개발 팀이 직원들을 위해 개발 중인 애플리케이션의 문제를 해결하는 데 도움을 줄 수 있습니다.

수백 개 또는 수천 개의 엔드포인트 전반에 걸친 프로세스 실행, 메모리 할당, 디스크 사용량 및 기타 주요 지표에 대한 실시간 및 과거 성능 데이터는 개발자가 테스트 환경에서 제한된 범위로 진행한 배포 단계에서는 감지하거나 제대로 파악하지 못했던 문제를 해결하고 수정하는 데 도움이 될 수 있습니다.

실시간 및 과거 실적 데이터
실시간 및 과거 실적 데이터

성과 모니터링은 모든 직원에게 적용할 수 있는 일반적인 도구로 여겨질 수 있지만, 비록 공식적으로 소프트웨어 개발 제품군의 일부는 아니더라도 개발 조직에게도 유용한 도구입니다.

7. 평균 수리 시간(MTTR) 단축

MTTR 은 아마도 모든 성능 모니터링 관행에 있어 가장 중요한 지표일 것입니다.

문제가 발생했을 때, IT 팀은 얼마나 빨리 이를 해결할 수 있습니까? 그들은 필요한 정보를 빠르고 쉽게 찾을 수 있을까요? 이 문제로 영향을 받은 직원들의 업무를 방해하지 않고도 그 원인을 찾아낼 수 있을까요?

이와 같은 지표를 추적함으로써 IT 조직은 자사의 성과 관리 도구와 절차가 제공하는 가치를 평가할 수 있습니다. 성능 모니터링에 활용하는 인력, 프로세스 및 기술이 MTTR을 단축하지 못한다면, 이는 해당 인력, 프로세스 및 기술에 여전히 개선이 필요하다는 신호입니다.

이러한 모범 사례를 따르시면 MTTR을 단축하고, 직원의 일상 업무에 지장을 주지 않으면서 성능을 최적화하며, 내부 개발 팀이 미묘한 문제를 더 신속하게 해결할 수 있도록 지원하고, 보안 취약점 및 기타 운영 위험에 더 빠르게 대응할 수 있는 이점을 누릴 수 있습니다.

자세한 내용은 제 이전 블로그 게시물 ‘ ’와 ‘Tanium이 성능 모니터링을 개선하는 10 가지 방법’을 확인해 보세요.

실제 작동 모습을 확인해 보실 준비가 되셨다면, 오늘 바로 데모에 등록해 보세요.