Google Benchmark로 마이크로 벤치마크하기
Google Benchmark로 신뢰할 수 있는 마이크로 벤치마크를 작성하고 측정상의 함정을 피합니다.
Google Benchmark로 마이크로 벤치마크하기은(는) CoddyKit의 무료 C++ Academy 강의입니다. 이것은 4개 중 4번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 C++ Academy 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. C++ Academy 강의에는 총 4개의 강의가 포함되어 있습니다.
마이크로 벤치마크를 하는 이유
매크로 프로파일링은 시간이 어디에서 소비되는지 보여 줍니다. 마이크로 벤치마크는 특정 코드를 격리하여 측정하므로 알고리즘이나 구현을 비교할 때 유용합니다.
구글 벤치마크 설정
구글이 만든 헤더 전용에 가까운 C++ 벤치마크 라이브러리입니다. vcpkg, Conan 또는 apt로 설치한 뒤 -lbenchmark를 링크하십시오.
#include <benchmark/benchmark.h>
static void BM_StringCopy(benchmark::State& state) {
std::string s = "Hello, World!";
for (auto _ : state) {
std::string copy(s);
}
}
BENCHMARK(BM_StringCopy);
BENCHMARK_MAIN();컴파일 및 실행
최적화 옵션을 사용해 컴파일하고, 벤치마크 라이브러리를 링크한 다음 실행하십시오.
g++ -O2 -DNDEBUG bench.cpp -lbenchmark -lpthread -o bench
./bench출력 해석
라이브러리는 반복당 시간, 반복 횟수 및 CPU 시간을 출력합니다. 기준 결과와 제안한 변경 사항을 비교하십시오.
최적화기의 변칙 피하기
최적화기는 쓸모없는 코드를 삭제할 수 있습니다. 결과가 실제로 “중요하다”고 인식되도록 benchmark::DoNotOptimize를 사용하십시오.
for (auto _ : state) {
auto result = expensive_function();
benchmark::DoNotOptimize(result);
}사용되지 않는 저장 방지
benchmark::ClobberMemory는 컴파일러에 메모리 상태가 관찰되었다고 알려 저장 연산이 제거되지 않도록 합니다.
매개변수화된 벤치마크
서로 다른 입력 크기에서 같은 함수를 테스트하십시오.
static void BM_Sort(benchmark::State& state) {
std::vector<int> v(state.range(0));
std::iota(v.rbegin(), v.rend(), 0);
for (auto _ : state) {
auto copy = v;
std::sort(copy.begin(), copy.end());
}
}
BENCHMARK(BM_Sort)->RangeMultiplier(2)->Range(8, 1<<14);다중 스레드 벤치마크
Threads 수정자를 사용하여 확장성을 테스트하십시오.
BENCHMARK(BM_ConcurrentMap)->Threads(1)->Threads(4)->Threads(16);사용자 지정 카운터
초당 바이트 수나 초당 항목 수처럼 도메인에 특화된 지표를 추적하십시오.
state.SetItemsProcessed(state.iterations() * input.size());
state.SetBytesProcessed(state.iterations() * input.size() * sizeof(int));통계 출력
--benchmark_repetitions=10으로 실행하면 평균, 중앙값 및 표준 편차를 얻을 수 있습니다. 라이브러리가 이를 자동으로 보고합니다.
일반적인 함정
다음 사항에 주의하십시오.
- 컴파일러가 “사용되지 않는” 코드를 제거함 → DoNotOptimize 사용
- 준비 실행의 영향 → 여러 번 반복하여 측정
- CPU 주파수 조정 → 코어를 고정하고 부스트 비활성화
- 다른 프로세스가 실행 중임 → 조용한 환경에서 벤치마크 실행
수치를 비판적으로 읽기
5% 개선은 측정 잡음일 수 있습니다. 여러 번 반복 실행하고 통계적으로 유의미한 차이만 믿으십시오. 알려진 기준 결과와 비교하십시오.
대안
다른 마이크로 벤치마크 도구는 다음과 같습니다.
- Nonius — 헤더 전용 C++ 벤치마크 도구
- Hayai — 더 오래되었지만 가벼운 도구
- Catch2 — 벤치마크 기능이 내장되어 있음
빠른 확인
벤치마크 반복문 안에서 benchmark::DoNotOptimize(result)를 사용하는 이유는 무엇일까요?
복습
세밀한 측정에는 구글 벤치마크를 사용하십시오. DoNotOptimize와 ClobberMemory로 컴파일러의 변칙적인 최적화를 방지하십시오. 매개변수화된 벤치마크와 다중 스레드 벤치마크를 사용해 입력과 동시성에 따른 동작을 살펴보십시오. 통계적으로 유의미한 차이만 신뢰하십시오.
자주 묻는 질문
“Google Benchmark로 마이크로 벤치마크하기” 강의는 무료인가요?
네 — “Google Benchmark로 마이크로 벤치마크하기” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 C++ Academy 강의 전체를 잠금 해제할 수 있습니다. C++ Academy 강의에는 총 4개의 강의가 포함되어 있습니다.
“Google Benchmark로 마이크로 벤치마크하기”에서 뭘 배우나요?
Google Benchmark로 신뢰할 수 있는 마이크로 벤치마크를 작성하고 측정상의 함정을 피합니다. 브라우저에서 직접 실행하는 실습 코드로 C++ Academy을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.
C++ Academy을(를) 시작하는 데 경험이 필요한가요?
사전 경험은 필요하지 않습니다. CoddyKit의 C++ Academy은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 4번째 강의입니다.
“Google Benchmark로 마이크로 벤치마크하기” 강의는 얼마나 걸리나요?
대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.
이 C++ Academy 강의에서 코드를 작성하고 실행할 수 있나요?
네. 모든 C++ Academy 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.
이 강의의 모든 강의
- 캐시에 친화적인 데이터 배치
- 분기 예측과 자주 실행되는 반복문
- perf, vtune 및 Sanitizer로 성능 분석하기
- Google Benchmark로 마이크로 벤치마크하기