비용 이해하기: 토큰 계산 및 예산
tiktoken으로 토큰을 계산하고, 전송 전에 비용을 추정하며, 요청별 및 일별 예산을 적용해보세요.
비용 이해하기: 토큰 계산 및 예산은(는) CoddyKit의 무료 AI Agents 강의입니다. 이것은 4개 중 4번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 AI Agents 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. AI Agents 강의에는 총 4개의 강의가 포함되어 있습니다.
토큰을 세어야 하는 이유
토큰 단위로 비용을 지불합니다. 토큰 예산이 없는 에이전트 루프가 폭주하면 몇 분 만에 수백 달러를 쓸 수 있습니다.
토큰 세기는 비용을 통제하는 데 가장 중요한 습관입니다.
토큰이란 무엇인가요
토큰은 모델이 처리하는 텍스트의 한 덩어리입니다. 영어에서는 다음과 같은 대략적인 기준을 사용할 수 있습니다:
- 토큰 1개 ~ 문자 4개
- 토큰 1개 ~ 단어 0.75개
- 토큰 100개 ~ 단어 75개
코드, 이모지, 영어가 아닌 텍스트는 문자당 더 많은 토큰을 사용합니다.
tiktoken으로 토큰 세기(OpenAI)
OpenAI는 정확한 토크나이저를 제공합니다:
# pip install tiktoken
import tiktoken
enc = tiktoken.encoding_for_model('gpt-4o-mini')
tokens = enc.encode('Hello, world!')
print(len(tokens)) # 4
print(tokens) # [9906, 11, 1917, 0]메시지의 토큰 세기
전체 개수에는 메시지 구조의 오버헤드도 포함됩니다:
def count_message_tokens(messages, model='gpt-4o-mini'):
enc = tiktoken.encoding_for_model(model)
total = 0
for m in messages:
total += 4 # role + structural
total += len(enc.encode(m['content']))
return total + 2 # primingAnthropic으로 토큰 세기
Anthropic은 서버 측 토큰 수 계산 엔드포인트를 제공합니다:
count = client.messages.count_tokens(
model='claude-sonnet-4-5',
system='You are helpful.',
messages=[{'role': 'user', 'content': 'Hello'}],
)
print(count.input_tokens)전송 전에 비용 추정하기
토큰 개수에 토큰당 가격을 곱합니다(제공업체의 가격 페이지에서 확인):
INPUT_PRICE = 0.150 / 1_000_000 # gpt-4o-mini: $0.15 / 1M input tokens
OUTPUT_PRICE = 0.600 / 1_000_000
input_tokens = count_message_tokens(messages)
est_input_cost = input_tokens * INPUT_PRICE
print(f'Estimated input cost: ${est_input_cost:.6f}')실제 비용 추적하기
각 호출 후 사용량을 합산합니다:
total_cost = 0
response = client.chat.completions.create(...)
cost = (
response.usage.prompt_tokens * INPUT_PRICE +
response.usage.completion_tokens * OUTPUT_PRICE
)
total_cost += cost실행별 예산
에이전트 실행마다 하드 상한을 설정합니다:
MAX_COST_PER_RUN = 0.50 # USD
if total_cost > MAX_COST_PER_RUN:
raise BudgetExceeded(f'Cost {total_cost} exceeds limit')사용자별 일일 예산
Redis에서 사용자별 비용을 추적하고 매일 초기화합니다:
key = f'cost:{user_id}:{today_date}'
current = float(redis.get(key) or 0)
if current + cost > 5.0:
raise QuotaExceeded()
redis.incrbyfloat(key, cost)
redis.expireat(key, midnight_tomorrow_ts)호출별 max_tokens 상한 설정
실수로 비용이 가장 크게 늘어나는 원인은 50,000토큰 응답을 생성하는 것입니다. 상한을 설정하세요:
response = client.chat.completions.create(
model='gpt-4o-mini',
messages=messages,
max_tokens=2048, # never more than 2k output
)에이전트의 단계 상한
토큰 상한에 단계 상한(최대 반복 횟수)을 함께 적용합니다:
MAX_STEPS = 20
for step in range(MAX_STEPS):
response = run_step(...)
if response.is_final():
break
else:
raise StepLimitExceeded()출력 토큰 상한
max_tokens를 명시적으로 설정해야 하는 이유는 무엇인가요?
복습
토큰 세기, 호출별 max_tokens, 실행별 예산, 사용자별 할당량, 단계 상한입니다. 안전한 운영 환경을 위해 이 다섯 가지를 모두 적용하세요.
AI 튜터와 함께 AI Agents을(를) 배우세요 — 무료
브라우저에서 실제 코드를 작성하고 실행하며, 24/7 AI 튜터로부터 즉각적인 도움을 받고, 웹이나 앱에서 중단한 부분부터 계속 학습하세요.
- 코스
- 60
- 레슨
- 239
자주 묻는 질문
“비용 이해하기: 토큰 계산 및 예산” 강의는 무료인가요?
네 — “비용 이해하기: 토큰 계산 및 예산” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 AI Agents 강의 전체를 잠금 해제할 수 있습니다. AI Agents 강의에는 총 4개의 강의가 포함되어 있습니다.
“비용 이해하기: 토큰 계산 및 예산”에서 뭘 배우나요?
tiktoken으로 토큰을 계산하고, 전송 전에 비용을 추정하며, 요청별 및 일별 예산을 적용해보세요. 브라우저에서 직접 실행하는 실습 코드로 AI Agents을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.
AI Agents을(를) 시작하는 데 경험이 필요한가요?
사전 경험은 필요하지 않습니다. CoddyKit의 AI Agents은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 4번째 강의입니다.
“비용 이해하기: 토큰 계산 및 예산” 강의는 얼마나 걸리나요?
대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.
이 AI Agents 강의에서 코드를 작성하고 실행할 수 있나요?
네. 모든 AI Agents 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.
이 강의의 모든 강의
- OpenAI API 호출: chat.completions
- Anthropic API 호출: messages
- 응답 스트리밍(SSE)
- 비용 이해하기: 토큰 계산 및 예산