AI 도구 · 자동화 · 생산성
5개의 글 · #Claude API
지난주 고객 문의 자동응답 에이전트를 만들다가 3시간을 날렸어요. Claude가 제공한 도구를 계속 무시하고 텍스트로만 답하더라고요. 원인은 JSON 스키마에서 required 필드 누락이었습니다.
#로컬LLM #Ollama #Claude API #LLM 비교 #자동화로컬 LLM은 정말 빠를까 — Ollama와 Claude API를 동일 작업으로 실측한 결과Ollama로 로컬 모델을 돌렸더니 응답이 1.2초 만에 왔습니다. API는 2.8초였어요. "역시 로컬이 빠르네"라고 생각했는데, 같은 스크립트를 10분 돌렸더니 브라우저가 멈춰 있더군요. 추론 시간만 재면 이기지만, 엔드-투-엔드 체감과 다른 작업 블로킹까지 보면 이야기가 달라…
#Claude API #Batch API #LLM 비용 절감 #프롬프트 캐싱 #자동화Claude Batch API로 LLM 추론 비용 절반 줄이기 — 실전 절차매달 Claude API 비용이 몇백 달러씩 나가는데, 실시간 응답이 필요 없는 작업까지 실시간 API로 돌리고 있지 않나요? Batch API를 쓰면 입력·출력 토큰 비용을 정확히 50% 줄일 수 있습니다. 일일 요약, 대량 분류, 데이터 추출처럼 "지금 당장 결과가 필요하지 않…
#GitHub Actions #코드리뷰 #AI 자동화 #Claude API #PR 워크플로우AI 코드리뷰 자동화 — PR마다 LLM이 버그를 먼저 잡게 하기PR 하나 올릴 때마다 팀원을 기다리는 시간이 아까웠어요. 혼자 개발하는 프로젝트라면 더 막막하죠. 이 글을 읽고 나면 GitHub Actions로 모든 PR에 Claude API를 붙여서, 사람보다 먼저 버그·보안 이슈를 자동으로 지적받을 수 있게 됩니다. 실제 워크플로우 YAM…
#프롬프트 캐싱 #Claude API #API 비용 절감 #LLM 자동화 #AnthropicClaude 프롬프트 캐싱으로 API 비용 60% 절감한 실전 가이드지난달 Claude API 청구서를 열어보니 $243이 찍혀 있었어요. 같은 시스템 프롬프트 8만 토큰을 매번 통째로 보내고 있었다는 걸 그제야 깨달았죠. 프롬프트 캐싱을 켜자 다음 달 청구서는 $92로 내려왔습니다. 62% 절감이었습니다.