AI 도구 · 자동화 · 생산성
7월 7일, Claude 사용 패턴이 바뀝니다. Fable 5 모델이 주간 사용량 50% 한도 제약을 받다가 이후에는 usage credit 기반으로 완전 전환되거든요. 코딩 작업 일부는 Opus 4.8로 자동 폴백된다는 공지도 나왔어요 출처: Reddit r/ClaudeAI 공식…
#Sonnet 5 #토큰 효율 #비용 최적화 #Claude 가격 #모델 선택Sonnet 5 할인가 함정 — 토큰 2배 생성으로 실비용이 Opus 4.8과 같아지는 이유Sonnet 5 할인가를 보고 바로 구독했더니 첫 주말에 예산이 터졌어요. 같은 코드 리뷰를 Opus 4.8로 돌렸을 때보다 청구액이 거의 같았거든요. 할인가는 분명 절반인데 왜일까요?
#Sonnet 5 #모델 성향 #프롬프트 전략 #LLM 상호작용 #협업 모드Sonnet 5는 '증명하려는' 모델 — 성능지향 성향을 이해하고 협업 모드로 다루는 법Sonnet 5한테 코드 리팩토링 부탁했는데, 요청하지도 않은 테스트 케이스까지 달아서 돌려준 적 있으신가요? 저도 처음엔 친절한가 보다 싶었어요. 그런데 며칠 쓰다 보니 패턴이 보이더라고요. 이 모델은 제가 던진 요청을 '증명 과제'로 받아들이는 것 같았어요. 저는 Sonnet …
#Claude #API #구독 #비용최적화 #LLMClaude API vs Claude Pro Max — 실제 비용 계산과 선택 기준지난달 Anthropic API 청구서를 열었을 때, $1,247이 찍혀 있었어요. Sonnet을 매일 코드 리뷰에 돌리고 Opus로 문서 작업을 맡기다 보니 어느새 이 정도가 됐더라고요. "Max 구독으로 바꾸면 $100로 끝나는 거 아냐?"라는 생각이 들었지만, 막상 계산해보니…
#ExtendedThinking #AI UX #생산성 #LLM #추론모드Extended Thinking은 성능이 더 좋은데 왜 다들 끌까 — UX 마찰의 생산성 비용ChatGPT Pro에 Extended Thinking 모드가 생긴 지 석 달쯤 됐을 때, 저는 이 기능을 끄고 있었어요. MATH 벤치마크에서 12% 더 높은 정확도를 내는 추론 모드를 왜 꺼두냐고요? 매번 클릭 한 번 더 하고, 15초씩 더 기다리는 게 귀찮았거든요. r/Ope…
#GLM #Claude #LLM벤치마크 #모델비교 #AI도구GLM 5.2가 Claude를 이겼다는 벤치마크 — 숫자 뒤를 의심하는 법MMLU 88.3% vs 87.9%. 0.4%p 차이로 중국 LLM이 Claude를 넘어섰다는 발표가 나왔다. 제가 확인한 공식 벤치마크 결과는 분명했지만, 실제로 같은 번역 작업을 두 모델에 맡겼을 때 체감 격차는 거꾸로였어요. 벤치마크 우위가 실무 선택을 바꿔야 할 이유는 아니…