AI 도구 · 자동화 · 생산성
12개의 글 · #LLM
Caveman, Ponytail, Mandarin. 커뮤니티에서 입소문 난 토큰 절약 프롬프트 기법 5종을 실제 코딩 작업 140회에 적용했더니, 5종 모두 총 토큰이 늘었다는 실측이 올라왔어요. 관사를 빼고 전보식으로 쓴 Caveman은 약 68% 증가, 최소 지시로 줄인 Pon…
#백테스트 #look-ahead bias #LLM #퀀트트레이딩 #AI 에이전트백테스트 미래정보 누수를 LLM이 잡는다 — 오라클로 오라클을 죽이는 역설2024년 3월, 동료가 짠 백테스트 코드에서 look-ahead bias를 찾느라 오후를 다 썼어요. 종가 데이터를 t+1일 아침 시그널에 쓴 게 문제였죠. 수익률은 연 42%였는데, 그 한 줄 고치자 8%로 떨어졌습니다.
#퀀트트레이딩 #LLM #멀티에이전트 #백테스트 #LangGraphTradingAgents 리뷰 — 멀티에이전트 LLM이 트레이딩 팀을 흉내 낼 때 얻는 것과 잃는 것저희 블로그 파이프라인에서 한 초안이 중복 검사에 다섯 번 걸렸습니다. 원인은 코드블록 들여쓰기 겹침이었는데, 사람이 4-gram을 직접 계산해서야 특정됐어요. TradingAgents는 트레이딩 판단을 8개 역할로 쪼개 LangGraph로 엮은 프레임워크인데, 이런 멀티에이전트 …
#자동화 #LLM #기술부채 #운영 #워크플로우AI 자동화 감사 능력 — 검증할 수 없는 워크플로우의 기술 부채지난달, 제가 6개월 전에 만든 Zapier 워크플로우가 멈췄어요. Airtable에서 데이터를 뽑아 Claude API로 요약하고 Slack에 올리는 자동화였습니다. 문제는 어디서 틀렸는지 찾는 데 3시간이 걸렸다는 겁니다. 저는 이게 진짜 함정이라고 봐요. 자동화는 성공했는데,…
#백테스트 #LLM #퀀트 #룩어헤드 #자동매매 #AILLM 백테스트가 샤프 레이쇼를 부풀리는 이유 — 파라메트릭 미래 누수 방어법백테스트 결과가 의심스럽게 좋았습니다. 샤프 레이쇼 2 넘는데 실거래는 마이너스. point-in-time DB는 깨끗한데 원인은 다른 곳 — LLM이 사전학습 메모리로 미래를 이미 알고 있었던 겁니다. 코드 레벨 look-ahead 방어는 LLM 앞에서 무력화됩니다. 최근 논문 …
#AI자동화 #에이전트 #워크플로우 #LLM #파이프라인AI 자동화 플로우의 진짜 위험 — 환각보다 무서운 4가지 함정과 가드레일지난 6개월간 32마리 AI 에이전트가 돌아가는 블로그 발행 파이프라인을 운영했어요. n8n이나 cron 같은 자동화 도구에 LLM을 끼워넣으면 "완전 자동"이 되겠다는 기대로 시작했죠. 실제로 매일 3편씩 글이 나오긴 합니다. 하지만 그 과정에서 마주친 진짜 위험은 사람들이 떠올…