AI 코딩 요금, 쓰는 습관이 가른다
앤스로픽이 공개한 클로드 코드 토큰 절약 6가지 실전 수칙
클로드 코드 토큰 청구서, 어디서 새는지 찾는다
로컬 로그만 읽어 회수 가능한 지출을 금액으로 — 업로드는 없다
싼 모델 셋을 역할별로 조립했다
코딩은 딥시크, 이미지 판독은 루나, 검색은 안티그래비티. 분업형 셋업이 등장했다.
중국 모델로 배워도 검열은 안 따라왔다
152쌍 대조 실험 — 금융 추론은 오르고 정치 검열은 전이되지 않았다
클로드·코덱스를 한 세션으로 묶는 '탠덤'
한도에 걸려도 그대로 이어서 — 구독 두 개를 활주로 하나로
30초 캐시 핑, API 요금 8배 낭비하고 있다
프롬프트 캐시 keepalive 4사 실측 — 정답은 4분 간격, 업체별로 손익도 갈린다
어떤 LLM이든 코덱스·클로드 코드에 붙인다
구독 하나에 묶이지 않고 저렴한 모델·로컬 LLM을 코딩 도구에 연결하는 오픈소스 프록시.
넉 달 만에 오푸스 넘은 GPT-5.6, 실전 교체기
절반 시간·27% 저렴, 대신 도구 스키마·캐시 손봐야 했다
클로드가 지휘, 저가 AI가 실행…코딩 비용 15배 절감
클로드 코드가 코덱스·커서 모델을 하위 에이전트로 부리는 오픈소스 CLI 공개
AI 코딩 비용, 자동 라우팅으로 절감
프롬프트 난이도 읽어 싼 모델로 넘기는 게이트웨이 '브릭'
클로드 워크플로를 코덱스로 돌려 토큰값 아끼기
클로드 코드의 워크플로 스크립트를 수정 없이 코덱스에서 실행해 실행 비용을 분리하는 오픈소스 런타임이 등장했다
에이전트 코딩, 3분에 수십 원으로 끝냈다
값싼 오픈 모델과 가상머신 격리로 비용·보안 둘 다 잡은 에이전트 코딩 실험기
클로드 구독 없이 클로드 코드 멀티에이전트
딥시크·GLM·코덱스 등 외부 모델을 클로드 코드 작업자로 붙이는 오픈소스 cc-fleet
가벼운 작업은 작은 모델에…클로드 코드 비용 줄이기
제로GPU 라우터 플러그인, 분류·추출·PII 마스킹을 전문 소형모델로 자동 분기
코드 유출 없이 커서에 로컬 AI를 꽂는다
Locaible, 내 컴퓨터에서만 도는 AI 에이전트를 커서·컨티뉴에 연결하는 도구
코드 한 줄도 안 새어나간다… 커서서 도는 로컬 AI
클라우드 대신 내 컴퓨터에서 — 토큰 비용 0, 고객 코드 보안까지