2026년 8월 15일 (토)
-
Claude Code 2.1.232 주요 변경사항
Claude Code 2.1.232에서 기본적으로 subagent forking이 켜졌고, `subagent_type: "fork"`인 subagent가 전체 대화 및 프롬프트 캐시를 상속합니다. 프롬프트에 `@`를 쳐서 다른 Claude 세션을 이름으로 호출할 수 있고, SendMessage는 라이브 세션과 정확히 일치하는 맨명(bare name)에 바로 전달합니다. 인터랙티브 세션 이름 충돌 처리, `/config`에 Dialog expiry 및 교차-세션 수신 설정 추가, GitLab 토큰 계열의 비밀 마스킹과 `glpat-`/`gldt-` 토큰 완전 마스킹, GitLab 리포지토리 마켓플레이스 복제 지원 등이 포함됩니다. Gateway 설정 검증 강화와 여러 권한/접근성 우회·연결·원격 제어 관련 보안·신뢰성 버그 수정들도 포함됩니다.
-
Cursor가 SpaceX에 인수됨
Cursor가 SpaceX에 공식 인수되었습니다. 이번 인수는 4월에 발표한 SpaceXAI와의 파트너십에서 시작된 절차의 완료입니다. SpaceX의 대규모 GPU 플릿에 접근하게 되어 더 강력하고 운영 비용이 낮은 모델을 개발할 수 있으며, 최근 공개한 Grok 4.6은 그 협업의 초기 결과를 보여줍니다. Cursor는 앞으로 SpaceX의 컴퓨팅을 활용해 더 유용한 AI 도구를 제공하겠다는 계획입니다.
-
Claude Code 세션 비용과 토큰 효율화 팁
Claude Code 세션의 비용은 모델, 입력/출력 토큰 여부, 캐시 여부 등 세 요소가 결정하며, 실제로는 토큰당 모델 추론(인퍼런스) 시간에 대한 요금을 지불합니다. 요청은 prefill(입력 토큰 읽기)과 decode(출력 토큰 생성)의 두 단계로 GPU를 사용하고, decode의 출력 토큰은 입력보다 대략 5배 비용이 듭니다. 출력 토큰 중 많은 부분이 모델의 사고(think) 토큰이며, `/effort`로 제어되는 노력 수준이 이 사고량에 영향을 줍니다. 따라서 문제 난이도에 맞는 모델을 선택하고 토큰이 실제 요청에 쓰이도록 세션을 설계하는 것이 효율성의 핵심입니다.
-
Graft — Claude Code 토큰 절감 훅
Graft는 Claude Code용 훅으로, 리포지토리 내용을 그래프로 구성해 에이전트가 매번 리포지토리를 재탐색하는 오버헤드를 줄입니다. `graft init`과 `graft build`로 .claude/에 연결하며 graft/은 로컬 재생성 가능 캐시로 .gitignore에 추가됩니다. 162회 벤치마크에서 Graft는 Cold 대비 정확도를 66%로 개선(Cold 54%)했고, push(preset 주입)와 pull(요청 시 검색) 방식 모두 성능·정확성 이득을 보였으며 pull은 정확도 98%를 기록했습니다. 측정은 동일 에이전트·동일 파일 도구 조건에서 수행되었습니다.
-
Lumabri — P2P로 Moe 모델 실행
Lumabri는 colibri 엔진 기반으로 P2P 스웜에서 mixture-of-experts 모델을 실행하는 도구로, 순수 C로 작성되어 의존성이 없습니다. 한 대가 모델을 호스팅하면 다른 머신은 필요한 바이트를 처음 이용할 때만 네트워크로 받아 로컬 미러에 저장해 이후 빠르게 제공하며, CPU만 있어도 동작하고 GPU는 속도 개선 요소입니다. serve는 트래커와 maintainer를 운영하고, chat은 LD_PRELOAD 기반의 liblumabri.so로 파일 블록을 요구 시 페어에서 가져와 희소(sparse) 로컬 미러로 동작하며 ~/.lumabri/cas에 콘텐츠 주소화된 청크를 저장합니다. 네트워크는 바이트의 출처만 바꿀 수 있고 바이트 정체성은 검증되며, 모델 파일 쓰기는 읽기전용(EROFS), 유실 블록은 명시적 에러(EIO)를 냅니다.