← 아카이브

2026년 8월 15일 (토)

  1. Claude Code 2.1.232 주요 변경사항

    Claude Code 2.1.232에서 기본적으로 subagent forking이 켜졌고, `subagent_type: "fork"`인 subagent가 전체 대화 및 프롬프트 캐시를 상속합니다. 프롬프트에 `@`를 쳐서 다른 Claude 세션을 이름으로 호출할 수 있고, SendMessage는 라이브 세션과 정확히 일치하는 맨명(bare name)에 바로 전달합니다. 인터랙티브 세션 이름 충돌 처리, `/config`에 Dialog expiry 및 교차-세션 수신 설정 추가, GitLab 토큰 계열의 비밀 마스킹과 `glpat-`/`gldt-` 토큰 완전 마스킹, GitLab 리포지토리 마켓플레이스 복제 지원 등이 포함됩니다. Gateway 설정 검증 강화와 여러 권한/접근성 우회·연결·원격 제어 관련 보안·신뢰성 버그 수정들도 포함됩니다.

    raw.githubusercontent.com

  2. Cursor가 SpaceX에 인수됨

    Cursor가 SpaceX에 공식 인수되었습니다. 이번 인수는 4월에 발표한 SpaceXAI와의 파트너십에서 시작된 절차의 완료입니다. SpaceX의 대규모 GPU 플릿에 접근하게 되어 더 강력하고 운영 비용이 낮은 모델을 개발할 수 있으며, 최근 공개한 Grok 4.6은 그 협업의 초기 결과를 보여줍니다. Cursor는 앞으로 SpaceX의 컴퓨팅을 활용해 더 유용한 AI 도구를 제공하겠다는 계획입니다.

    cursor.com

  3. Claude Code 세션 비용과 토큰 효율화 팁

    Claude Code 세션의 비용은 모델, 입력/출력 토큰 여부, 캐시 여부 등 세 요소가 결정하며, 실제로는 토큰당 모델 추론(인퍼런스) 시간에 대한 요금을 지불합니다. 요청은 prefill(입력 토큰 읽기)과 decode(출력 토큰 생성)의 두 단계로 GPU를 사용하고, decode의 출력 토큰은 입력보다 대략 5배 비용이 듭니다. 출력 토큰 중 많은 부분이 모델의 사고(think) 토큰이며, `/effort`로 제어되는 노력 수준이 이 사고량에 영향을 줍니다. 따라서 문제 난이도에 맞는 모델을 선택하고 토큰이 실제 요청에 쓰이도록 세션을 설계하는 것이 효율성의 핵심입니다.

    claude.com

  4. Graft — Claude Code 토큰 절감 훅

    Graft는 Claude Code용 훅으로, 리포지토리 내용을 그래프로 구성해 에이전트가 매번 리포지토리를 재탐색하는 오버헤드를 줄입니다. `graft init`과 `graft build`로 .claude/에 연결하며 graft/은 로컬 재생성 가능 캐시로 .gitignore에 추가됩니다. 162회 벤치마크에서 Graft는 Cold 대비 정확도를 66%로 개선(Cold 54%)했고, push(preset 주입)와 pull(요청 시 검색) 방식 모두 성능·정확성 이득을 보였으며 pull은 정확도 98%를 기록했습니다. 측정은 동일 에이전트·동일 파일 도구 조건에서 수행되었습니다.

    github.com

  5. Lumabri — P2P로 Moe 모델 실행

    Lumabri는 colibri 엔진 기반으로 P2P 스웜에서 mixture-of-experts 모델을 실행하는 도구로, 순수 C로 작성되어 의존성이 없습니다. 한 대가 모델을 호스팅하면 다른 머신은 필요한 바이트를 처음 이용할 때만 네트워크로 받아 로컬 미러에 저장해 이후 빠르게 제공하며, CPU만 있어도 동작하고 GPU는 속도 개선 요소입니다. serve는 트래커와 maintainer를 운영하고, chat은 LD_PRELOAD 기반의 liblumabri.so로 파일 블록을 요구 시 페어에서 가져와 희소(sparse) 로컬 미러로 동작하며 ~/.lumabri/cas에 콘텐츠 주소화된 청크를 저장합니다. 네트워크는 바이트의 출처만 바꿀 수 있고 바이트 정체성은 검증되며, 모델 파일 쓰기는 읽기전용(EROFS), 유실 블록은 명시적 에러(EIO)를 냅니다.

    github.com