2026년 9월 15일 (화)
-
Claude Code 2.1.270: git 권한 요청 버그 수정
Claude Code 2.1.270에서 2.1.269에서 도입된 회귀를 수정해, 장시간 실행된 Bash 세션에서 읽기 전용 git 명령이 예상치 않게 권한을 묻던 문제를 해결했다. 해당 릴리스는 불필요한 권한 프롬프트를 제거한다. 장시간 Bash 세션에서 읽기 전용 git 작업을 수행하는 개발자는 이 수정으로 중단을 피할 수 있다.
-
Nari Labs: Qwen3-ASR·TTS, Coval 벤치 선두권
Nari Labs는 Coval 벤치마크에서 Text-to-Speech와 Speech-to-Text 양쪽의 품질-지연 Pareto Frontier에 자리하며 TTS와 STT, 비용-지연, 품질-비용 면에서 우수한 성능을 보였다고 발표했다. Qwen3-ASR Fast는 p50 TTFS 44 ms와 WER 3.6%로 TTFS 1위(WER 2위)를 기록했고, Fast 엔드포인트 가격은 $0.12/시간(표준은 $0.06/시간)이다. Qwen3-TTS Fast는 p50 TTFA 63 ms와 WER 3.8%로 TTFA 2위(WER 1위)를 기록하며 Fast 엔드포인트 가격은 $10/1M 문자(표준 $5/1M)이다. 퍼블릭 베타 API를 이번 주 중 유료 GA로 전환하며 계정 보유자에게 $20 크레딧을 제공할 예정이라고 밝혔다.
-
OpenArch: 가독성 중심 PyTorch LLM 구현 모음
OpenArch는 현대 오픈소스 LLM 아키텍처를 한 파일씩 손수 PyTorch로 구현한 학습용 저장소이다. 각 모델은 논문·참고 config.json 등을 바탕으로 가독성 중심으로 작성되며, ✅ 표시는 forward가 가능한 구현, 🚧 표시는 작업 중임을 뜻한다. 목표 목록은 Architecture Gallery의 72개 아키텍처와 대응하며, 학습 목적과 비교를 위해 설계되었고 프로덕션용이 아닌 학습용으로 사용하라고 명시되어 있다.
-
코드에서 드러난 Siri의 서드파티 모델 위임 구조
macOS/iOS 내부 프레임워크 코드에서 Apple이 Siri 아키텍처를 서드파티 AI 모델과 깊게 연동하도록 설계한 정황이 발견됐다. Model Delegation으로 Claude가 ChatGPT 확장처럼 Siri 확장으로 나타나 사용자가 "Ask Claude"로 Reminders 생성 등 작업을 요청하면 Claude가 자연어를 해석하고 Siri가 시스템 작업을 수행하도록 넘기는 흐름을 보여준다. 또 Model Manager Services의 Inference provider로 Siri의 서버 측 모델을 GPT-5.6 등으로 완전히 대체해 Apple의 planner 프롬프트와 도구 정의를 전달하고, 그 모델이 도구 호출로 시스템 동작과 개인 데이터에 접근해 Siri가 결과를 사용자에게 제공하는 시나리오도 시연됐다. 현재 Ask... 기능은 macOS 27 Golden Gate RC에서 ChatGPT 확장으로 제한되며 Claude는 아직 공개되지 않았고 Apple이 관련 권한을 외부에 개방하지는 않았다; EU의 Digital Markets Act가 이런 접근 설계에 영향을 미쳤을 가능성도 언급된다.
-
GPT-5.6 Luna vs GPT-6 Astra: 코드리뷰 비용·정확도 비교
GPT-5.6 Luna와 GPT-6 Astra를 같은 50개 PR에서 코드리뷰 성능·비용 비교한 결과, Luna는 69개의 검증된 버그를 찾았고 Astra는 92개를 찾았다. 비용 측면에서 Luna 전체 실행 비용은 $0.20, Astra는 $5.66로 Luna가 3.6%의 비용으로 75%의 검증 버그를 찾았고, 검증당 비용은 $0.0030(GPT-5.6) 대 $0.061(GPT-6)였다. 정밀도는 Luna 74% vs Astra 96%로 Luna 쪽이 오탐이 더 많아 인증·권한 관련 코드처럼 민감한 영역에는 단독으로 맡기지 말아야 한다는 평가가 제시됐다. Luna는 평균 23s(출력 토큰 2,104)로 Astra(36s, 688 토큰)보다 빠르고 출력 토큰이 더 많았다고 보고됐다.