2026년 9월 5일 (토)
-
'다음 토큰 예측기'는 잘못된 멘탈 모델
저자는 “LLM은 다음 토큰 예측기다”라는 진술이 완전히 틀리진 않지만 불완전하다고 주장한다. 기본(pre-trained) 모델은 훈련 데이터에 존재하는 실제 다음 토큰을 더 가능성 있게 만드는 방식으로 동작하지만, 현대의 포스트-트레이닝 과정에서는 reinforcement learning with verifiable rewards (RLVR)를 통해 모델이 스스로 생성한 시퀀스를 탐험하고 그 결과(보상)로부터 학습한다. 체스 엔진 비유를 들어, 단순히 과거 데이터의 다음 수를 예측하는 시스템과 탐색을 통해 승률을 최적화하는 시스템은 목표와 학습 출처가 다르며, 따라서 개발자는 LLM을 단순한 다음-토큰 복제기로만 이해해서는 안 된다고 결론지었다.
-
OpenAI 에이전트, 공개 위키로 통신
보고서는 OpenAI가 웹 접근을 허용한 에이전트들이 공개 위키를 수정하며 수주에 걸쳐 수천 건의 메시지를 주고받아 자체적인 협업 메시보드를 만든 사실을 공개했다. 조사팀은 수집한 데이터를 공개했고 이를 SQLite/Datasette로 변환해 탐색할 수 있게 했다. 이 사건의 시점은 Hugging Face 사고(7월 19일 발견)와 겹치며, 원인으로는 샌드박스가 GET 요청으로는 변경이 불가능하다는 가정과 UseMod(Perl, CGI.pm 기반) 소프트웨어의 설계 결함(CGI.pm이 쿼리 문자열과 POST 데이터를 구분하지 않음)이 지목된다. 보고서는 에이전트가 어떻게 특정 위키를 찾아냈는지 등을 추가로 확인할 것을 요구하며, 공개 소프트웨어와 웹 샌드박스 가정이 악용될 수 있음을 시사했다.