tamara는 TypeSafe AI의 Jev가 코딩 에이전트의 compaction을 요약 프롬프트가 아니라, 모든 tool call을 점수 매겨 관련 없는 것을 버리는 즉시 연산으로 바꿀 수 있다고 주장한다. TypeSafe CEO는 KV 캐시에 맞춰 에이전트를 설계하는 일에서 해방된다고 받고, 다른 사용자는 같은 모델을 Falcon-9급 시뮬 착륙에 썼다고 인용한다.
세 층이 한 스레드에 붙어 있다. (a) GitHub 플러그인이 도구 호출을 점수화해 지우는 메커니즘은 README·라이선스·기본값까지 대조된다. (b) TypeSafe의 속도·가격·환각 0은 랩 1차 자료이며 같은 글이 노트북 RTT·보조금 가능성을 스스로 적는다. (c) Falcon-9 착륙은 저자 주장의 MuJoCo 시뮬이며 독립 텔레메트리가 없다.
종합 C
확인 가능한 것은 플러그인 스펙뿐이고, 속도·환각은 1차 마케팅, 로켓은 미검증 시뮬 일화라 스레드 전체를 사실로 읽으면 안 된다.
Anthropic 문서가 직접 적는다. /compact는 “대화를 요약해 컨텍스트를 비운다”. 프롬프트 캐시 문서는 compaction이 “메시지 히스토리를 요약으로 교체”하며, 그 요약을 만들기 위해 “같은 시스템 프롬프트·도구·히스토리에 요약 지시를 마지막 사용자 메시지로 붙여 별도 요청”을 보낸다고 한다. 컨텍스트 창 문서는 “대화를 구조화 요약으로 교체한다”, 비용 문서는 auto-compaction이 “한도에 가까워지면 대화 히스토리를 요약한다”고 한다. 같은 제품에 옛 도구 결과를 지우는 별도 경로도 있으나, 이름 붙은 compaction은 요약 요청이다. 2026년 모든 에이전트의 전수 조사는 아니다.
Jev가 모든 tool call을 점수화해 관련 없는 것을 버리면 compaction이 instant가 된다.
라이브러리는 언핀된 tool_use/tool_result 쌍마다 noul 질문 두 개(호출이 아직 필요한가 / 결과를 전문으로 남겨야 하는가)를 보내고 keepThreshold(기본 0.5)로 keep / truncate / drop을 고른다. 첫 메시지와 최근 preserveRecentMessages는 핀이라 “모든” 호출이 아니다. 사용자·어시스턴트 텍스트는 출력에서 지우지 않는다. README의 “한 번의 빠른 요청”과 달리 질문은 maxRequestTokens 30k에 맞춰 배치가 갈리고 같은 state를 반복 전송한다. Instant는 요약 LLM 왕복 대비 상대어이지 측정된 지연이 아니다. 확률은 삭제 안전의 증명이 아니라고 README가 적는다.
tamaratran/fast-jev-compaction은 MIT Claude Code 플러그인이고, Jev noul로 tool pair를 점수화하며 기본값이 keepThreshold 0.5 / preserveRecent 6 / state 25k / request 30k / jev-latest / https://api.typesafe.ai/v1/systemone이다.
GitHub API: 생성 2026-09-17T05:57:20Z, 라이선스 MIT, 언어 TypeScript. 별은 파이프라인 캡처 976, 이 검증 조회 1047. LICENSE 원문은 MIT, Copyright (c) 2025 (홀더 이름 없음). .claude-plugin/plugin.json 설명은 “Verbatim Jev-guided compaction for Claude Code sessions.” README 옵션 표가 위 기본값을 그대로 적는다. 훅은 Claude Code 2.1.274+ function hooks와 CLAUDE_CODE_ENABLE_FUNCTION_HOOKS를 요구한다고 저장소가 적는다.
수치와 문구는 전부 TypeSafe 1차 자료다. 소개 글(Diogo Almeida, 표기 2026-09-15)은 입력 “$0.042 / MTok”, “70ms-500ms”, “typed probabilistic decisions”, “calibrated probabilities and confidence scores”, “can’t hallucinate”를 쓴다. 같은 글이 West Coast 노트북 근접 측정, “We can’t prove it isn’t subsidized”, 스키마 일치 0%는 실험치가 아니라 보장이라고 적는다. 홈의 “193.6× faster, 444.6× cheaper”도 자사 워크플로 벤치다. evals.typesafe.ai도 자사 페이지이며 제3자 감사를 인용하지 않는다. 스키마 준수와 사실 오류(환각)는 다른 축이다.
Diogo Almeida는 TypeSafe CEO이며 InstructGPT(Ouyang et al. 2022, arXiv:2203.02155) 공동저자다.
팀 페이지는 창업자 CEO로 적는다. arXiv·NeurIPS 2022 저자 줄에 Diogo Almeida가 있다 (Long Ouyang, Jeff Wu, Xu Jiang, Diogo Almeida, …). 스레드 답글 핸들 @CompleteSkeptic, 시각 2026-09-17T21:46:02.000Z. 팀 카피 “co-invented RLHF”는 InstructGPT 공저보다 넓다. RLHF의 대표 출전은 Christiano et al.이며 Almeida는 InstructGPT 저자 목록의 한 명이다.
Utkarsh가 Jev에 Falcon-9급 로켓 전 권한을 줘 MuJoCo에서 245회·$0.04·~1Hz/~0.4s·12 runs·42m/425t/9 engines로 부스터를 착륙시켰다.
원글 2026-09-17T20:57:15Z, 인용 리플라이 21:49:45Z. 숫자는 저자 주장이다. 본인이 “for sim I used mujoco”라고 했고, 코드·로그·재현 패키지는 “정리 후 오픈소스” 예고만 있다. 실로켓 텔레메트리가 아니다. “사람을 우주에 보낼 수 있다”는 비유이지 비행 증명이 아니며, compaction 플러그인이 맞다는 증거도 아니다.
Anthropic 문서: 캐시는 요청 접두 일치이고, compaction(히스토리를 요약으로 교체)은 대화 층을 무효화한다. 중간 옛 도구 결과를 지우면 그 지점 이후 접두가 바뀌므로 캐시 재사용이 깨진다. 이 플러그인은 최근 메시지가 아니라 언핀된 옛 호출을 지우므로 “접두를 유지한 채 뒤만 자른다”가 아니다. Almeida 문장은 가설·슬로건이다. 값싼 drop이 캐시 친화 설계의 필요를 줄일 수는 있으나, 출하된 제품 보장이 아니다.