X · 2026-09-17

@typesafeai Jev의 완벽한 사용처: 즉시 compaction

요약 프롬프트로 히스토리를 다시 쓰지 말고, 도구 호출에 점수를 매겨 지운다. 남는 토큰은 원문이다.

읽기 전에

컨텍스트가 꽉 찼을 때 에이전트가 줄여야 하는 것은 이야기인가, 도구 호출인가.

에이전트 컨텍스트는 소설이 아니라 도구 로그다. Compaction은 그 로그를 다시 쓰는 요약 프롬프트가 아니라, 호출과 결과를 한 번에 점수화해 낡은 줄을 지우거나 자르는 필터다. 남는 토큰은 원문 그대로다. 다시 쓰면 캐시가 깨지고, 지우면 트래픽만 줄어든다.

권장 순서와 소요.

  1. 루트 트윗 네 줄. 주장의 전부다. “왜 아직 요약 프롬프트인가”가 질문이고, 답은 점수화 후 삭제다.
  2. 셀프 리플라이의 저장소 설명 한 줄. 한 번의 빠른 요청으로 점수 → 삭제/절단, 남긴 것은 verbatim. 5초 영상은 포스터만 보면 된다.
  3. Executive Summary의 주장 목록. 그다음 Diogo Almeida의 KV 캐시 답글과 tamara의 “코딩 에이전트 primitive를 Jev가 대체할 수 있다”.
  4. 팩트체크. Jev 가격·지연, 플러그인 범위, 로켓 시뮬은 compaction 성공 증거가 아니다.
  5. 여유가 있으면 완역과 Utkarsh 인용. Falcon-9급 MuJoCo는 같은 모델의 다른 일 — 빠른 분류기가 실시간 제어에 쓰일 수 있다는 주장이다.

요약만 4분. 스레드·인용·저장소 설명까지 완독 12분.

  1. 요약 compaction과 점수화 compaction에서, 살아남은 토큰의 바이트가 같은가. 같지 않다면 무엇이 바뀌었나.
  2. 중간 도구 결과를 지우면 KV 캐시는 어디서부터 깨지는가. Diogo가 말한 “캐시 중심 설계”가 성립하려면 어떤 편집만 허용해야 하는가.
  3. 245회·0.04달러의 Falcon-9 시뮬 착륙은 fast-jev-compaction이 맞다는 증거인가, Jev가 빠르다는 다른 사용처인가.

Executive Summary

tamara는 TypeSafe AI의 Jev가 코딩 에이전트의 compaction을 요약 프롬프트가 아니라, 모든 tool call을 점수 매겨 관련 없는 것을 버리는 즉시 연산으로 바꿀 수 있다고 주장한다. TypeSafe CEO는 KV 캐시에 맞춰 에이전트를 설계하는 일에서 해방된다고 받고, 다른 사용자는 같은 모델을 Falcon-9급 시뮬 착륙에 썼다고 인용한다.

저자

tamara (@tamarajtran)

시각

2026-09-17T21:13:04.000Z

형태

루트 + 셀프 리플라이 + 대화 리플라이 6개 게시물 (긴 셀프 스레드 아님)

제품

@typesafeai Jev

5,896

루트 좋아요 (캡처 시점)

332

루트 리트윗

222

루트 리플라이

912,009

루트 조회

129

루트 인용

4,075

루트 북마크

루트 — instant compaction

루트 트윗 5초 데모 영상 포스터 (fast-jev-compaction)
루트에 붙은 5초 데모 포스터. Jev가 tool call을 점수화해 compaction하는 화면.

셀프 리플라이 — fast-jev-compaction

976

GitHub 별 (캡처 시점)

42

포크

7

열린 이슈

MIT

라이선스

TS

주 언어 TypeScript

2026-09-17

저장소 생성일

tamaratran/fast-jev-compaction GitHub 카드
셀프 리플라이에 붙은 GitHub 카드. Claude Code 플러그인으로 compaction 요약을 Jev 결정으로 바꾼다.

Diogo Almeida — KV 캐시에서 해방

Utkarsh — “아니면 사람을 우주로 보낼 수도”

인용된 Falcon-9급 MuJoCo 시뮬 영상 포스터
인용 원글의 122초 시뮬 포스터. Jev가 Falcon-9급 부스터를 발사부터 착륙까지 조종했다고 주장하는 장면.
245

Jev 호출 수

$0.04

API 호출 비용

~1 Hz

Jev 의사결정 주기

~0.4 s

출력 지연

0.8 s

기체 불안정 주기 (원문 “ubstable every .8 secs”)

12

착륙 성공까지 실험 횟수

42 m

부스터 길이

425 t

질량 (원문 425 tonnes)

9

엔진 수

5

착륙 번에서 Jev가 스스로 고른 엔진 수

tamara 후속

캡처 시 보강된 제품 맥락 (트윗 본문 밖)

source.json의 typesafe_context. 트윗 주장이 아니라 캡처 파이프라인이 붙인 맥락이다.


팩트체크

세 층이 한 스레드에 붙어 있다. (a) GitHub 플러그인이 도구 호출을 점수화해 지우는 메커니즘은 README·라이선스·기본값까지 대조된다. (b) TypeSafe의 속도·가격·환각 0은 랩 1차 자료이며 같은 글이 노트북 RTT·보조금 가능성을 스스로 적는다. (c) Falcon-9 착륙은 저자 주장의 MuJoCo 시뮬이며 독립 텔레메트리가 없다.

종합 C

확인 가능한 것은 플러그인 스펙뿐이고, 속도·환각은 1차 마케팅, 로켓은 미검증 시뮬 일화라 스레드 전체를 사실로 읽으면 안 된다.

✅사실

2026년에도 코딩 에이전트 compaction의 기본 경로는 요약 프롬프트다 (Claude Code /compact).

Anthropic 문서가 직접 적는다. /compact는 “대화를 요약해 컨텍스트를 비운다”. 프롬프트 캐시 문서는 compaction이 “메시지 히스토리를 요약으로 교체”하며, 그 요약을 만들기 위해 “같은 시스템 프롬프트·도구·히스토리에 요약 지시를 마지막 사용자 메시지로 붙여 별도 요청”을 보낸다고 한다. 컨텍스트 창 문서는 “대화를 구조화 요약으로 교체한다”, 비용 문서는 auto-compaction이 “한도에 가까워지면 대화 히스토리를 요약한다”고 한다. 같은 제품에 옛 도구 결과를 지우는 별도 경로도 있으나, 이름 붙은 compaction은 요약 요청이다. 2026년 모든 에이전트의 전수 조사는 아니다.

code.claude.com/docs/en/commands · prompt-caching (Compacting the conversation) · context-window (What survives compaction) · costs (auto-compaction)

🟡부분사실

Jev가 모든 tool call을 점수화해 관련 없는 것을 버리면 compaction이 instant가 된다.

라이브러리는 언핀된 tool_use/tool_result 쌍마다 noul 질문 두 개(호출이 아직 필요한가 / 결과를 전문으로 남겨야 하는가)를 보내고 keepThreshold(기본 0.5)로 keep / truncate / drop을 고른다. 첫 메시지와 최근 preserveRecentMessages는 핀이라 “모든” 호출이 아니다. 사용자·어시스턴트 텍스트는 출력에서 지우지 않는다. README의 “한 번의 빠른 요청”과 달리 질문은 maxRequestTokens 30k에 맞춰 배치가 갈리고 같은 state를 반복 전송한다. Instant는 요약 LLM 왕복 대비 상대어이지 측정된 지연이 아니다. 확률은 삭제 안전의 증명이 아니라고 README가 적는다.

github.com/tamaratran/fast-jev-compaction · README (raw) · docs.typesafe.ai/primitives/noul

✅사실

tamaratran/fast-jev-compaction은 MIT Claude Code 플러그인이고, Jev noul로 tool pair를 점수화하며 기본값이 keepThreshold 0.5 / preserveRecent 6 / state 25k / request 30k / jev-latest / https://api.typesafe.ai/v1/systemone이다.

GitHub API: 생성 2026-09-17T05:57:20Z, 라이선스 MIT, 언어 TypeScript. 별은 파이프라인 캡처 976, 이 검증 조회 1047. LICENSE 원문은 MIT, Copyright (c) 2025 (홀더 이름 없음). .claude-plugin/plugin.json 설명은 “Verbatim Jev-guided compaction for Claude Code sessions.” README 옵션 표가 위 기본값을 그대로 적는다. 훅은 Claude Code 2.1.274+ function hooks와 CLAUDE_CODE_ENABLE_FUNCTION_HOOKS를 요구한다고 저장소가 적는다.

api.github.com/repos/tamaratran/fast-jev-compaction · README · LICENSE · plugin.json

⚠️불확실

Jev/System One은 typed decision, 보정된 확률, 입력 $0.042/MTok, 70–500ms, 환각 불가(타입 에러 0)이다.

수치와 문구는 전부 TypeSafe 1차 자료다. 소개 글(Diogo Almeida, 표기 2026-09-15)은 입력 “$0.042 / MTok”, “70ms-500ms”, “typed probabilistic decisions”, “calibrated probabilities and confidence scores”, “can’t hallucinate”를 쓴다. 같은 글이 West Coast 노트북 근접 측정, “We can’t prove it isn’t subsidized”, 스키마 일치 0%는 실험치가 아니라 보장이라고 적는다. 홈의 “193.6× faster, 444.6× cheaper”도 자사 워크플로 벤치다. evals.typesafe.ai도 자사 페이지이며 제3자 감사를 인용하지 않는다. 스키마 준수와 사실 오류(환각)는 다른 축이다.

introducing-system-one-models-and-jev · typesafe.ai · docs.typesafe.ai · evals.typesafe.ai

✅사실

Diogo Almeida는 TypeSafe CEO이며 InstructGPT(Ouyang et al. 2022, arXiv:2203.02155) 공동저자다.

팀 페이지는 창업자 CEO로 적는다. arXiv·NeurIPS 2022 저자 줄에 Diogo Almeida가 있다 (Long Ouyang, Jeff Wu, Xu Jiang, Diogo Almeida, …). 스레드 답글 핸들 @CompleteSkeptic, 시각 2026-09-17T21:46:02.000Z. 팀 카피 “co-invented RLHF”는 InstructGPT 공저보다 넓다. RLHF의 대표 출전은 Christiano et al.이며 Almeida는 InstructGPT 저자 목록의 한 명이다.

typesafe.ai/team · arXiv:2203.02155 · NeurIPS 2022 초록 · x.com/CompleteSkeptic/status/2100702845779775675

⚠️불확실

Utkarsh가 Jev에 Falcon-9급 로켓 전 권한을 줘 MuJoCo에서 245회·$0.04·~1Hz/~0.4s·12 runs·42m/425t/9 engines로 부스터를 착륙시켰다.

원글 2026-09-17T20:57:15Z, 인용 리플라이 21:49:45Z. 숫자는 저자 주장이다. 본인이 “for sim I used mujoco”라고 했고, 코드·로그·재현 패키지는 “정리 후 오픈소스” 예고만 있다. 실로켓 텔레메트리가 아니다. “사람을 우주에 보낼 수 있다”는 비유이지 비행 증명이 아니며, compaction 플러그인이 맞다는 증거도 아니다.

x.com/uttkarsh_42/status/2100690568947159309 · 인용 리플라이

🟡부분사실

도구 결과를 지우면 코딩 에이전트를 KV cache에 맞춰 설계하는 일에서 해방된다.

Anthropic 문서: 캐시는 요청 접두 일치이고, compaction(히스토리를 요약으로 교체)은 대화 층을 무효화한다. 중간 옛 도구 결과를 지우면 그 지점 이후 접두가 바뀌므로 캐시 재사용이 깨진다. 이 플러그인은 최근 메시지가 아니라 언핀된 옛 호출을 지우므로 “접두를 유지한 채 뒤만 자른다”가 아니다. Almeida 문장은 가설·슬로건이다. 값싼 drop이 캐시 친화 설계의 필요를 줄일 수는 있으나, 출하된 제품 보장이 아니다.

Diogo 답글 · prompt-caching (prefix match, compaction invalidates conversation layer) · README (핀·옛 호출 drop)

⚠️불확실

코딩 에이전트 primitive 상당수를 Jev로 대체할 수 있다.

tamara의 2026-09-17T21:50:36Z 의견·예측. 이 저장소가 실제로 건드리는 것은 compaction 요약 한 조각이다. TypeSafe 소개 글이 Jev의 일을 typed decision으로 적지만, “상당수 primitive”의 범위·측정은 없다.

x.com/tamarajtran/status/2100703995006447811 · System One 소개


원본 (완역)

루트 트윗

tamara (@tamarajtran) · 2026-09-17T21:13:04.000Z

@typesafeai Jev의 완벽한 사용처를 찾았다:

즉시 compaction

2026년에, 왜 compaction은 아직도 요약 프롬프트인가?

Jev는 모든 tool call에 점수를 매기고 관련 없는 것을 버려서, 이를 즉시로 만들 수 있다

루트 트윗 5초 데모 영상 포스터 (fast-jev-compaction)
5초 데모 영상 포스터. 원본 영상은 X에서만. 다운로드 변환 안 함

pic.x.com/h6NzKzNpCg

이어지는 저장소 링크

tamara (@tamarajtran) · 2026-09-17T21:13:04.000Z

run fast-jev-compaction: https://github.com/tamaratran/fast-jev-compaction

GitHub 카드: tamaratran/fast-jev-compaction
GitHub 카드 — tamaratran/fast-jev-compaction (github.com)

답글 — Diogo Almeida

Diogo Almeida (@CompleteSkeptic) · 2026-09-17T21:46:02.000Z

@tamarajtran @typesafeai 맞아! 코딩 에이전트를 KV cache를 중심으로 설계하는 일에서 해방시켜 줘

답글 — Utkarsh Agrawal (인용 포함)

Utkarsh Agrawal (@uttkarsh_42) · 2026-09-17T21:49:45.000Z

@tamarajtran @typesafeai 아니면

그걸로 사람을 우주에 보낼 수도 있지

https://x.com/uttkarsh_42/status/2100690568947159309

Utkarsh Agrawal (@uttkarsh_42) · 2026-09-17T20:57:15.000Z

그래서 나는 jev에게 falcon-9급 로켓의 전면 제어권을 줬다

발사부터 착륙까지 전부

오토파일럿 없음, 스크립트된 궤적 없음, 코드 안의 안전 거부권(safety veto) 없음

모든 결정은 jev가 내렸다 (영상 하단에서 결정들을 볼 수 있다)

그리고 그래, 부스터를 착륙시킬 수 있었다

그리고 이 전부를 고작 245 calls and and $0.04 in API calls로 했다

시뮬에는 mujoco를 썼다

설정은 42m booster, 425 tonnes, 9 engines, 실제 대기, 마하 의존 항력, 바람, 그리고 추진제 소모였다

기체는 .8초마다 불안정해지고 있었고, jev의 의사결정은 ~1Hz로 일어나며 출력은 ~0.4 sec이다

그래서 나는 jev에게 이런 제어를 줬다

  • 발사 또는 대기 (launch or hold)
  • 매 연소의 엔진 수 (착륙에는 스스로 5 engines for landing를 골랐다!)
  • 그 연소를 언제 점화할지
  • 상승 컷오프, 코스트, 진입, 다리, 터치다운 (ascent cutoff, coast, entry, legs, touchdown)

이 제어를 전부 jev에게 넘긴 뒤 실험이 시작됐다

그리고 12 runs와 여러 가지를 손본 끝에 스스로 착륙하는 데 성공했다

이에 대한 전체 글을 쓸 것이다

실험에서 내가 한 일과, 내가 손본 것들도

하지만 마지막 생각 몇 가지

사람들은 그냥 분류기라고 말한다

맞다, 하지만 아주 좋고 효과적인 분류기다. 그 속도와 의사결정은 실세계 과제와 구현을 위한 완전히 새로운 일을 연다

코드의 잡동사니를 치운 뒤에 이 전체 저장소도 오픈소스할 것이다

그래서 이게 짧은 데모다

마음에 들면 좋겠다

인용된 Falcon-9급 MuJoCo 시뮬 영상 포스터
인용된 MuJoCo 시뮬 영상 포스터

답글 — 코딩 에이전트 원시 요소

tamara (@tamarajtran) · 2026-09-17T21:50:36.000Z

@CompleteSkeptic @typesafeai 코딩 에이전트의 원시 요소 상당수를 Jev로 대체할 수 있다!

답글 — wow

tamara (@tamarajtran) · 2026-09-17T21:54:34.000Z

@uttkarsh_42 @typesafeai wow


원본 링크·인용

본문 완역에 같은 href가 이미 있다. 여기는 보조 목록이다.


기타

원문 x.com/tamarajtran/status/2100694549362553153 · 작성 tamara · 2026-09-17T21:13:04.000Z · 디자인 엔진 ui-ux named reference openai