Slack 채널 하나에 Claude Tag 데일리 루틴 11종 — 수주간 388개 PR을 열고 180개를 머지했다
원문: Boris Cherny (Anthropic, Claude Code 창시자) ·
원문 스레드 · 14.8K views
읽기 전에
핵심 질문: 사람이 지시하지 않아도 매일 도는 AI 루틴에게 앱 유지보수를 통째로 맡기면, 실제로 머지할 만한 코드가 나오는가 — 나온다면 무엇이 그걸 가능하게 하는가.
선행 개념
Claude Tag — Slack 채널 안에서 멘션·지시로 구동되는 Claude. 이 실험에서는 전용 채널(proj-claude-maintains-apps)에 상주하며 루틴을 실행하는 주체다.
루틴(routine) — 크론처럼 매일 반복 실행되는 클라우드 에이전트 작업 단위. 일회성 프롬프트가 아니라 "매일 같은 점검을 돌고, 결과를 PR로 낸다"는 상시 작업이다. claude.ai/code에서 직접 만들 수 있다.
유지보수 루틴의 성격 — 신기능 개발이 아니라 기계적 정리 작업이다: 크래시 탐색·중복 통합·데드코드 제거·플레이키 테스트 수리·누수 추상화 교정 등. "정답이 비교적 명확한 일"이라는 점이 이 실험의 전제다.
2단 리뷰 게이트 — 루틴이 낸 PR은 Claude Code Review를 먼저 통과한 뒤 사람 리뷰를 거쳐 머지된다. 자동 머지가 아니다.
멘탈 모델: 이것은 "AI에게 코딩 시키기"가 아니라 유지보수를 데몬화한 것이다. 사람이 하던 반복 점검(크래시 잡기, 중복 정리, 죽은 코드 삭제)을 매일 도는 루틴으로 바꾸고, 사람의 역할은 실행이 아니라 머지 게이트와 루틴 튜닝("내일은 더 잘하게 고쳐라")으로 올라간다. 실패 처리도 코드 수정이 아니라 루틴 프롬프트 수정이라는 점이 핵심 전환이다.
권장 읽기 순서
포스트 1 — 셋업(Slack 채널 + 데일리 루틴)을 먼저 잡는다. 구조가 단순하다는 점 자체가 논지다.
포스트 2의 루틴 표 — 11개 루틴을 훑되 "전부 기계적·수렴적 작업"이라는 공통점을 확인한다. Dead-code remover의 2단계 검증(로깅 심고 다음 날 삭제)이 루틴 설계의 대표 사례다.
포스트 3 — 숫자를 읽는다: 388 PR 중 180 머지(약 46%), 그리고 실패 시 대응이 "루틴 튜닝, 며칠 소요"라는 운영 방식.
포스트 4와 댓글 — 재현 경로(claude.ai/code 루틴)와 비용 논쟁($1000/일, "개인에겐 무리, 앱 여러 개 굴리는 회사용"이라는 저자의 스코프 한정)을 마지막에 본다.
예상 소요
요약만: 약 3분 — 셋업·루틴 표·388/180 숫자·비용 한정만 잡는다.
완독(댓글 포함): 약 8분 — 루틴 11종의 설계 차이와 튜닝 루프까지 소화한다.
점검 질문
11개 루틴이 신기능 개발이 아니라 전부 유지보수·정리 작업으로만 구성된 이유는 무엇인가.
388개 PR 중 180개 머지라는 수치를 성공으로 읽을 수 있는 근거와, 반대로 한계로 읽어야 할 지점은 각각 무엇인가.
루틴이 틀린 PR을 냈을 때 저자의 대응은 코드 수정이 아니라 무엇이며, 그 방식이 이 워크플로우의 지속 가능성에 왜 중요한가.
Executive Summary
Boris Cherny(Anthropic, Claude Code 창시자)가 지난 몇 주간 진행한 실험의 공개 보고다: 앱의 일상 유지보수(day-to-day maintenance)를 Claude에게 통째로 넘기는 것. 본인 표현으로 "weird experiment"지만, "이게 가능할지도 모른다는 초기 생명 신호(early signs of life)"를 봤다고 평가한다.
388루틴이 연 PR (수주간)
180머지된 PR (~46%)
6대상 플랫폼
11+일일 루틴 종류
셋업 — Slack 채널 하나가 전부다
구성은 단순하다. proj-claude-maintains-apps라는 Slack 채널에서 Claude Tag가 매일 자동 루틴(daily routines)을 돌린다. 대상은 Claude 제품군 전체 — iOS · Android · Desktop · web · CLI · Agent SDK 6개 플랫폼이다. 사람이 작업을 지시하는 게 아니라, 미리 정의된 루틴이 매일 스스로 코드베이스를 순찰하고 PR을 연다.
루틴 카탈로그 — 11종의 자동 유지보수 봇
루틴은 각각 하나의 유지보수 관점을 담당한다. 공개된 카탈로그 전수는 다음과 같다.
결함 탐지·수리
Crash fuzzer — 시뮬레이터에서 실제 앱을 열고 탭을 난사해 크래시를 유발, 근본원인을 찾아 수정 PR을 연다
Logic bugfixer — 까다로운 비즈니스 로직을 형식적으로 모델링해 버그를 찾아 고친다
Flaky-test fixer — 불안정한 CI 테스트의 근본원인을 추적한다
코드 다이어트
Dead-code remover — 정적으로 도달 불가능한 코드를 삭제한다. 죽었다고 의심되는 코드에는 로깅을 심어 하루 관찰 후, 정말 죽었으면 다음 날 제거한다
Useless-test pruner — 실패할 수 없는(무의미한) 테스트를 삭제한다
Shipped-feature inliner — 완전히 출시된 기능의 피처 플래그를 걷어낸다
Ant-only shipper — 방치된 내부 전용 기능을 사용량 기준으로 출시하거나 삭제한다
구조 개선
Dup unifier — 비슷하지만 미묘하게 갈라진 중복 구현을 스캔해 하나로 통합하는 PR을 연다
수주간 루틴들이 388개 PR을 열었고, 그중 180개(~46%)가 Claude Code Review + 휴먼 리뷰를 거쳐 머지됐다.
저자의 평가는 "surprisingly positive". Claude는 대체로 첫 시도에 올바른 PR을 만들고, 틀리면 사람이 고쳐주는 게 아니라 Claude에게 루틴 자체를 튜닝시켜 다음 날 더 잘하게 만든다 — 때로는 며칠의 튜닝이 걸린다. 즉 운영 루프는 "PR 수정"이 아니라 "루틴 개선"이다. 팀은 현재 이런 기계적 변경(mechanical changes)의 머지를 더 매끄럽게 만드는 방법을 고민 중이다.
재현 경로
동일 워크플로우는 Claude Code나 Tag에게 요청하거나, claude.ai/code에서 루틴을 직접 생성해 시도할 수 있다. 저자는 실제 사용한 Slack 프롬프트 원문(7/19)도 공개했다 — 크래시 퍼저는 "목 없이 실제 앱 구동(no mocks)", 각 PR은 "/verify 실행 + 재현(repro)과 truth table을 PR에 첨부", 로직 버그픽서는 "로직을 형식적으로 모델링(formally model the logic)"하라는 식으로, 검증 산출물을 PR에 강제하는 설계다.
비용 논쟁 — 개인은 무리, 회사 규모에서 유효
"And it only costs $1000/day to use Claude models to do so!" — 댓글 반응
댓글의 핵심 반론은 비용이다("일 $1000", "무제한 토큰 예산이 있어야"). 저자도 이를 부정하지 않고 인정한다: "개인에게는 아마 말이 안 되지만, 여러 앱을 만드는 회사에게는 정말 유용했다." 즉 이 워크플로우의 경제성은 토큰 비용 대비 유지보수 인건비가 큰 조직 규모에서 성립한다는 게 저자 스스로의 포지셔닝이다.
팩트체크 · 신뢰도
A−
핵심 사실 주장(저자 신원·Claude Tag·routines 기능)은 전부 외부 소스로 확인된다. 수치(388 PR/180 머지)만 외부 검증이 불가능한 저자 자기보고인데, Anthropic이 공개한 "사내 PR의 약 65%를 Claude가 연다"는 발표와 방향이 일치해 과장으로 볼 근거는 없다.
✅ 사실
C1. Boris Cherny는 Anthropic 소속이며 Claude Code의 창시자다.
본인 LinkedIn 직함이 "Creator & Head of Claude Code @ Anthropic"이고, Pragmatic Engineer·Fortune 등 다수 매체가 동일하게 확인한다. 2024년 말 Anthropic 프로토타이핑 팀에서 Claude Code를 만들었고, 현재 8개월째 손 코딩 없이 에이전트 운영만 한다고 밝힌 인물 — "our apps"를 Anthropic의 Claude 앱군으로 읽는 맥락과 정합적이다.
LinkedIn — bchernyPragmatic Engineer — Building Claude CodeFortune 2026-06-08
✅ 사실
C2. "Claude Tag"라는 Slack 내 Claude 제품이 존재하며, 채널에서 상시 작동하는 에이전트로 쓸 수 있다.
Anthropic이 2026-06-23 공식 발표한 실제 제품이다. Enterprise/Team 베타로, Slack 채널에 팀원처럼 상주하며 @Claude 태그로 작업을 맡기고, "ambient" 모드에선 선제적으로 스레드를 팔로업한다 — 채널에서 daily routine을 돌린다는 서술과 부합한다. TechCrunch·VentureBeat가 동시 보도했다.
Anthropic — Introducing Claude TagTechCrunch 2026-06-23VentureBeat
✅ 사실
C3. claude.ai/code에서 routines(스케줄된 클라우드 에이전트)를 직접 만들 수 있다.
실재하는 기능이다. Claude Code Routines는 2026-04-14 리서치 프리뷰로 공개된 스케줄드 클라우드 에이전트로, CLI의 /schedule 외에 웹 claude.ai/code/routines에서도 생성 가능하다. 트리거는 스케줄·API 엔드포인트·GitHub 이벤트 3종, Pro/Max/Team/Enterprise 대상.
Tessl — Anthropic adds routinesMakerkit — Routines 가이드 (2026)
📎 저자 주장
C4. 수주간 루틴들이 388개 PR을 열었고 180개가 Claude Code Review + 휴먼 리뷰 후 머지됐다.
구체 수치(388/180)를 담은 외부 소스는 검색에서 확인되지 않았다 — Anthropic 내부 수치라 외부 검증 자체가 불가능한 자기보고다. 다만 규모의 개연성은 있다: Anthropic은 Claude Tag 발표에서 "사내 PR의 약 65%를 Claude가 연다"고 공개했고, Cherny 본인도 주당 수십 PR급 에이전트 운영 워크플로우를 반복적으로 공개해왔다.
VentureBeat — 사내 PR 65% 수치Product with Attitude — Cherny 워크플로우
첨부 스크린샷과 본문의 목록은 서로 일치하나, 목록 자체가 저자 개인 설정의 나열이라 외부 검증 대상이 아니다. 이런 유지보수형 루틴(야간 트리아지·의존성 스캔·데드코드 정리)이 routines의 대표 유스케이스라는 점은 서드파티 가이드들이 공통으로 기술한다.
Makerkit — 유스케이스 목록
⚠️ 불확실
C6. 댓글 주장 "$1000/day 비용" — 저자는 긍정도 부정도 안 함.
익명 댓글러의 추정치로, 뒷받침하는 외부 데이터가 없다. 참고로 routines 사용량은 일반 Claude Code 세션과 동일하게 플랜 사용량으로 집계되고 일일 실행 한도(무료 포함분 기준 계정당 15회/일 보도)가 있어, 구독 계정 기준으로는 $1000/day라는 산식이 그대로 성립하지 않는다 — API 종량제 초과분(metered overage)까지 열어둔 조직이라면 규모에 따라 가능한 범위다. "개인에겐 비합리적, 회사엔 유효"라는 저자 입장은 의견이므로 판정 대상이 아니다.
Makerkit — 플랜 집계·일일 한도
지난 몇 주간 해본 좀 이상한 실험이 하나 있는데, 우리 앱들의 일상 유지보수(day-to-day maintenance)를 Claude에게 통째로 맡겨보는 것이다. 이게 가능할지도 모른다는 초기 신호들이 보이고 있다.
셋업은 단순하다. proj-claude-maintains-apps라는 Slack 채널이 하나 있고, 그 안에서 Claude Tag가 iOS, Android, 데스크톱, 웹, CLI, Agent SDK 전반에 걸쳐 여러 개의 데일리 루틴(daily routine)을 돌린다:
결과는 놀랄 만큼 긍정적이었다. 지난 몇 주 동안 이 루틴들이 우리 레포들에 걸쳐 388개의 PR을 열었고, 그중 180개를 Claude Code Review + 사람 리뷰를 거쳐 머지했다. 지금은 이런 기계적인(mechanical) 변경들의 머지를 더 쉽게 만들기 위해 이 과정을 어떻게 간소화할지 고민하고 있다.
Claude는 대체로 이런 PR을 첫 시도에 제대로 만들어내고, 그렇지 못하면 다음 날 더 잘하도록 Claude에게 자기 루틴을 튜닝하라고 시킨다. 며칠간의 튜닝이 필요할 때도 있다.
비슷한 워크플로우를 시도해 보려면 Claude Code나 Tag에게 요청하거나, claude.ai/code…에서 직접 루틴을 만들면 된다. 실제로 내가 사용한 프롬프트 몇 개를 아래에 첨부한다.
비슷한 워크플로우를 실험해 본 사람 있는가?
이미지 2 — Boris가 Slack에서 실제로 입력한 루틴 생성 프롬프트 4개 (7월 19일):
boris, 7월 19일 12:30 PM — "iOS, Android, 데스크톱 앱을 e2e로 크래시 퍼징(crash fuzzing)하는 새 데일리 루틴들을 시작하자. 각 앱마다 루틴을 만들되, 워크플로우를 써서 실제 앱을 (목(mock) 없이) 구동하고 퍼징해서 크래시를 유발한 다음, 그 크래시들에 대한 수정 PR을 올려라. 모든 PR은 반드시 /verify를 실행하고 재현(repro)과 진리표(truth table)를 PR에 게시해야 한다. 업데이트는 이 채널의 새 최상위 Fuzzer 스레드에 게시하라" (원문: "lets start new daily routines for crash fuzzing ios, android, and desktop apps e2e. make routines for each that use workflows to run the real apps (no mocks) and fuzz them to trigger crashes, then put up fix prs for those crashes. each pr must run /verify and post a repro and truth table to the pr. post updates in a new top level Fuzzer thread in this channel")
boris — "business-logic-bugfixer-daily와 business-logic-simplifier-daily, 그리고 dup-unifier도 만들어라. 같은 방식이다 — 앱별로 별도 루틴, 업데이트를 올리는 최상위 스레드, 항상 진리표와 함께 e2e로 검증. 이 모든 루틴에서, 갭과 중복을 찾아내고 모든 엣지 케이스가 잘 테스트되도록 로직을 형식적으로(formally) 모델링하는 것도 잊지 마라" (원문: "also make business-logic-bugfixer-daily and business-logic-simplifier-daily and dup-unifier. same story -- separate routine per app, top level thread with updates, always verify e2e with truth table. for all of these, remember to formally model the logic also to spot gaps and duplication and to make sure all edge cases are well tested")
boris — "불안정한(flaky) 테스트의 근본 원인을 찾아 고치는 것과 쓸모없는 테스트를 지우는 것에 대해서도 똑같이 해라" (원문: "also do this for finding and fixing root causes of flaky tests, and deleting useless tests")
boris, 7월 19일 12:43 PM — "데드 코드 제거(dead code removal)용 루틴도 하나 만들어라" (원문: "also do one for dead code removal")
댓글
runninwithit(2시간 전): "그리고 그렇게 하는 데 Claude 모델 비용이 하루에 겨우 $1000밖에 안 든다!" (원문: "And it only costs $1000 / day to use Claude models to do so!")
haifengkao(2시간 전): "토큰을 무제한으로 주면 나도 그거 할 수 있다" (원문: "I can do that if you give me unlimited tokens")
boris_cherny(1시간 전, 저자): "개인한테는 아마 수지가 안 맞겠지만, 여러 앱을 만드는 회사 입장에서는 정말 유용했다" (원문: "This probably doesn't make sense for individuals, but for a company building a bunch of apps it's been really useful")
jason.ycw(47분 전): "그 회사에 무제한 토큰 예산이 있을 때만 그렇겠지" (원문: "Only if that company has unlimited token budget")
용어 — Claude Tag: Slack 채널에 상주하는 Claude 에이전트 제품(2026-06-23 공개). routine: claude.ai/code의 스케줄드 클라우드 에이전트. flaky test: 코드 변경 없이 간헐적으로 실패하는 테스트. leaky abstraction: 내부 구현이 경계 밖으로 새는 추상화. truth table(진리표): 로직의 입력·출력 전 조합 표. Ant-only: Anthropic 사내 전용(internal-only).
추출 — 로그인 세션 브라우저로 전문 추출 완료(부분 추출 아님). 스크린샷 2장은 원본 CDN 만료·referrer 제한 대비 로컬 사본으로 첨부했다.
고지 — 이 문서는 원문 스레드의 한국어 재구성이다. 원문 게시물과 이미지의 저작권은 원저자에게 있다.