Andrew Ng이 2026-08-29 X에 올린 두 번째 스킬 맵 후속글의 한국어 완역·요약·팩트체크. 에이전트가 코드를 다 짜주는 시대에도 왜 소프트웨어 기본기(풀스택·데이터·아키텍처·보안·운영)가 여전히 필수인지.
Posts for: #AI agents
[LINK/SUMMARY] AgentBehavior — 행동 명세 파일과 구조 검증기의 실제 경계
GitHub braintrustdata/agentbehavior를 커밋 1866cff에 고정한 static-only 채택 검토. 파일 계약과 validator는 조건부 채택할 만하지만 runtime confidence는 unknown이다.
[LINK/SUMMARY/번역] 이해가 새 병목이다 — Understanding is the new bottleneck
Geoffrey Litt(Notion)의 2026-07 AI Engineer 강연 완역·팩트체크. AI 에이전트가 코드를 짜주는 시대에 사람이 여전히 코드를 이해해야 하는 이유(검증이 아니라 참여)와 이를 되찾는 3기법: explain-diff · 마이크로월드 · 공유 공간.
[LINK/SUMMARY] firstmate — 한 명의 선장이 크루를 몰기 위한 에이전트 배포판
GitHub kunchenguid/firstmate를 커밋 7ee0c19에 고정한 static-only 채택 검토. 구현·테스트·CI·보안 경계는 조건부 trial을 지지하지만, 실행하지 않았으므로 runtime confidence는 unknown이다.
[LINK/SUMMARY/번역] Cursor의 Lauren Tan: 왜 5개월 만에 매달 1000+ PR을 병합할 수 있었나
Michael Guo(@Michaelzsguo)가 정리한 Lauren Tan(@poteto)의 방법론 완역·팩트체크 — AI 코딩의 진짜 병목은 코드 생성이 아니라 검증이라는 명제와, 그것을 풀어낸 pstack.
[LINK/SUMMARY] PenguinHarness — 커밋 고정 코드 검증 채택 판단 도시에
Prism-Shadow/penguin-harness를 고정 커밋 b90f5aa7에서 파일 29개만 정적 검증했다. 데스크톱/CLI 이중 배포로 loopback 127.0.0.1:7364에 자체 서버+웹 UI+SQLite를 띄우고, HMR로 비즈니스 표면 전체를 hot push한다. 벤더 벤치마크 재현 아티팩트는 아직 커밋에 없고, 컨트리뷰션의 80%가 top-1에 몰려 있다. 채택 판단은 개인·팀 자체 호스팅 실험용 조건부 GO — 프로덕션·다중 사용자 배포는 실행 리뷰와 벤치마크 재현 이후로 보류 (Apache-2.0, 신뢰도 B, 정적 상한).
[LINK/SUMMARY] xfx — fx의 러스트 이식본을 코드로 확인한 기록
vercel-labs/fx의 비공식 러스트 이식본 2lab-ai/xfx를 고정 커밋 f1913a6b의 파일 30개(16,878줄)만 읽어 정적으로 검증했다. 핵심은 모델 카탈로그가 코드에 아예 없다는 것 — ‘무엇을 쓸 수 있는가’를 로컬 llmux 데몬에 통째로 위임한 대가로 키 없는 loopback 실행을 얻었다. 요청자 진술 5건과 README 진술을 코드와 대조했고, README가 ‘없다’고 적은 전체화면 TUI가 코드에 있는 충돌까지 원장에 남겼다 (신뢰도 B).
[LINK/SUMMARY] Grok Bot 0.18 재구성
b-nnett의 grok-bot-0.18-reconstructed 커밋 고정 도시. 공개 Grok Bot 0.18.0 macOS 앱을 TypeScript로 다시 붙인 비공식 연구 저장소 — 엔트리포인트·추론 라우터·로컬 Docker를 file:line으로 실증. 라이선스 없음. 실행하지 않음.
[LINK/SUMMARY] mobile-mcp — 에이전트가 폰을 조작하는 표준이 되려는 MCP 서버
mobile-next의 mobile-mcp(모바일 자동화 MCP 서버) 저장소 도시에: iOS·Android·시뮬레이터·에뮬레이터를 27개 mobile_* 도구로 묶는 TypeScript MCP 서버. 커밋 고정 정독 — 소스가 SSOT: 도구 등록→디바이스 추상화→불투명 Go 바이너리(mobilecli) 위임 경로를 file:line으로 실증, 기본 ON 텔레메트리·SSE 무인증 fail-open·CVE 2건의 보안 경계, 22개 주장 원장 + 공개 증거 번들.
How Second Brain Works — 노트 앱이 아니라 제어 시스템이다
LLM 에이전트와 12주 운영한 second brain의 실측 해부. 개입률 7주 시계열(하락 미입증까지 공개), open-loop 폐쇄율 11.6%가 말해준 ‘인간이 병목’, 헌법 145→64줄 삭제 궤적, 블라인드 재개 실험 5/5 — 잘 정리된 아카이브가 아니라 위임 가능한 제어 루프가 목표다.