Calvin French-Owen의 ‘Small Models Have Arrived’를 요약하고, 가격·속도·투자 유치·시장 인과를 주장 단위로 검증한 뒤 원문 구조 그대로 한국어로 옮겼다.
Posts for: #LLM
[LINK/SUMMARY/번역] GLM-5.3-Flash: 프런티어 지능을 플래시 가격에
Z.ai가 2026-08-26 공개한 GLM-5.3-Flash — 320B/18B 네이티브 멀티모달 MoE, 하이브리드(선형+희소) 어텐션·mHC·IndexPool, MIT 오픈웨이트, 국산 AI 칩 서빙. 원문 완역+팩트체크.
[LINK/SUMMARY] PenguinHarness — 커밋 고정 코드 검증 채택 판단 도시에
Prism-Shadow/penguin-harness를 고정 커밋 b90f5aa7에서 파일 29개만 정적 검증했다. 데스크톱/CLI 이중 배포로 loopback 127.0.0.1:7364에 자체 서버+웹 UI+SQLite를 띄우고, HMR로 비즈니스 표면 전체를 hot push한다. 벤더 벤치마크 재현 아티팩트는 아직 커밋에 없고, 컨트리뷰션의 80%가 top-1에 몰려 있다. 채택 판단은 개인·팀 자체 호스팅 실험용 조건부 GO — 프로덕션·다중 사용자 배포는 실행 리뷰와 벤치마크 재현 이후로 보류 (Apache-2.0, 신뢰도 B, 정적 상한).
[LINK/SUMMARY] xfx — fx의 러스트 이식본을 코드로 확인한 기록
vercel-labs/fx의 비공식 러스트 이식본 2lab-ai/xfx를 고정 커밋 f1913a6b의 파일 30개(16,878줄)만 읽어 정적으로 검증했다. 핵심은 모델 카탈로그가 코드에 아예 없다는 것 — ‘무엇을 쓸 수 있는가’를 로컬 llmux 데몬에 통째로 위임한 대가로 키 없는 loopback 실행을 얻었다. 요청자 진술 5건과 README 진술을 코드와 대조했고, README가 ‘없다’고 적은 전체화면 TUI가 코드에 있는 충돌까지 원장에 남겼다 (신뢰도 B).
How Second Brain Works — 노트 앱이 아니라 제어 시스템이다
LLM 에이전트와 12주 운영한 second brain의 실측 해부. 개입률 7주 시계열(하락 미입증까지 공개), open-loop 폐쇄율 11.6%가 말해준 ‘인간이 병목’, 헌법 145→64줄 삭제 궤적, 블라인드 재개 실험 5/5 — 잘 정리된 아카이브가 아니라 위임 가능한 제어 루프가 목표다.
[LINK/SUMMARY/번역] 당신의 AGENTS.md는 신경망이다
Kun Chen — 프로젝트 AGENTS.md를 파일이 아니라 가중치로 취급하라: 세션 트랜스크립트가 loss, 주 1회 backward pass, 토큰 버짓 = model size. backpass CLI까지 완역 + 팩트체크 A-.
[LINK/SUMMARY/번역] 제로에서 그래프 아키텍트까지: Claude 그래프 엔지니어링 14단계 로드맵
선형 멀티에이전트 파이프라인을 ‘무엇이 무엇에 의존하는가’의 그래프로 재설계하는 14단계 — Claude Code dynamic workflows(agent()·parallel())로 실제 구동하는 방법. Wayne(@waynoir) X 아티클의 완역과 독립 팩트체크(A-).
[LINK/SUMMARY/번역] CLAUDE.md는 왜 계속 자라는가? — 에이전틱 코딩의 파국적 기억
에이전틱 README가 무한 성장하는 ‘파국적 기억’ 현상 — 1,867개 레포 관찰 + IFEval 반전 실험으로 ‘프롬프트 주석’이 성장을 멈춘다는 논문. 한국어 완역 + Executive Summary + 팩트체크(B+).
[LINK/SUMMARY/번역] 독점 LLM API에서 추론 트레이스 훔치기
제공사가 암호화해 반환하는 추론(CoT) 블록의 크로스모델 호환성 취약점과 네 가지 공격 벡터 — 한국어 완역 + Executive Summary + 팩트체크(A).
Grok 4.5 vs 4.6
같은 차체, 27일 뒤의 두 번째 점화. xAI 공식 발표와 모델 카드, Artificial Analysis로 고정한 4.5와 4.6의 차이.