2026.09.24 StyleGallery: CSS 패턴 모음을 넘어, 근거와 경계를 관리하는 UI 지식 저장소
2026.09.24 Jev가 좋아도 도입하지 않은 이유: 모델 교체보다 먼저 재야 할 오탐과 커버리지
2026.09.24 UI 스킬 10개를 전부 설치하지 마세요: 제작·적응·검수에 맞춰 고르는 법
2026.09.16 더 일찍 알았더라면 좋았을 소프트웨어 엔지니어링 11대 핵심 원칙과 AI 코딩 시대의 가치
2026.08.28 Warp Skill-doctor: AI 에이전트 대화 로그를 채점하고 스킬 품질을 진단하는 리포트 도구
2026.08.28 Qwen3.8-Flash-Next 무검열판 공개: 어블리터레이션 기법으로 지능 손실 없이 거절만 제거한 원리
2026.08.24 LongHorizon-Harness: AI 에이전트의 장시간 복합 작업 붕괴를 방지하는 3인 1조 검증 아키텍처
2026.08.14 AGENTS.md 완벽 가이드: 점진적 공개(Progressive Disclosure)와 Instruction Budget 관리
2026.08.09 Floci: 유료 제한 없는 오픈소스 로컬 AWS 에뮬레이터 구조 분석
2026.08.07 Prime Agent ARC-AGI-3 95.5% 팩트체크: 모델보다 하네스가 중요해졌다는 뜻일까
2026.07.25 코드 리뷰를 없애면 왜 결국 사이트가 터질까: '하네스만으로는 부족하다'는 주장 정리
2026.07.02 바이브 코딩으로 17만 줄 프로그램을 만들며 배운 것: MVP 다음에는 하네스, 테스트, 로그가 필요하다
2026.06.19 장애는 30초 만에 끝났는데 왜 우리 서버는 10분 더 죽었을까: 재시도 폭풍, 백오프, 지터, 서킷 브레이커
2026.06.02 넷플릭스가 실시간 서비스 맵을 따로 만든 이유: 로그·메트릭·트레이스만으로는 보이지 않는 ‘정상 상태 토폴로지’가 있다
2026.05.31 AI가 코드를 싸게 만들었다는 착각: Matt Pocock이 ‘소프트웨어 기본기’를 다시 꺼낸 이유
2026.05.18 Playwright보다 더 아래층으로 내려간 브라우저 자동화: CloakBrowser가 '설정'이 아니라 '바이너리'를 건드리는 이유
2026.04.16 Superpowers와 GSD를 brownfield 프로젝트에 붙이면 누가 더 낫나: E2E 테스트 인프라 비교
2026.03.13 GSD - AI 코드 개발을 위한 컨텍스트 엔지니어링 및 스펙 기반 개발 시스템
2026.03.12 Promptfoo: LLM 평가와 레드팀을 하나의 CLI로 운영하는 방법
2026.03.10 GSD (Get Shit Done) — AI 코딩 에이전트를 위한 컨텍스트 엔지니어링 & 스펙 기반 개발 시스템 완전 가이드
2026.03.10 Vibe Coding 시대의 스펙 주도 개발: AI 코딩을 감각이 아니라 명세로 통제하는 방법
2026.03.07 에이전트 엔지니어링 패턴 - Simon Willison의 코딩 에이전트 활용 가이드
2026.03.02 테스트는 새로운 해자인가: AI 시대 오픈소스 경쟁력의 재정의
2026.03.01 AGENTS.md는 정말 도움이 될까: AGENTbench 논문으로 본 컨텍스트 파일의 실제 효과
2026.02.28 Toward Expert Investment Teams: 세밀한 태스크 분해가 LLM 트레이딩 팀 성능을 끌어올리는 방식
2026.02.20 아직도 RAG 쓰세요? 단순 RAG는 줄이고, Contextual Retrieval로 올리는 실전 가이드
2026.01.09 15년차 CTO가 바이브 코딩하는 방법: 증강형 코딩과 tdd-go-loop 워크플로우