기술 에세이
에이전트, 메모리 아키텍처, 모델 행동 특성, 도구, 언어에 관한 기술 에세이 및 실무 기록입니다.
에이전트 조율, 안전성, 실무 환경에서의 작동 요건.
Grok Bot: Cursor’s Bet on Multi-Agent AI
Of all the AI tools I’ve tried, Grok Bot may be the simplest iteration of a “personal agentic team.” The problem is that it keeps breaking.
AI 제품의 본질은 모델이 아닌 하네스입니다
코드는 모델이 작성하지만, 반복된 도구 호출 오류를 방지하고 제어하는 것은 하네스 시스템입니다.
AI 에이전트에게 API 키를 직접 전달하지 않는 방법
에이전트가 API 키를 요구할 때 즉시 점검해야 할 보안 원칙과 안전한 대안.
에이전트 대응형 웹: Cloudflare 평가 기준 적용기
Cloudflare의 신규 에이전트 대응성 스캐너를 개인 사이트에 직접 적용하고 분석한 결과.
ChatGPT로 Claude Code를 오케스트레이션하는 실험
하나의 언어 모델로 다른 모델을 지휘할 때 나타나는 시스템적 변화와 가능성.
정보의 지속성, 승격 기준, 에이전트가 참조 가능한 지식 구조.
단순 체감이 아닌 실제 업무 기준의 정량적 모델 평가.
Claude vs. GPT vs. Gemini: You’re Benchmarking the Wrong Thing
These benchmarks are not only comparing models. They are comparing the systems built around those models and the design of the benchmarks themselves.
Opus 4.8 vs 4.7 vs Sonnet vs Haiku: 고성능 모델의 실효성 분석
새로운 모델 출시 시 단순 벤치마크 점수가 아닌 실제 업무 생산성에서 느껴지는 유의미한 차이를 비교합니다.
AI 텍스트 탐지기가 실제로 측정하는 지표
AI 탐지 도구의 기술적 작동 원리와 그에 따른 한계 및 변동성을 분석합니다.
Claude Code를 프로덕션 레벨에서 안정적으로 운용하는 방법.
I Stopped Debugging Claude’s Code and Started Debugging My Prompts Instead
Debugging AI-generated code usually isn’t about fixing bad code. It’s about giving the model context it never had.
Claude Code를 실무에 제대로 적용하는 방법
강력한 성능 이면에 존재하는 무질서함을 통제하고 구조화된 워크플로우를 정립하는 전략.
타인의 AI 설정을 모방하지 않고 나만의 시스템을 구축하는 법
외부 워크플로우를 그대로 복사하기보다 자신의 실제 업무 데이터로 검증된 환경을 구축해야 합니다.
Claude Code를 활용한 로컬 자동화 구축
로컬 컨텍스트를 활용하여 능동적인 AI 자동화를 구현하는 아키텍처 패턴.
마찰을 흐름으로: Claude Code 명령어 라이브러리 구축
명령어를 통한 인지 부하 감소. 기억에 의존하지 않고 명확히 호출하는 시스템 만들기.
AI 코딩 도구를 실무에 도입하기 전 알아야 할 10가지
프로덕션 환경에서 AI 코딩 도구를 매일 활용하며 얻은 실질적인 교훈.
월 0원으로 25개 사이트와 10개 데이터베이스를 운영하는 방법
실제 서비스 중인 인프라 목록과 프리 티어 아키텍처를 투명하게 공개합니다.
도구와 시스템 이면에 존재하는 근본적인 질문들.