전체 글109 Jev란? 글을 생성하지 않고 결정을 내리는 AI LLM에게 “이 작업을 계속할까?”, “어떤 도구를 호출할까?”, “이 답변을 사람에게 넘겨야 할까?”를 물어보면 답은 대체로 잘 온다. 처음에는 그 정도면 에이전트 자동화도 충분히 만들 수 있을 것 같았다.그런데 막상 코드 안에 넣으려면 조금 이상해진다. 사람이 읽을 문장을 다시 파싱해야 하고, 정해 둔 형식과 다른 값이 나오지 않았는지 검증해야 한다. 무엇보다 모델이 확신하는지조차 알기 어렵다.최근 나온 Jev는 이 지점을 정면으로 겨냥한 모델이다. 이번에는 Jev가 기존 LLM과 무엇이 다르고, AI 에이전트 설계에서 어디에 넣을 수 있는지 정리해보려고 한다!목차1. LLM의 답변이 자동화에 바로 쓰기 어려운 이유2. Jev는 무엇을 반환하는 모델인가3. System One Model이라는 이름4... 2026. 9. 22. AI 에이전트 코드 리뷰, 왜 구현자와 분리해야 할까? 커밋 전 리뷰 루프 설계 AI 에이전트에게 코드를 작성시킨 뒤 같은 세션에서 “리뷰해줘”라고 요청하면, 대체로 꽤 좋은 평가가 돌아온다. 처음에는 코드가 정말 괜찮아서 그런 줄 알았다.그런데 곰곰이 생각해보면 이상하다. 방금 코드를 작성한 세션은 설계 의도와 구현 과정, 애매했던 선택의 이유까지 전부 알고 있다. 사람으로 치면 작성자가 직접 자기 PR을 검토하는 것과 비슷하다. 이번에는 이 문제를 줄이기 위해 만든 커밋 전 리뷰 루프를 정리해보려고 한다!목차1. 리뷰가 리뷰가 아니게 되는 순간2. 전체 흐름: 팬아웃 후 수렴3. 증거를 스크립트가 만드는 이유4. 서로 다른 축의 리뷰어 3명5. 판정자를 한 층 위에 둔 이유6. 정적 리뷰와 테스트 게이트를 분리한 이유 1. 리뷰가 리뷰가 아니게 되는 순간리뷰어를 별도로 띄운다고 .. 2026. 9. 18. Claude Code 전용 하네스 소개 이번 글에서는 지난번에 하네스에 대해 공부한 것을 바탕으로 프로젝트를 생성 시마다 사용하는내 하네스 기본 세팅에 대해서 소개하려고 한다! 핵심은 범용 워크플로(클로드에서 기본으로 제공해주는 /plan, /code-review, /tdd)는 다시 만들지 않는다.이런 일반 기능은 외부 하네스에 의존하고, 이 저장소는 프로젝트의 고유한 것만 담도록 구성하였다.목차1. 최상위 구조2. rules/ - 항상 지켜야 하는 규칙 (가장 핵심)3. commands/ - 사용자가 /이름으로 직접 호출4. skills/ - Claude가 상황에 맞춰 자동 로드5. agents/ - 격리된 컨텍스트로 작업 위임6. hooks/ + scripts/ - 라이프사이클 이벤트 자동화7. mcp-configs/ - 외부 서비스 연동.. 2026. 9. 5. 에이전트 오케스트레이션 - 루프 & 그래프 설계 기준 LLM의 설계 단위가 여러 차례 걸쳐서 이동을 하고 있는데, 아래 순서와 같이 확장을 해나아가고 있다.프롬프트 엔지니어링 → 컨텍스트 엔지니어링 → 루프 엔지니어링 → 그래프 엔지니어링 설계의 관심사는 프롬프트에서 컨텍스트로, 다시 반복과 분기의 통제(루프)로 옮겨왔다.루프가 여러 개가 되면 실행 순서가 흔들리는데, 그래프 엔지니어링은 루프 안쪽의자율성은 두고 루프 사이의 흐름만 고정하는 방식이다. 이번 글에서는 루프 엔지니어링과 그래프 엔지니어링을 자세히 다뤄보려고 한다!목차1. 본격적으로 들어가기 전에: 다섯 가지 엔지니어링 용어 정리2. 루프 엔지니어링이란 무엇인가3. 루프에서 반드시 정해야 하는 네 가지3-1. 트리거 — 언제 시작하는가3-2. 검증 — 무엇이 진실을 판정하는가3-3. 상태 — 어.. 2026. 8. 24. 이전 1 2 3 4 ··· 28 다음