Agent Engineering
Codex의 Agent Loop는 어떻게 한 바퀴를 도는가
모델 호출만으로는 에이전트가 움직이지 않는다. 컨텍스트를 만들고 도구 결과를 다시 입력으로 연결하는 하네스의 핵심 흐름을 실제 Codex 코드와 함께 살펴본다.
좋은 모델보다 먼저 필요한 건, 실패했을 때 멈추고 다시 이어갈 수 있는 실행 경계라고 생각한다.
OpenAI Engineering · Michael Bolin ·
Independent Technology Review
Issue 08 August 2026
Agent Engineering
모델 호출만으로는 에이전트가 움직이지 않는다. 컨텍스트를 만들고 도구 결과를 다시 입력으로 연결하는 하네스의 핵심 흐름을 실제 Codex 코드와 함께 살펴본다.
좋은 모델보다 먼저 필요한 건, 실패했을 때 멈추고 다시 이어갈 수 있는 실행 경계라고 생각한다.
OpenAI Engineering · Michael Bolin ·
Agent Evaluation
여러 번 도구를 호출하고 상태를 바꾸는 에이전트는 한 번의 정답만으로 평가하기 어렵다. transcript와 grader를 어떤 기준으로 나눠야 하는지 읽어볼 만하다.
에이전트 테스트는 정답률보다 어떤 과정과 증거로 결론에 도달했는지를 함께 봐야 한다.
Anthropic Engineering · Anthropic ·
Framework Watch
모델만 바꾸는 추상화를 넘어 Codex와 Claude Code 같은 하네스까지 같은 인터페이스에서 실행하려는 접근을 소개한다.
공통 인터페이스는 시작점일 뿐이고 권한과 복구 방식의 차이는 어댑터 밖으로 숨기면 안 된다.
Vercel · Gregor Martynus 외 4명 ·
Source Code Shelf
Cheondi's Desk
Editor's NoteAgent Loop, 평가, 하네스를 실제 개발 흐름에 붙인다면 어느 단계부터 시작해야 할지 정리한 기록이다.
참고 자료 3개 · 코드 저장소 3개
개인 기록 읽기직접 읽고 고른 글을 짧게 소개합니다. 원문의 저작권은 각 작성자와 발행처에 있으며, 전문 대신 출처와 연결되는 독서 메모만 남깁니다.
Cheondi Review Archive
한 달에 한 번 고른 기술 원문과 그때의 생각을 모았습니다.
Issue 07 2026년 7월호
MCP와 A2A가 맡은 역할을 나누고 에이전트 연결 전에 필요한 권한 경계를 살펴본다.
Issue 06 2026년 6월호
여러 API가 이어지는 흐름과 중복 실행을 막는 재시도 경계를 함께 읽는다.
Issue 05 2026년 5월호
로그의 양보다 화면·API·서비스를 잇는 증거의 연결이 중요한 이유를 정리한다.
Issue 04 2026년 4월호
비밀번호가 사라진 뒤에도 서버에 남는 challenge, origin, RP ID 검증을 따라간다.
Issue 03 2026년 3월호
브라우저 그래픽 API와 WebAssembly 런타임을 Unity Web의 경계에서 다시 살펴본다.
Cheondi's Notes
105개의 글
Agent Loop, 평가, 실행 하네스를 함께 읽고 실제 개발 흐름의 어느 단계부터 적용할지 정리한 기록입니다.
읽어보기코드, 테스트, 빌드, 배포 자산과 실제 화면을 서로 다른 증거 단계로 관리한 검증 체계 기록입니다.
읽어보기AI 작업을 한 번의 답변이 아니라 상태 전이, 검증, 재시도, 중단과 재개가 있는 실행 루프로 설계한 기록입니다.
읽어보기MCP와 A2A를 같은 연결 기술로 묶지 않고 도구 접근, 에이전트 협업, 권한의 위치를 나눠 본 기록입니다.
읽어보기외부 결제 콜백의 중복·순서 변경·재시도를 멱등성과 상태 전이로 다룬 기록입니다.
읽어보기WebTransport의 stream과 datagram을 WebSocket과 비교하고 실시간 화면의 재접속 상태를 명시적인 상태 머신으로 정리했습니다.
읽어보기