Nate Herk | AI AutomationYOUTUBE SUMMARIES · 2026-09-13 · Nate Herk | AI Automation🎬 영상
AI 에이전트 선택은 모델 성능보다 하네스·자산 설계가 좌우한다.
AI 에이전트는 모델 우열보다 하네스·스킬·자산의 이식성과 관리가 중요하다.
01핵심 개요
- 모델은 ‘병 속의 뇌’에 비유되며, 파일 읽기·쓰기·Bash·로컬 실행 같은 하네스가 실제 결과물을 만든다고 설명한다.
- LM Studio의 Qwen 27B는 HTML을 생성해도 로컬 서버를 만들 수 없지만, Claude Code·Codex는 컴퓨터 상호작용 기능을 갖춘다고 비교한다.
- 발표자는 공급업체가 아닌 자신의 장비·자산에 충성해야 하며, 스킬을 여러 모델과 하네스에서 쓰도록 설계해야 한다고 말한다.
- Claude Code는 기획과 아이디어 구상, Codex는 정확한 지시 이행과 검증 루프에 강점이 있다는 작업별 활용 사례를 제시한다.
- AIOS를 프로젝트별로 분리하고 스킬·규칙·정체성의 변화 속도에 맞춰 정기 감사하는 방식을 권한다.
02핵심 주장 / 논점 구조
- Claude, Codex, Gemini 등 ‘뇌’ 자체의 우열보다 도구·파일·셸·검증 루프를 묶는 하네스가 실사용 성능을 크게 좌우한다고 본다.
- 모델은 입력을 받아 출력하는 두뇌이고, 하네스는 모델이 로컬 컴퓨터·클라우드·파일 시스템과 상호작용하게 하는 손과 다리로 설명된다.
- 특정 공급업체에 종속되기보다 스킬·문서·핵심 자산을 모델 중립적으로 보유해 필요할 때 두뇌를 교체하는 것이 목표다.
- AI에게 사고 작업을 맡길 수는 있어도, 파일 위치와 시스템 작동 원리에 대한 이해까지 외주화해서는 안 된다고 강조한다.
03하네스가 모델 출력을 실행 가능한 결과로 바꾸는 방식
- 하네스는 파일 읽기·쓰기·편집, Bash 사용, 폴더 생성·이동처럼 모델에 기본 탑재되지 않은 컴퓨터 제어 기능을 제공한다.
- 로컬 모델에 웹사이트 제작과 로컬 실행을 요청하면 HTML은 만들 수 있어도 서버를 실행할 팔다리가 없어 후자를 수행하지 못한다고 설명한다.
- 에이전트 루프는 요청 후 스크립트를 실행하고, 오류 또는 성공 결과를 받아 다음 행동을 반복하는 과정으로 소개된다.
- 더 나은 모델은 어떤 도구와 스크립트를 언제 사용할지 더 잘 판단하지만, 도구 활용을 가능케 하는 환경 역시 핵심 요소라고 말한다.
04LM Studio와 Claude Code·Codex의 실행 능력 비교
- LM Studio는 오픈소스 모델로 ChatGPT 같은 대화를 실행하는 도구이며, 발표자는 이를 하네스 없이 뇌와 직접 상호작용하는 사례로 든다.
- Qwen 27B에 ‘Prompt Advisor’ 랜딩 페이지를 만들고 로컬 호스팅하라고 요청한 예시에서, 모델은 HTML 출력은 가능해도 컴퓨터와 상호작용해 서버를 만들 수 없다고 설명한다.
- 웹 기반 Claude 채팅은 검색이나 PDF 생성 같은 기본 기능을 수행하지만, 로컬 파일 접근·파일 이동 등 배경 환경을 직접 다루기 어려울 수 있다고 말한다.
- Claude Code는 로컬 컴퓨터와 클라우드 모두와 상호작용할 수 있어, 단순한 생성 결과보다 실제 작업 완료에 유리하다고 비교한다.
05Claude Code·Codex·Hermes를 작업별로 전환하는 전략
- 발표자는 최근 작업 시간의 약 60%를 Codex에 쓰며, Claude Code는 오래 사용해 익숙한 리듬이 있다고 말한다.
- Claude Code는 아이디어 구상과 계획에 강한 ‘재능 있는 예술가’ 또는 ‘현명한 늙은 올빼미’, Codex는 지시를 끝까지 수행하는 ‘외과의사’ 또는 ‘로트와일러’로 비유된다.
- Claude Code의 계획을 Codex가 검토하고, 누락된 부분을 찾도록 최대 10라운드의 반복 검토를 시킨 사례를 든다.
- Hermes는 원하는 모델을 연결하는 하네스이며, 검증 루프 등을 조정해 Codex와 유사한 동작을 모방하도록 구성할 수 있다고 설명한다.
06모델 중립적 폴리 스킬과 자산 이식 방법
- 발표자는 모든 스킬을 Claude Code용에서 Codex에 최적화된 형태로 변환하는 ‘폴리 스킬’을 사용한다고 말한다.
- 핵심 자산이 담긴 하나의 링크를 두고, 서로 다른 모델이 동일한 자산의 위치를 찾도록 해 모델 교체를 쉽게 만든다.
- 스킬 파일 상단의 YAML에는 스킬명, kebab-case 형식, 특정 행동에 따라 스킬을 실행시키는 트리거 단어가 들어간다고 설명한다.
- Codex와 Claude Code의 문서를 AI가 검토하게 해 여러 플랫폼에서 작동할 스킬을 만들고, 필요한 경우 설명을 더 상세하게 조정한다고 말한다.
- 파이썬 스크립트 자체는 공통적으로 활용할 수 있지만, 모델이 언제 어떻게 호출할지 알도록 하는 부분은 조정이 필요하다고 설명한다.
07AIOS의 부패 관리와 프로젝트별 운영체제 분리
- rot.md 파일을 통해 AIOS의 정체성·기반 맥락·스킬·규칙·후크·에이전트가 서로 다른 속도로 부패하거나 무용해진다고 관리한다.
- 정체성과 목표는 1~3개월 또는 그 이상 유지될 수 있는 반면, 규칙은 새 작업의 제약과 예외에 따라 매일 바뀔 수 있다고 말한다.
- GitHub에 클라이언트 프로젝트를 푸시할 때 PII와 민감 데이터를 제거하는 후크는 약 6개월간 크게 부패하지 않을 수 있는 사례로 제시된다.
- 보리스 체르니가 6개월마다 모든 스킬을 삭제해야 한다고 했다는 언급을 들어, 모델이 발전하면 기존 스킬이 가치보다 마찰을 만들 수 있다고 주장한다.
- 세무·재무, 컨설팅, 학교, 고객 서비스별로 운영체제를 분리하고 전역 규칙은 극소수만 유지해 실험의 영향 범위를 작게 만든다고 설명한다.
08용어 사전
| 용어 | 뜻 |
|---|
| 하네스 | 모델이 파일·Bash·로컬 컴퓨터·클라우드와 상호작용하고 결과를 검증하도록 둘러싼 도구와 환경을 뜻한다. |
| 에이전트 루프 | 요청에 따라 스크립트를 실행한 뒤 오류 또는 성공 결과를 받아 다음 행동을 반복하는 과정이다. |
| 폴리 스킬 | Claude Code용 스킬을 Codex 등 다른 모델과 하네스에서도 작동하도록 변환·최적화하는 발표자의 스킬 방식이다. |
| AIOS | 정체성, 기반 맥락, 스킬, 규칙, 후크, 에이전트 등을 계층적으로 관리하는 개인 운영체제 개념이다. |
| rot.md | AIOS 구성 요소마다 무용화·변화 속도가 다르다는 전제에서 점검 주기를 관리하기 위해 만든 파일이다. |
| 검증 루프 | 작업 결과를 확인하고 누락이나 오류를 찾아 반복 수정하는 과정으로, 영상에서는 Codex의 강점으로 언급된다. |