Nate Herk | AI AutomationYOUTUBE SUMMARIES · 2026-09-13 · Nate Herk | AI Automation🎬 영상

AI 에이전트 선택은 모델 성능보다 하네스·자산 설계가 좌우한다.

AI 에이전트는 모델 우열보다 하네스·스킬·자산의 이식성과 관리가 중요하다.

01핵심 개요

  • 모델은 ‘병 속의 뇌’에 비유되며, 파일 읽기·쓰기·Bash·로컬 실행 같은 하네스가 실제 결과물을 만든다고 설명한다.
  • LM Studio의 Qwen 27B는 HTML을 생성해도 로컬 서버를 만들 수 없지만, Claude Code·Codex는 컴퓨터 상호작용 기능을 갖춘다고 비교한다.
  • 발표자는 공급업체가 아닌 자신의 장비·자산에 충성해야 하며, 스킬을 여러 모델과 하네스에서 쓰도록 설계해야 한다고 말한다.
  • Claude Code는 기획과 아이디어 구상, Codex는 정확한 지시 이행과 검증 루프에 강점이 있다는 작업별 활용 사례를 제시한다.
  • AIOS를 프로젝트별로 분리하고 스킬·규칙·정체성의 변화 속도에 맞춰 정기 감사하는 방식을 권한다.

02핵심 주장 / 논점 구조

  • Claude, Codex, Gemini 등 ‘뇌’ 자체의 우열보다 도구·파일·셸·검증 루프를 묶는 하네스가 실사용 성능을 크게 좌우한다고 본다.
  • 모델은 입력을 받아 출력하는 두뇌이고, 하네스는 모델이 로컬 컴퓨터·클라우드·파일 시스템과 상호작용하게 하는 손과 다리로 설명된다.
  • 특정 공급업체에 종속되기보다 스킬·문서·핵심 자산을 모델 중립적으로 보유해 필요할 때 두뇌를 교체하는 것이 목표다.
  • AI에게 사고 작업을 맡길 수는 있어도, 파일 위치와 시스템 작동 원리에 대한 이해까지 외주화해서는 안 된다고 강조한다.

03하네스가 모델 출력을 실행 가능한 결과로 바꾸는 방식

  • 하네스는 파일 읽기·쓰기·편집, Bash 사용, 폴더 생성·이동처럼 모델에 기본 탑재되지 않은 컴퓨터 제어 기능을 제공한다.
  • 로컬 모델에 웹사이트 제작과 로컬 실행을 요청하면 HTML은 만들 수 있어도 서버를 실행할 팔다리가 없어 후자를 수행하지 못한다고 설명한다.
  • 에이전트 루프는 요청 후 스크립트를 실행하고, 오류 또는 성공 결과를 받아 다음 행동을 반복하는 과정으로 소개된다.
  • 더 나은 모델은 어떤 도구와 스크립트를 언제 사용할지 더 잘 판단하지만, 도구 활용을 가능케 하는 환경 역시 핵심 요소라고 말한다.

04LM Studio와 Claude Code·Codex의 실행 능력 비교

  • LM Studio는 오픈소스 모델로 ChatGPT 같은 대화를 실행하는 도구이며, 발표자는 이를 하네스 없이 뇌와 직접 상호작용하는 사례로 든다.
  • Qwen 27B에 ‘Prompt Advisor’ 랜딩 페이지를 만들고 로컬 호스팅하라고 요청한 예시에서, 모델은 HTML 출력은 가능해도 컴퓨터와 상호작용해 서버를 만들 수 없다고 설명한다.
  • 웹 기반 Claude 채팅은 검색이나 PDF 생성 같은 기본 기능을 수행하지만, 로컬 파일 접근·파일 이동 등 배경 환경을 직접 다루기 어려울 수 있다고 말한다.
  • Claude Code는 로컬 컴퓨터와 클라우드 모두와 상호작용할 수 있어, 단순한 생성 결과보다 실제 작업 완료에 유리하다고 비교한다.

05Claude Code·Codex·Hermes를 작업별로 전환하는 전략

  • 발표자는 최근 작업 시간의 약 60%를 Codex에 쓰며, Claude Code는 오래 사용해 익숙한 리듬이 있다고 말한다.
  • Claude Code는 아이디어 구상과 계획에 강한 ‘재능 있는 예술가’ 또는 ‘현명한 늙은 올빼미’, Codex는 지시를 끝까지 수행하는 ‘외과의사’ 또는 ‘로트와일러’로 비유된다.
  • Claude Code의 계획을 Codex가 검토하고, 누락된 부분을 찾도록 최대 10라운드의 반복 검토를 시킨 사례를 든다.
  • Hermes는 원하는 모델을 연결하는 하네스이며, 검증 루프 등을 조정해 Codex와 유사한 동작을 모방하도록 구성할 수 있다고 설명한다.

06모델 중립적 폴리 스킬과 자산 이식 방법

  • 발표자는 모든 스킬을 Claude Code용에서 Codex에 최적화된 형태로 변환하는 ‘폴리 스킬’을 사용한다고 말한다.
  • 핵심 자산이 담긴 하나의 링크를 두고, 서로 다른 모델이 동일한 자산의 위치를 찾도록 해 모델 교체를 쉽게 만든다.
  • 스킬 파일 상단의 YAML에는 스킬명, kebab-case 형식, 특정 행동에 따라 스킬을 실행시키는 트리거 단어가 들어간다고 설명한다.
  • Codex와 Claude Code의 문서를 AI가 검토하게 해 여러 플랫폼에서 작동할 스킬을 만들고, 필요한 경우 설명을 더 상세하게 조정한다고 말한다.
  • 파이썬 스크립트 자체는 공통적으로 활용할 수 있지만, 모델이 언제 어떻게 호출할지 알도록 하는 부분은 조정이 필요하다고 설명한다.

07AIOS의 부패 관리와 프로젝트별 운영체제 분리

  • rot.md 파일을 통해 AIOS의 정체성·기반 맥락·스킬·규칙·후크·에이전트가 서로 다른 속도로 부패하거나 무용해진다고 관리한다.
  • 정체성과 목표는 1~3개월 또는 그 이상 유지될 수 있는 반면, 규칙은 새 작업의 제약과 예외에 따라 매일 바뀔 수 있다고 말한다.
  • GitHub에 클라이언트 프로젝트를 푸시할 때 PII와 민감 데이터를 제거하는 후크는 약 6개월간 크게 부패하지 않을 수 있는 사례로 제시된다.
  • 보리스 체르니가 6개월마다 모든 스킬을 삭제해야 한다고 했다는 언급을 들어, 모델이 발전하면 기존 스킬이 가치보다 마찰을 만들 수 있다고 주장한다.
  • 세무·재무, 컨설팅, 학교, 고객 서비스별로 운영체제를 분리하고 전역 규칙은 극소수만 유지해 실험의 영향 범위를 작게 만든다고 설명한다.

08용어 사전

용어뜻
하네스모델이 파일·Bash·로컬 컴퓨터·클라우드와 상호작용하고 결과를 검증하도록 둘러싼 도구와 환경을 뜻한다.
에이전트 루프요청에 따라 스크립트를 실행한 뒤 오류 또는 성공 결과를 받아 다음 행동을 반복하는 과정이다.
폴리 스킬Claude Code용 스킬을 Codex 등 다른 모델과 하네스에서도 작동하도록 변환·최적화하는 발표자의 스킬 방식이다.
AIOS정체성, 기반 맥락, 스킬, 규칙, 후크, 에이전트 등을 계층적으로 관리하는 개인 운영체제 개념이다.
rot.mdAIOS 구성 요소마다 무용화·변화 속도가 다르다는 전제에서 점검 주기를 관리하기 위해 만든 파일이다.
검증 루프작업 결과를 확인하고 누락이나 오류를 찾아 반복 수정하는 과정으로, 영상에서는 Codex의 강점으로 언급된다.
Nate Herk | AI Automation · 2026-09-13
← 목록으로