평범한 사업가YOUTUBE SUMMARIES · 2026-09-12 · 평범한 사업가🎬 영상

개인 AI 에이전트는 기록·절차·검증을 갖춘 반복 업무부터 실험해야 한다.

AI 에이전트는 기록·근거·검증을 갖춘 반복 업무 하나부터 측정하며 시작한다.

01핵심 개요

  • YC의 GARRY TAN은 개인 기록과 업무 절차를 AI에 연결해 반복 사용하며 축적하는 ‘개인 AGI’ 비전을 제안했다.
  • 영상은 개인 AGI를 범용 인공지능 완성의 과학적 판정이 아닌, 발표자의 비전으로 구분해 해석한다.
  • METR의 2025년 연구에서는 숙련된 개발자 16명이 246개 작업을 할 때 AI 사용 완료 시간이 평균 19% 더 길었다.
  • 기록은 출처·적용 시점·상태를 함께 관리하고, 결과에는 근거를 붙여 실제 결론을 지지하는지 확인해야 한다.
  • 첫 적용은 회의록 정리처럼 반복 업무 하나를 골라 시간·오류·품질을 기록하며 일주일간 검증하는 방식이다.

02핵심 주장 / 논점 구조

  • 강연의 핵심은 모델 성능을 빌리되, 개인의 기록·업무 맥락·반복 절차는 스스로 소유하고 축적하자는 제안이다.
  • 영상은 원본의 아이디어, 다른 자료로 확인할 수 있는 근거, 직접 적용할 방법을 구분해 다룬다.
  • 소유는 판단을 돕는 모델, 일을 이해하게 만드는 자료, 결과를 만드는 절차의 세 요소로 업무화된다.
  • 목표는 거대한 시스템 설치가 아니라 이번 주 반복 업무 하나를 다음번에 덜 설명하고 더 정확히 끝내는 것이다.

03생산성 수치와 실제 작업 시간 측정

  • GARRY TAN은 2013년과 비교해 결과물이 약 400배 수준이라고 말하지만, 영상은 이를 개인 업무에 그대로 적용하지 말라고 한다.
  • METR의 2025년 연구에서 숙련된 오픈소스 개발자 16명은 익숙한 프로젝트의 246개 작업을 무작위 조건으로 수행했다.
  • 해당 조건에서 AI 사용 시 완료 시간은 평균 19% 더 길었으며, 개발자 체감과 측정 결과가 달랐다는 점이 제시된다.
  • 회의록 정리의 가정 예시에서 직접 작업은 30분, AI 초안 5분에 준비 7분·검토 20분이면 총 32분이 된다.
  • 요청 작성부터 실제 사용 가능한 결과가 나올 때까지 재고, 잘못된 날짜나 빠진 할 일도 함께 기록해야 한다.

04기억 관리와 근거 중심 기록

  • 저장한 정보와 현재 답변을 만드는 데 실제로 사용한 정보는 다르므로, 자료가 들어갔는지보다 제대로 활용됐는지를 봐야 한다.
  • 2023년 ‘Lost in the Middle’ 연구는 긴 입력에서 필요한 정보 위치에 따라 성능이 달라지고 중간 정보 활용이 어려운 경우를 관찰했다.
  • 중요 기록에는 작성 날짜뿐 아니라 적용 시점과 초안·확정·폐기 같은 상태를 붙이는 방식을 제안한다.
  • 금요일 저녁 7시 강의와 다음 주부터 토요일 오전 10시 강의라는 문서가 충돌하면, 적용 시점·확정자·적용 수업을 확인해야 한다.
  • 변경 근거가 없거나 기록끼리 충돌할 경우 ‘확인 필요’로 남기고, 오래된 내용을 조용히 지우지 않는다.

05스킬 파일과 회의록 정리 절차

  • 스킬은 영어로 쓴 한 페이지로, 똑똑한 인턴이나 글을 읽는 사람이 따라 할 수 있어야 한다는 판단 기준이 제시된다.
  • 회의록 스킬의 목표는 ‘다음 행동을 빠짐없이 정리한다’이며, 입력은 회의록과 현재 프로젝트 기준만 사용한다.
  • 출력은 할 일·담당자·기한·근거 문장을 표로 만들고, 담당자나 기한이 없으면 추측하지 않고 ‘미정’으로 표시한다.
  • 완료 조건은 모든 항목에 근거가 연결되고 외부 발송을 하지 않은 상태이며, 평범한 회의록과 날짜 충돌 회의록으로 확인한다.
  • 한 번 잘 나온 결과로 절차를 고정하지 않고, 실패 원인을 한 줄로 고쳐 같은 입력에서 다시 확인한다.

06워크플로·에이전트 구분과 실행 검증

  • Anthropic의 에이전트 설계 글은 정해진 순서로 처리하는 워크플로와 모델이 다음 행동을 정하는 에이전트를 구분한다.
  • 영상은 필요한 만큼만 복잡하게 만들 것을 권하며, 모든 작업에 여러 에이전트가 필요하다는 뜻은 아니라고 설명한다.
  • 회의 문장에서 할 일을 찾아 표현하는 해석 작업은 모델이 초안을 만들고, 날짜 형식 검사나 금액 합산은 코드·규칙으로 처리할 수 있다.
  • 참가자 수를 세는 작업처럼 정확한 숫자가 필요한 경우에는 그럴듯한 문장보다 단계별 검증이 중요하다.
  • 사람이 읽을 수 있는 지침을 작성했다고 계산까지 자동으로 정확해지는 것은 아니므로, 단계마다 확인 방식을 지정해야 한다.

07프롬프트 인젝션과 일주일 실험 기준

  • OWASP가 설명하는 프롬프트 인젝션에는 외부 자료를 통해 모델 행동을 바꾸려는 경우도 포함된다고 영상은 설명한다.
  • 회의 자료에 고객 명단을 특정 주소로 보내라는 문장이 있어도 이는 자료 내용일 뿐, 새 실행 지시로 취급하지 않아야 한다.
  • 회의록 읽기 권한과 외부 발송 권한을 나누고, 처음에는 읽기·초안 작성부터 맡긴 뒤 발송·변경은 확인 후 실행한다.
  • 15분 실행안은 업무 선택 3분, 성공 사례와 입력 자료 수집 5분, 다섯 줄 지침 작성 5분, 확인 질문 작성 2분으로 구성된다.
  • 일주일 뒤에는 같은 품질의 시간 단축, 반복 오류 감소, 관리 부담을 기준으로 계속·축소·중단을 판단한다.

08용어 사전

용어뜻
개인 AGIGARRY TAN이 제안한 표현으로, 개인의 인프라에서 기억을 읽고 작성한 절차를 실행하며 효과를 축적하는 에이전트 비전이다.
스킬 파일반복 업무의 목표·입력·출력·예외·완료 조건을 적어 인턴이나 에이전트가 따라 하도록 만든 작업 지침이다.
워크플로Anthropic의 구분에서 정해진 순서에 따라 처리하는 방식으로, 모델이 다음 행동을 정하는 에이전트와 대비된다.
프롬프트 인젝션외부 자료에 포함된 문장 등을 통해 모델의 행동을 바꾸려는 공격 또는 위험으로, 읽기와 발송 권한 분리가 대응으로 제시된다.
Lost in the Middle긴 입력에서 필요한 정보의 위치에 따라 모델 성능이 달라질 수 있으며 중간 정보를 활용하지 못하는 경우를 관찰한 2023년 연구다.
평범한 사업가 · 2026-09-12
← 목록으로