happy_various AI 실전 기록

2026년 9월 8일 기준

이 글에는 제휴 링크가 없습니다. 다이어그램은 직접 제작했습니다.

AI 에이전트 만들기 입문 — 폰에서 이슈 하나 올리면 11분 뒤 블로그 3채널에 발행되는 구조

오늘 저녁 6시 48분, 점심에 다녀온 샤브 뷔페 사진 12장을 폰에서 GitHub 이슈로 올렸습니다. 6시 59분, 그 후기가 제 여행 블로그와 네이버 블로그, 인스타그램에 올라가 있었고 이슈에는 발행 주소가 댓글로 달린 채 닫혀 있었어요. 11분. 그 사이 제가 한 일은 없습니다. 이게 제가 실제로 굴리는 AI 에이전트고, 이 글은 그걸 뜯어서 “에이전트가 뭔지, 뭘로 만드는지, 어디서부터 시작하면 되는지”를 설명합니다.

결론 요약

🧩 1. 에이전트는 챗봇과 뭐가 다른가

챗봇은 질문 → 답입니다. 답을 받아서 뭘 할지는 내가 정하고, 다음 단계도 내가 시킵니다. 에이전트는 목표 → 완료예요. “이 이슈 처리해”라고 하면 사진을 내려받고, 글을 쓰고, 사이트를 배포하고, 네이버에 올리고, 인스타에 올리고, 이슈에 댓글을 답니다. 각 단계 사이의 “다음엔 뭘 하지”를 AI가 스스로 잇습니다.

차이를 만드는 건 세 가지입니다.

챗봇에이전트
입력질문목표
도구없음 (말만)있음 (파일·명령·브라우저·API)
루프한 번 답하고 끝결과 보고 다음 행동 결정, 끝날 때까지 반복
실패 시틀린 답재시도하거나, 멈추고 사람에게 보고

핵심은 마지막 줄이에요. 에이전트는 막혔을 때 뭘 할지까지 정해져 있어야 합니다. 오늘 실제로 그런 순간이 있었는데 뒤에서 보여드릴게요.

📦 2. 실물 — 이슈 하나가 3채널 발행이 되기까지

GitHub 이슈에서 3채널 발행까지 — 에이전트가 잇는 5단계 (직접 제작)

제 여행 블로그 라인의 발행 파이프라인입니다. 사람이 하는 일은 딱 하나, 폰에서 이슈 올리기뿐이에요.

단계에이전트가 하는 일쓰는 도구
① 수집열린 이슈를 찾고 본문·사진 주소를 읽는다GitHub API (스크립트 108줄)
② 사진첨부 전부 내려받아 회전 보정·리사이즈, 한 장씩 보고 얼굴 나온 컷을 뺀다같은 스크립트 + AI의 이미지 판독
③ 글이슈 본문에 있는 사실만으로 원고를 쓴다AI 본체
④ 발행사이트 빌드·배포, 네이버 재구성판 작성·카테고리·발행, 카드뉴스 생성·인스타 게시배포 스크립트, 브라우저 자동화, 카드 생성기
⑤ 회신이슈에 발행 주소 댓글, 이슈 닫기, 기록·커밋GitHub API, git

오늘 타임라인은 이랬습니다.

⚙️ 3. 재료 세 가지 — 지시서·도구·규칙

이 에이전트를 “만들었다”고 할 때 실제로 만든 건 파일 몇 개입니다.

① 지시서 (91줄짜리 마크다운) “인박스 확인 → 사진 수집 → 글 생성 → 발행 → 회신”이 순서대로 적혀 있고, 각 단계에 어떤 명령을 치는지, 사진은 몇 장 쓰는지, 글 형식은 뭔지가 들어 있어요. yml 글에서 “반복해서 설명하던 걸 파일로 빼라”고 했는데, 지시서는 그걸 절차 수준으로 확장한 겁니다. AI는 매번 이 파일을 읽고 시작합니다.

② 도구 (스크립트 몇 개) 이슈를 읽고 사진을 받는 스크립트 108줄, 사이트를 배포하는 스크립트, 네이버 에디터를 조종하는 브라우저 자동화, 카드뉴스 생성기. 전부 AI가 만들었고, 저는 “수동으로 3번 이상 해본 일만 스크립트로 만든다”는 원칙만 지켰어요. HTML 파일 하나가 앱이 되듯, 스크립트 하나가 에이전트의 손이 됩니다.

③ 규칙 (하면 안 되는 것 + 승인 지점)

셋 중 뭐가 제일 중요하냐면 ③입니다. 지시서와 도구는 AI가 금방 만들어주지만, 규칙은 사람이 정해야 하고 사고는 규칙이 없는 곳에서 납니다.

🔍 4. “막혔을 때”가 진짜 실력입니다

오늘 에이전트가 두 번 판단을 했습니다.

첫째, 사진 12장 중 2장을 뺐습니다. 샐러드 바 원경에 다른 손님들 얼굴이, 아이스크림 기계 앞에 통화 중인 손님이 찍혀 있었어요. 규칙(“얼굴 나온 컷 제외”)이 있으니 판단은 쉬웠고, 뺐다는 사실은 이슈 댓글에 남겼습니다.

둘째, 제 메모와 사진이 달랐습니다. 저는 “100분 이용”이라고 적었는데, 제가 찍은 안내판 사진엔 “점심 80분·저녁 100분”이라고 돼 있었어요. 점심 회식이었으니 에이전트는 안내판 기준으로 쓰고, “실제 100분이었다면 알려달라”고 이슈 댓글로 물었습니다. 멈추지도 않았고, 제 메모를 그대로 믿지도 않았어요.

두 번째가 에이전트다운 순간입니다. 챗봇이면 제 말을 그대로 옮겼을 거고, 규칙 없는 자동화면 멈췄을 거예요. “사실이 충돌하면 근거가 강한 쪽을 쓰고, 사람에게 확인을 남긴다”는 규칙이 이걸 가능하게 합니다. AI 산출물은 검증까지가 한 세트라는 원칙을 에이전트 안에 넣어둔 셈이죠.

🎯 5. 입문 로드맵 — 4단계

거창한 프레임워크 없이, 제가 실제로 밟은 순서입니다.

1단계 — 반복하는 지시를 파일로 뺀다. AI에게 매번 같은 말을 하고 있다면 그게 지시서의 첫 줄입니다. 형식은 yml이든 마크다운이든 상관없어요.

2단계 — 도구를 하나 만든다. “이 폴더의 사진을 전부 리사이즈해줘”처럼 매번 손으로 하던 일 하나를 스크립트로. AI에게 “이 작업을 스크립트로 만들어줘”라고 하면 됩니다. 단, 손으로 3번은 해본 뒤에. 입력·출력·예외를 모르는 채 자동화하면 사고가 자동화됩니다.

3단계 — 트리거를 정한다. 에이전트가 “언제 움직이는지”입니다. 저는 GitHub 이슈를 골랐어요. 폰에서 사진 첨부가 되고, 댓글로 대화가 되고, 닫으면 처리 완료가 되니까요. 메일이든 특정 폴더든, 사람이 편한 입구를 고르세요.

4단계 — 승인 지점을 박는다. 돈이 나가거나, 외부에 공개되거나, 되돌리기 어려운 행동 앞에 “여기서 멈추고 사람에게 묻는다”를 넣습니다. 저는 블로그 발행은 위임했지만 플레이스 리뷰 등록은 매번 승인합니다. 이 선은 에이전트가 아니라 사람이 긋는 것이고, 나중에 넓힐 수는 있어도 처음부터 없애면 안 됩니다.

Claude Code를 쓴다면 지시서는 .claude/commands/에 두는 슬래시 커맨드가, 도구는 훅과 서브에이전트가 그대로 대응됩니다.

⚠️ 6. 주의 — 에이전트라서 생기는 함정

시작 코스

  1. 오늘 AI에게 두 번 이상 같은 설명을 했다면, 그걸 파일 하나로 (1단계)
  2. 손으로 3번 이상 해본 단순 작업 하나를 “스크립트로 만들어줘” (2단계)
  3. 그 둘을 이어서 “이 파일 규칙대로 이 스크립트를 돌려줘”가 되면, 이미 에이전트의 절반입니다

AI 업무 자동화는 도구가 아니라 순서라고 썼는데, 에이전트는 그 순서의 끝에 있는 게 아니라 순서 자체를 파일에 적어둔 것입니다. 오늘 11분은 그 파일 91줄이 만든 시간이에요.


기준: 2026-09-08. 타임라인은 GitHub 이슈 #5의 등록·댓글·종료 시각(UTC → KST)과 발행 커밋 시각에서 확인했습니다. 지시서·스크립트 줄 수는 실제 파일을 셌습니다. 다이어그램은 직접 제작했습니다.