본문으로 바로가기
CLAUDE CODE

Claude Code 플러그인 4종, 깔기 전에 직접 재본 기록 (Karpathy 스킬·I Have ADHD·Superpowers·Claude Octopus)

Claude Code 플러그인 추천으로 자주 보이는 Karpathy 스킬, I Have ADHD, Superpowers, Claude Octopus를 직접 설치해 대화 시작 토큰과 같은 지시 A/B 결과를 쟀습니다. 무엇을 남기고 언제 켤지 정리했습니다.

작성 2026년 10월 9일읽기 16분
Claude Code 플러그인 깔기 전에 재봤습니다라는 제목 옆에 Karpathy 스킬 99, I Have ADHD 0, Superpowers 2,164, Octopus 5,087 토큰 막대그래프를 놓은 대표 이미지

얼마 전 인스타그램에서 "이 4개 플러그인을 깔기 전에는 Claude Code로 바이브코딩을 시작하지 마라"는 릴스를 봤습니다. Superpowers, Karpathy 스킬, I Have ADHD, Claude Octopus 네 개를 50초 안에 소개하는 영상이었습니다. 그런데 같은 날 유튜브에서는 정반대 주장을 하는 영상도 봤습니다. "하네스는 죽었다, Superpowers 같은 건 전부 지워라"는 내용입니다.

한쪽은 깔라고 하고 한쪽은 지우라고 하니 결국 직접 재보는 수밖에 없었습니다. 이번 글에서는 네 플러그인을 하나씩 설치해서 대화를 시작할 때 얼마나 많은 글자를 먼저 읽히는지(토큰)와 같은 지시를 줬을 때 결과가 어떻게 달라지는지(A/B 실험)를 재본 기록을 정리하겠습니다. A/B는 조건마다 2번씩 총 20번 돌렸고 Octopus는 사정상 직접 돌리지 못해 그 대신 Claude와 Codex로 교차 리뷰를 손으로 해봤습니다.

(작성일 2026-10-09 기준입니다. Claude Code 2.1.294, 모델은 claude-opus-5-5, Windows 11에서 쟀습니다. 레포가 자주 바뀌어서 지금 보시면 숫자가 다를 수 있습니다.)

사용 도구 및 준비물

플러그인이 컨텍스트를 먹는 방식

먼저 용어 몇 개만 짚고 가겠습니다.

  • context(컨텍스트, 모델이 한 번에 펼쳐 놓고 보는 작업대): 대화 내용, 규칙 파일, 도구 설명이 전부 여기 올라갑니다. 작업대가 넓어도 잡동사니가 많으면 정작 내 요청이 묻힙니다.
  • token(토큰, 모델이 글자를 세는 단위): 영어는 대략 단어 하나가 1~2토큰입니다. 이 글의 숫자는 전부 토큰입니다.
  • skill(스킬)과 plugin(플러그인): 스킬은 "이럴 땐 이렇게 해라"를 적은 지시서 파일(SKILL.md)이고, 플러그인은 스킬·명령어·훅을 한 번에 설치하게 묶은 꾸러미입니다.
  • hook(훅, 특정 순간에 자동으로 실행되는 스크립트): 대화 시작, 명령 실행 직전처럼 정해진 순간에 끼어들어 무언가를 하거나 글을 더 넣습니다.

스킬은 도서관에 비유하면 이해가 쉽습니다. 평소에는 책 제목과 한 줄 소개(스킬 설명)만 목록에 꽂혀 있고 필요해지면 그때 책 본문을 꺼내 읽습니다. 그래서 스킬 자체는 가볍습니다. 문제는 목록이 길어지는 경우, 그리고 훅이 대화 시작마다 책 한 권을 통째로 펼쳐 놓는 경우입니다.

그래서 첫 번째로 잰 건 아무 말도 하기 전에 얼마나 읽히는가입니다. 빈 폴더에서 Claude Code를 헤드리스 모드(claude -p, 화면 없이 명령어로 한 번 실행)로 띄우고 "ok라고만 답해"를 보낸 뒤, 첫 요청의 입력 토큰을 플러그인 유무로 비교했습니다. 아무것도 설치하지 않은 상태는 34,152토큰이었습니다(3번 재서 ±1).

플러그인별로 대화를 시작할 때 추가로 읽는 토큰 수를 비교한 막대그래프

차트를 읽어 보면 같은 "플러그인"인데 무게가 50배 넘게 차이 납니다. 숫자 뒤의 구조도 같이 정리해 보겠습니다.

플러그인들어 있는 것대화 시작 시 추가 토큰언제 본문을 읽나
Karpathy 스킬스킬 1개 (SKILL.md 2,585바이트)+99코드 작업일 때 모델이 판단해서
Karpathy CLAUDE.md규칙 파일 1개 (2,422바이트)+1,007매 대화 항상
I Have ADHD스킬 1개 (7,343바이트), 시작 훅 1개0/i-have-adhd를 입력했을 때만 (+2,532)
Superpowers스킬 15개, 시작 훅 1개+2,164 (훅 빼면 +864)훅이 시작 안내서를 매번 넣음
Claude Octopus스킬 폴더 61개, 명령 54개, 에이전트 파일 5개, 훅 항목 43개, 1,408파일 22MB+5,087 (훅 제외)대부분 /octo:*로 직접 부를 때만

몇 가지는 직접 열어 보고 알았습니다.

  • I Have ADHD가 0인 이유: 스킬 파일 머리에 disable-model-invocation: true가 적혀 있습니다. 모델이 알아서 부르지 못하게 막아 둔 설정이라 목록에도 안 올라갑니다. 내가 /i-have-adhd를 칠 때만 본문이 들어옵니다.
  • Superpowers의 +2,164 중 1,300토큰 정도는 훅입니다. 대화가 시작될 때마다 using-superpowers 스킬 전문을 <EXTREMELY_IMPORTANT> 태그로 감싸 넣습니다.
  • Octopus는 소개처럼 "도구 하나"가 아니라 이 넷 중 가장 큰 꾸러미입니다. README는 /octo:*를 직접 부르기 전까지는 잠들어 있다(dormant)고 설명하고 실제로 스킬 폴더 61개 중 59개가 직접 호출 전용입니다. 그래도 목록 설명만으로 5,087토큰이 상주합니다.

5,087토큰이 어느 정도냐면, 대략 영어 문서 A4 7~8쪽 분량을 매 대화 앞에 깔고 시작하는 셈입니다. 작업대 크기(이 모델은 100만 토큰)에 비하면 1%도 안 되니 당장 느려질 정도는 아닙니다. 다만 이런 꾸러미가 서너 개 쌓이면 이야기가 달라질 수 있습니다.

Karpathy 스킬, 8줄과 27줄

Karpathy 스킬은 이름과 달리 Andrej Karpathy 본인이 만든 게 아닙니다. Karpathy가 X에 올린 "LLM이 코딩할 때 저지르는 실수" 글을 보고 forrestchang(현재 multica-ai 계정으로 이전)이 CLAUDE.md 한 장으로 정리한 레포입니다. GitHub 별은 작성일 기준 217,579개입니다.

규칙은 네 덩어리가 전부입니다. 원문 제목과 한 줄 설명을 그대로 옮기면 다음과 같습니다.

  1. Think Before Coding: Don't assume. Don't hide confusion. Surface tradeoffs.
  2. Simplicity First: Minimum code that solves the problem. Nothing speculative.
  3. Surgical Changes: Touch only what you must. Clean up only your own mess.
  4. Goal-Driven Execution: Define success criteria. Loop until verified.

(번역) 1. 코딩 전에 생각하기: 짐작하지 말고, 헷갈리는 걸 숨기지 말고, 선택지의 장단점을 드러낼 것. 2. 단순함 먼저: 문제를 푸는 최소한의 코드만, 추측성 기능은 넣지 말 것. 3. 수술하듯 고치기: 꼭 필요한 곳만 건드리고, 내가 어지른 것만 치울 것. 4. 목표 중심 실행: 성공 기준을 정하고, 확인될 때까지 반복할 것.

설치 방법은 두 가지입니다. 플러그인으로 깔면 스킬 하나가 생기고(대화 시작 +99토큰), CLAUDE.md 파일을 프로젝트에 복사하면 규칙 전문이 매번 들어갑니다(+1,007토큰).

HLJS BASH
/plugin marketplace add forrestchang/andrej-karpathy-skills
/plugin install andrej-karpathy-skills@karpathy-skills
curl -o CLAUDE.md https://raw.githubusercontent.com/forrestchang/andrej-karpathy-skills/main/CLAUDE.md

앞의 두 줄이 방법 1(플러그인)로, Claude Code 대화창 안에서 입력합니다. 첫 줄은 이 레포를 설치 목록에 등록하고 둘째 줄이 실제 설치입니다. 마지막 줄이 방법 2로, 프로젝트 폴더의 터미널에서 실행하면 CLAUDE.md 파일을 받아 옵니다. 이미 CLAUDE.md가 있는 프로젝트라면 -o CLAUDE.md 대신 >> CLAUDE.md로 뒤에 덧붙이라고 README에 적혀 있습니다.

효과를 보려고 작은 실험용 폴더를 만들었습니다. 주문 데이터를 읽어 매출을 출력하는 파이썬 파일 두 개(shop.py, report.py)와 README 하나, 일부러 남겨 둔 안 쓰는 함수 하나가 들어 있습니다. 여기에 "주문 목록을 CSV 파일로 내보내는 기능 추가해줘"라고 한 문장만 보냈습니다. 같은 폴더를 매번 새로 복사했고 조건만 바꿔 2번씩 돌렸습니다. (실행할 때 Bash 같은 명령 실행 도구는 막고 파일 읽기·쓰기만 허용했습니다.)

같은 CSV 기능 추가 지시에 기본 상태, Karpathy CLAUDE.md, Superpowers가 각각 만든 변경 내용 비교

화면을 읽어 보면 차이가 꽤 선명합니다.

  • 기본 상태는 shop.py에 함수를 넣고, 실행용 export.py를 새로 만들고, README에 사용법까지 적었습니다. 2번 모두 파일 3개, 27줄과 25줄이었습니다. 엑셀에서 한글이 깨지지 않게 utf-8-sig로 저장하는 배려도 넣었습니다.
  • Karpathy CLAUDE.md를 넣으면 shop.py에 함수 하나, 8줄만 추가하고 끝났습니다. 2번 모두 똑같이 8줄이었습니다. 시키지 않은 실행 파일이나 README 수정은 없었습니다.

다만 짧은 게 무조건 정답이라고 보긴 어렵습니다. Karpathy 쪽 함수는 열 이름을 price, qty로 고정했고 인코딩 지정도 없습니다. 인코딩을 안 정하면 실행하는 PC의 기본값을 따르기 때문에, 나중에 상품명 같은 한글 열이 생기고 Mac이나 서버에서 만든 파일을 엑셀로 열면 글자가 깨질 수 있습니다. 기본 상태의 "과잉" 중에는 쓸모 있는 배려도 섞여 있었던 셈입니다(이건 Karpathy 규칙 1번 "선택지를 드러내라"가 질문으로 바꿔줬으면 좋았을 지점 같습니다).

버그 수정도 시켜 봤습니다. "주문이 하나도 없으면 report.py가 평균 계산에서 죽어. 고쳐줘." 이번에는 차이가 없었습니다. 기본 상태도, Karpathy도 2번 모두 2줄만 고쳤고 안 쓰는 함수(old_discount)는 아무도 건드리지 않았습니다. Opus 5.5는 작은 버그에서는 원래 수술하듯 고친다는 뜻으로 읽힙니다. Karpathy 규칙이 차이를 만드는 곳은 "기능 추가"처럼 모델이 범위를 스스로 정해야 하는 지시인 것 같습니다.

I Have ADHD, 답의 순서를 바꾸는 스킬

I Have ADHD는 ayghri가 만든 스킬로 GitHub 별 55,683개입니다(MIT). 이름 때문에 오해하기 쉬운데, README 첫 줄에 "ADHD 진단이 없어도 된다"고 적혀 있습니다. 하는 일은 AI 답변의 순서와 모양을 바꾸는 것입니다. 규칙 10개 중 앞의 몇 개를 옮기면 다음과 같습니다.

  1. Lead with the next action. 2. Number multi-step tasks. 3. End with one concrete next step. 4. Suppress tangents. … 6. Specific time estimates (minutes, not "a bit"). … 9. Cap lists to 5 items. 10. No preamble. No recap. No closers.

(번역) 1. 다음에 할 일을 맨 앞에. 2. 여러 단계는 번호로. 3. 구체적인 다음 행동 하나로 끝내기. 4. 곁가지 이야기 빼기. … 6. 시간은 구체적으로("조금"이 아니라 몇 분). … 9. 목록은 5개까지. 10. 인사말, 요약, 맺음말 없이.

설치는 터미널에서 두 줄이고 쓸 때는 대화창에 /i-have-adhd를 입력합니다. 한 번 켜면 "stop adhd mode"라고 할 때까지 유지되고, 항상 켜 두고 싶으면 ~/.claude/.i-have-adhd-always 파일을 만들면 시작 훅이 매번 넣어 줍니다(이건 직접 확인한 코드 기준입니다).

HLJS BASH
claude plugin marketplace add ayghri/i-have-adhd
claude plugin install i-have-adhd@i-have-adhd

실험은 코딩 질문 하나로 했습니다. "Vercel에 배포한 Next.js 앱에서 process.env.API_KEY가 undefined로 나와. 왜 그렇고 어떻게 고쳐?" 이 질문을 그냥 보낸 것과 /i-have-adhd를 붙여 보낸 것을 2번씩 비교했습니다.

같은 질문에 대한 기본 답변과 I Have ADHD 적용 답변의 첫 줄과 마지막 줄 비교

기본 상태 (2회)I Have ADHD (2회)
답변 길이1,776자 / 1,740자1,170자 / 1,371자
첫 줄제목, "현재 작업 디렉터리에는 Next.js 코드가 없습니다""브라우저 코드에서 읽는지 확인하세요", "Settings → Environment Variables에서 확인하세요"
시간 안내없음"(약 5분)" 2회 모두
마지막 줄"알려주시면 짚어드릴게요" 류의 제안"다음 할 일:" + 확인할 것 하나

내용은 둘 다 맞습니다. 원인 후보(클라이언트에서 읽음, Vercel에 미등록, 환경 체크 누락, 재배포 안 함)도 거의 같습니다. 달라진 건 순서와 끝맺음입니다. 기본 답변은 설명을 다 듣고 나서야 뭘 할지 정해야 하고, ADHD 답변은 첫 줄을 읽자마자 대시보드를 열 수 있습니다. 길이는 21~34% 줄었습니다.

아쉬운 점도 있었습니다. 2회차 답변 끝에는 "로컬에서 Vercel 값 받기 (선택)"라는 곁가지 섹션이 붙었습니다. 규칙 4번(곁가지 빼기)과는 어긋나는 부분이라 규칙이 늘 그대로 지켜지는 건 아닌 것 같습니다.

Superpowers, 반론 영상의 주장을 직접 돌려보기

Superpowers는 Jesse Vincent(obra)가 만든 스킬 모음으로, 이 넷 중 가장 유명합니다. GitHub 별 296,666개, Anthropic 공식 플러그인 마켓플레이스에도 올라가 있습니다. 브레인스토밍 → 계획 작성 → 테스트 먼저 작성 → 서브에이전트 실행으로 이어지는 개발 절차를 스킬 15개로 강제하는 구조입니다.

반론 영상(메이커 에반, "하네스는 죽었다")이 짚은 문제는 이 강제성입니다. 실제로 using-superpowers 스킬 원문에는 이런 문장이 있습니다.

If you think there is even a 1% chance a skill might apply to what you are doing, you ABSOLUTELY MUST invoke the skill. … This is not negotiable.

(번역) 지금 하는 일에 스킬이 적용될 가능성이 1%라도 있다고 생각되면, 반드시 그 스킬을 호출해야 한다. … 이건 협상 대상이 아니다.

영상에서는 그래서 "오타 하나 고쳐 달라고 해도 브레인스토밍과 계획을 먼저 돈다"고 말합니다. 이 부분이 궁금해서 같은 폴더로 세 가지 지시를 2번씩 돌렸습니다.

먼저 측정 방법을 밝혀 둡니다. Superpowers는 대화를 시작할 때 훅 스크립트가 안내문을 넣는데, 이번 실험에서는 외부 스크립트를 제 PC에서 실행하지 않으려고 훅은 끄고, 훅이 넣는 문구를 그대로 시스템 프롬프트에 붙여 재현했습니다. 들어가는 글은 같지만 들어가는 자리가 조금 달라서 실제 설치 상태와 완전히 같다고 장담하긴 어렵습니다.

지시기본 상태 (2회)Superpowers (2회)
"README.md에 있는 오타 'teh'를 'the'로 고쳐줘."4턴, 9.7~12.8초, 2곳 수정56턴, 12.745.4초, 2곳 수정. 스킬 호출 0회
"주문이 없으면 평균 계산에서 죽어. 고쳐줘."5~6턴, 2줄 수정9턴, 2~3줄 수정. 2회 모두 systematic-debugging 호출
"주문 목록을 CSV로 내보내는 기능 추가해줘."9~10턴, 파일 3개 수정8턴, 코드 0줄. 2회 모두 brainstorming 호출 후 질문

(턴은 모델이 도구를 한 번 쓰고 결과를 받는 왕복 횟수입니다. 입력 토큰으로 보면 버그 수정이 11만~14만에서 16만으로, CSV가 11만에서 13만 5천으로 늘었습니다.)

결과를 정리하면 반론 영상의 주장은 절반만 맞았습니다. 오타 수정에서는 Opus 5.5가 2번 다 스킬을 부르지 않고 바로 고쳤습니다. 1회차가 45초로 오래 걸리긴 했지만 스킬 호출 없이 생각하는 시간이 길었던 것으로 보입니다. 반면 버그에는 디버깅 절차가, 기능 추가에는 브레인스토밍이 매번 붙었습니다.

CSV 지시에 대한 Superpowers의 답은 위 CSV 비교 이미지 아래쪽에 있습니다. 코드를 짜는 대신 설계안을 정리하고 "이 CSV는 주로 엑셀에서 열어 보시나요, 아니면 다른 프로그램에 넣으시나요?"라고 묻습니다. 질문 자체는 좋은 질문입니다. 앞에서 Karpathy 쪽 결과가 놓친 한글 인코딩 문제를 정확히 짚었습니다. 다만 헤드리스로 돌리면 여기서 멈추고 대화형으로 쓰더라도 내가 한 번 더 답해야 코드가 나옵니다. 혼자 빠르게 만들어 보는 단계라면 이 왕복이 반론 영상이 말한 "과속방지턱"으로 느껴질 것 같습니다.

Claude Octopus, 직접 돌리는 대신 손으로 해본 교차 검토

Claude Octopus(nyldn, MIT, GitHub 별 4,189개)는 같은 작업을 다른 AI에게도 맡겨서 답이 갈리는 곳을 배포 전에 표시해 주는 플러그인입니다. README에는 외부 연동 12개(Codex, Antigravity CLI, Copilot, Qwen, Ollama, Perplexity, OpenRouter, OrcaRouter, OpenCode, Cursor CLI, Grok, Kimi Code)가 적혀 있고 75% 합의 기준(consensus gate)으로 의견 충돌을 걸러낸다고 설명합니다. 릴스에서 말한 "최대 12개 모델"은 이 연동 개수를 말하는 것으로 보입니다.

이번 글에서 Octopus는 설치해서 돌리지 못했습니다. 이유가 두 가지입니다.

  1. README에 Windows 네이티브(Git Bash 포함)는 지원하지 않는다고 적혀 있습니다. Windows에서는 WSL(윈도우 안의 리눅스 환경)에서 Claude Code를 돌려야 하고 Git Bash에서는 훅이 바로 종료된다고 합니다.
  2. 훅 항목이 43개입니다. 대화 시작, 명령 실행 전후, 작업 완료 시점마다 스크립트가 붙어 있고, 그중에는 설정할 경우에만 동작하는 telemetry(사용 기록 전송) 웹훅이나 ~/.claude/settings.json의 상태줄 경로를 고치는 스크립트도 있습니다. 코드를 읽어 보니 대부분 조건이 맞을 때만 동작하게 되어 있었지만, 이 글을 쓰는 환경에서 외부 스크립트를 실행하는 건 피했습니다.

대신 Octopus가 자동으로 해주는 일을 손으로 해봤습니다. 같은 폴더의 shop.py, report.py를 Claude(claude-opus-5-5)와 Codex(gpt-6.1-sol)에게 똑같이 "실제로 문제가 될 수 있는 버그나 위험만 중요도 순으로 최대 5개, 각 한 줄로"라고 리뷰를 맡겼습니다.

지적 내용ClaudeCodex판단
주문이 0건이면 평균 계산에서 0으로 나눠 멈춤1순위1순위 (높음)둘 다 지적, 바로 고칠 것
orders.json을 실행 위치 기준으로 찾아서 다른 폴더에서 실행하면 못 찾음5순위2순위 (중간)둘 다 지적
파일 인코딩 미지정, Windows 기본값(cp949)으로 한글 JSON을 읽으면 오류2순위없음Claude만, 확인해 볼 것
평균 단가가 수량을 무시한 단순 평균3순위없음Claude만, 의도인지 확인할 것
가격이 소수면 금액 오차, int()는 반올림이 아니라 버림4순위없음Claude만

둘 다 짚은 2개는 거의 틀림없는 문제이고 한쪽만 짚은 3개는 "확인 목록"이 됩니다. 특히 cp949 인코딩 문제는 한국어 Windows 사용자에게는 실제로 자주 부딪히는 문제라 Codex가 놓친 게 의외였습니다. 이 표를 매번 사람이 만드는 대신 자동으로 만들어 주는 게 Octopus의 역할로 이해하면 될 것 같습니다. 다만 이 정도는 두 도구를 터미널 두 개에 띄워 놓고 같은 문장을 넣는 것만으로도 할 수 있었습니다.

개인적인 생각 & 한계점

반론 영상의 결론은 "모델이 일하게 해주는 도구는 남기고, 모델에게 생각하는 법을 가르치는 문서는 지워라"였습니다. 직접 재보고 나니 이 기준에 거의 동의하지만, 한 가지를 더 붙이고 싶습니다. 무엇을 하느냐보다 언제 읽히느냐가 더 중요한 것 같습니다.

  • Karpathy 스킬은 "생각하는 법을 가르치는 문서"인데도 남길 만했습니다. 1,007토큰짜리 규칙 네 개가 기능 추가에서 27줄을 8줄로 줄였습니다. 짧아서 내 프로젝트 규칙을 덮지 않는다는 점이 제일 좋았습니다.
  • I Have ADHD는 내가 부를 때만 읽힙니다. 평소 비용이 0이라 깔아 두는 부담이 없습니다.
  • Superpowers는 내가 부르지 않아도 매번 시작 안내문이 들어가고 그 안내문이 "1%라도 해당되면 반드시"라고 말합니다. 그래서 버그와 기능 요청마다 절차가 붙었습니다. 절차 자체의 품질은 좋았습니다(인코딩 질문처럼). 혼자 빠르게 만드는 상황과 안 맞을 뿐입니다.
  • Octopus는 "일하는 도구"에 가깝지만, 이 넷 중 가장 큰 꾸러미였습니다. 직접 부를 때만 동작하게 설계한 점은 좋은데, 목록 설명만으로 5천 토큰이 상주합니다.

본인 상황에 맞춰 나눠 보겠습니다.

1. 혼자 바이브코딩으로 빠르게 만드는 경우

  1. Karpathy CLAUDE.md를 프로젝트에 넣습니다. 기존 CLAUDE.md가 있으면 뒤에 붙이고 내 규칙과 겹치는 줄은 정리합니다.
  2. I Have ADHD는 깔아 두고 답이 길게 느껴질 때만 /i-have-adhd를 씁니다.
  3. Superpowers는 제 경우에는 빼는 편이 나았습니다.

2. 여러 명이 같은 방식으로 개발해야 하는 경우 Superpowers 같은 절차형 꾸러미가 오히려 맞습니다. 반론 영상도 팀 작업과 입문자 학습용으로는 쓸모가 있다고 인정합니다. "테스트 먼저", "원인부터 찾기"를 사람마다 다르게 하지 않게 만드는 게 목적이니까요.

3. 배포 전에 다른 AI의 검토를 받고 싶은 경우 Octopus를 쓰기 전에 손으로 교차 리뷰를 한두 번 해보길 권합니다. 두 모델이 갈리는 곳이 생각보다 많으면 그때 Octopus로 자동화하면 됩니다. Windows라면 WSL 환경부터 준비해야 합니다.

4. 이미 많이 깔아 둔 경우 반론 영상의 정리법이 합리적입니다. 지금 깔린 스킬·플러그인 목록부터 보고 내가 만들지 않은 큰 꾸러미부터 백업 폴더로 옮긴 뒤 일주일 써 보는 방식입니다. 스킬을 지워도 설정 파일의 훅은 남을 수 있어서 훅도 따로 확인해야 합니다.

한계도 분명히 적어 둡니다.

  • 조건마다 2번씩만 돌렸습니다. 같은 조건에서도 1회차와 2회차 시간이 45초와 13초로 갈린 것처럼 변동이 있어서, 이 숫자는 "경향"으로 보시는 게 맞습니다.
  • 실험 폴더가 파일 4개짜리 장난감 프로젝트입니다. 실제 서비스 코드에서는 Superpowers의 테스트 먼저 작성이나 Karpathy의 질문 유도가 더 큰 차이를 만들 수 있습니다.
  • Superpowers의 시작 훅은 실행하지 않고 같은 문구를 시스템 프롬프트로 재현했습니다.
  • Octopus는 설치·실행하지 않았고 구조와 README만 확인했습니다.
  • 모델은 Opus 5.5 하나만 썼습니다. 반론 영상이 말한 대로 모델이 지시를 얼마나 문자 그대로 따르느냐에 따라 결과가 달라질 수 있습니다.

(최대한 작성 시점 기준으로 확인했지만 틀린 부분도 있을 수 있습니다.)

이 글을 마치며 & Reference

결국 "4개 다 깔아라"도 "전부 지워라"도 반만 맞았습니다. 같은 플러그인이라는 이름 아래 99토큰짜리와 5,087토큰짜리가 섞여 있고, 절차를 강제하는 것과 내가 부를 때만 나오는 것이 섞여 있습니다. 깔기 전에 이 둘만 확인해 보시면 될 것 같습니다. 기회가 되면 제 실제 작업 폴더에 쌓인 스킬들도 같은 방식으로 재보고 덜어낸 기록을 다뤄보겠습니다.

CLAUDE.md를 처음 정리하는 중이라면 CLAUDE.md를 5가지 기준으로 진단하는 글을 먼저 보시는 걸 추천합니다. Karpathy 규칙을 붙이기 전에 내 규칙부터 정리하는 순서가 맞습니다. 디자인 쪽 스킬을 고르는 중이라면 Claude Code 프론트엔드 디자인 도구 5종도 같은 기준(언제 쓰는지, 다 깔 필요는 없음)으로 정리해 두었습니다.

Reference

  • multica-ai/andrej-karpathy-skills : Karpathy의 LLM 코딩 실수 관찰을 CLAUDE.md 한 장으로 정리한 레포. EXAMPLES.md에 규칙별 나쁜 예·좋은 예가 있어서 같이 보면 좋습니다
  • ayghri/i-have-adhd : README의 Before/After 예시 하나만 봐도 무엇을 바꾸는 스킬인지 바로 감이 옵니다
  • obra/superpowers : 팀 단위 개발 절차를 스킬로 만든 대표 사례. skills/using-superpowers/SKILL.md를 열어 보면 강제성의 정도를 직접 확인할 수 있습니다
  • nyldn/claude-octopus : 여러 AI 교차 검토 플러그인. 설치 전에 Windows 지원 범위(WSL 필요)부터 확인하시길 권합니다
  • Adilet(@adilet.fndr)의 4개 플러그인 릴스 : 이 글을 쓰게 만든 원본 영상. 50초 안에 네 개를 소개합니다
  • 메이커 에반, 하네스는 죽었다 : 반대 입장의 영상. 자기 PC의 스킬 폴더를 직접 열어 보여주고, 남길 것과 지울 것의 기준을 제시합니다

긴 글 읽어주셔서 감사합니다 :)

추가 학습 자료 신청

ZEXEA 메인 사이트의 자료 신청 페이지로 이동합니다. 이름·이메일·전화번호 등의 입력이 필요합니다. 블로그 글과 실습 예제는 신청 없이 모두 읽을 수 있습니다.

자료 신청 안내 보기

관련 가이드

CLAUDE.md 핵심 기능을 설명하는 샘호트만 유튜브 영상 썸네일
CLAUDE CODE2026년 8월 22일읽기 12분

CLAUDE.md, 잘 쓰고 있는지 5가지 기준으로 진단하세요 (복붙용 개선 프롬프트 포함)

CLAUDE.md가 방치되는 이유는 관리 플러그인이 없어서가 아니라 진단이 없어서입니다. 프로젝트 지도부터 실행 모델까지 5가지 판정 기준과 200줄 룰 구조 점검, 그리고 진단에서 개선 실행까지 한 번에 굴리는 3-Phase 프롬프트 전문을 정리했습니다.

전체 과정 보기
AI 티 나는 웹사이트를 고치는 디자인 도구 5종이라는 제목과 DESIGN.md, Taste Skill, Image to Code, Playwright CLI, Vercel 규칙 다섯 칩, Taste Skill 예시 사이트와 Playwright CLI로 찍은 모바일 화면을 배치한 대표 이미지
CLAUDE CODE2026년 10월 5일읽기 22분

Claude Code 프론트엔드 디자인 도구 5종, AI 티 나는 웹사이트를 고치는 스킬·CLI 사용법

Claude Code로 만든 웹사이트의 AI 티를 줄이는 디자인 도구 5종. Awesome DESIGN.md, Taste Skill, Image to Code, Playwright CLI, Vercel 규칙 스킬의 정체와 설치법, 쓰는 시점, 직접 돌려본 결과를 정리했습니다.

전체 과정 보기
남색 배경에 AI 학습 코치라는 제목과 물음표 아이콘, 코치의 실제 첫 응답 '무엇을, 언제까지, 왜 배우려는지 한 줄로 알려 주세요'를 담은 대표 이미지
CLAUDE CODE2026년 10월 6일읽기 16분

AI 공부법, 답 대신 질문하는 'AI 학습 코치' 스킬을 만들어 테스트해 본 기록

AI 공부법은 설명을 듣는 데서 끝나면 기억에 오래 남지 않습니다. 질문하고 문제를 내고 내 말로 설명하게 만드는 AI 학습 코치 스킬을 직접 만들어 5턴 테스트한 결과와 스탠포드 사례, 자격증 공부 세팅법, 무료 스킬 파일을 함께 공유합니다.

전체 과정 보기