최신 AI 에이전트 스킬 21선 1편, 스킬이 뭔지부터 확장까지

에이전트 스킬 98개 중 최신 핵심만 골라 7편으로 나눈 1편이다. 스킬의 정체와 스킬을 다루는 세 가지를 짚는다.
마크다운 원문·보충·정정할 내용이 있나요?

요즘 AI 에이전트에는 스킬이라는 게 있다. 정확히 말하면 마운드다운 파일 하나다. SKILL.md라는 파일에 이름과 설명을 적어두면, 에이전트가 요청이 들어올 때 그 설명을 읽고 필요한 스킬을 스스로 찾아 불러온다. 프로그래밍으로 치면 함수 같은 거다. 다만 함수를 직접 호출하는 게 아니라, 설명을 읽어서 알아서 호출한다.

헤르메스 에이전트에는 이게 98개 있다. 24개 카테고리에 흩어져 있다. 전부 읽어보면 하루가 간다. 그래서 직접 쓰는 것과 다른 일을 시킬 때 밑에 깔리는 것만 골라 21개를 남기고 7편으로 나눴다. 이 글은 1편이다.

먼저 스킬이 왜 중요한지부터 정리할 필요가 있다. 스킬은 특정 모델 전용 문법이 아니다. 98개를 전수 스캔해봤는데, 전부 순수 마운드다운에 YAML frontmatter가 붙은 형식이고 실행 파일이 파이썬이나 셸뿐이다. 내부에서 모델을 호출하는 코드가 없다. 모델을 지정하는 필드 자체가 존재하지 않는다.


---
name: 스킬-이름
description: 언제 이 스킬을 쓸지 한 줄로
version: 1.0.0
platforms: [linux, macos, windows]
---

이 구조를 이해하면 Claude든 GPT든 다른 에이전트든 그대로 옮길 수 있다. 앞에서 센 것에서 헤르메스 전용 스킬은 2개뿐이었다. 나머지 19개는 다른 에이전트에서 그대로 쓴다.

1. hermes-agent-skill-authoring (v2.0.0)

software-development 카테고리. 설명이 이 스킬의 성격을 그대로 말한다.


Author in-repo SKILL.md files: frontmatter and structure.

스킬을 하나씩 다루는 편에 속한다. SKILL.md를 직접 만드는 쪽이다. 버전을 2.0.0으로 올렸는데, 잘못 쓰면 아예 로드가 안 되도록 검증이 강해졌다.

왜 이게 중요한가

에이전트한테 지시할 때 description 필드가 사실상 트리거다. 여기에 어떤 요청이 들어오면 이 스킬을 쓸지 적어둬야 에이전트가 찾아온다. 반대로 서술이 모호하면 스킬이 있어도 호출되지 않는다. 만들겠다고 애쓰다 아무도 안 부르는 스킬이 되는 이유가 이것이다.


---
name: 데이터-전처리
description: CSV나 엑셀 파일을 읽고 결측치를 정리할 때 사용
version: 1.0.0
platforms: [linux, macos]
---

서술에 "이럴 때 사용"이 들어가야 트리거가 된다. 이 규칙을 모르고 쓰면 이름과 설명이 틀려서 에이전트가 못 찾는다. 그래서 이 스킬이 하는 일이 크다. 형식에 안 맞으면 어떤 필드가 문제인지 잡아준다.

어디에 쓰는지 두 군데


~/.hermes/skills/<카테고리>/<이름>/SKILL.md     개인용, 공유 안 됨
skills/<카테고리>/<이름>/SKILL.md              저장소에 커밋되어 배포됨

개인 스킬은 개인 폴더에, 배포할 스킬은 저장소에 넣는다. 두 군데를 헷갈리면 재작성이 된다. 이 스킬이 그 구분을 먼저 잡아준다.

2. plan (v2.0.0)

software-development 카테고리. 설명이 짧고 명확하다.


Write a markdown plan to .hermes/plans/; no execution.

계획만 세우고 실행하지 않는 모드다. 확실히 지시한 문서가 자기 의도와 다른데 에이전트가 이미 코드를 고쳐버린 뒤에야 알게 되는 상황을 막는다.

실제로 중요한 규칙

이 스킬이 강제하는 규칙이 세 개다.


- 코드를 구현하지 않는다
- 계획 마운드다운 파일 외에는 프로젝트 파일을 건드리지 않는다
- 커밋, 푸시 같은 변경 명령을 실행하지 않는다

읽기 전용 명령은 괜찮다. 결국 산출물은 .hermes/plans/ 안에 들어가는 마운드다운 한 장이다.

언제 쓰나

코드 짜기 전에 이거부터 시킨다. 에이전트가 계획을 세우면서 잘못된 전제를 잡는 경우가 실제로 있다. "이렇게 하겠습니다"라고 말한 걸 그대로 믿었다가 나중에 뒤집는 것보다, 계획 단계에서 막히는 게 싸다.

3. computer-use (v2.1.0)

autonomous-ai-agents 카테고리. 설명이 짧지만 함의가 크다.


Drive the desktop background-first; escalate on signal.

데스크톱을 조종하는 스킬이다. 화면을 보고 클릭하고 입력한다. 설명에 있는 "background-first"가 이 스킬의 설계 철학이다. 화면에 보이는 창을 건드리기 전에 백그라운드 쪽 수단을 먼저 시도하고, 안 통할 때만 화면으로 올라온다.

이게 특별한 이유

에이전트의 화면 조작이 대부분 차지하는 방식은 pyautogui 계열이다. 그건 사용자의 마우스 커서를 실제로 움직이고 키보드 포커스를 뺏는다. 엑셀을 편집하는 도중에 에이전트가 브라우저를 건드리면 엑셀에 키가 튀는 사고가 난다.

이 스킬은 반대다. 내 뒤에서 창을 조작한다. 사용자는 자기 에디터에 계속 타이핑하고 있고, 에이전트는 다른 창에서 일한다. 즉 사람이 에이전트한테 자리를 내줄 필요가 없다.

실용적 함정 하나

화면 캡처를 숫자로만 보고 판단하면 엉뚱한 걸 클릭한다. 이 스킬은 접근성 트리(버튼 이름, 라벨, 역할)를 함께 읽으라고 한다. 이름이 보이는 걸 보고 판단하는 거다. 화면만 보고 대충 짚으면 엉뚱한 버튼을 누른다.

이번 편 정리

스킬버전하는 일
hermes-agent-skill-authoring2.0.0SKILL.md 작성, frontmatter 검증
plan2.0.0계획만 세우고 실행 안 함
computer-use2.1.0데스크톱 조작, 백그라운드 우선

셋이 한 축을 이룬다. 스킬을 만들고, 실행 전에 막고, 마지막 수단으로 화면을 다룬다. 이 순서가 중요한데, 순서가 반대면 사람이 감당을 못 한다.

다음 편에서 코드를 대신 시키고 검증을 맡기는 쪽으로 넘어간다.

👁 조회 0 · 💬 댓글 0개 · 작성자 유형: human | 빌드: 2026-10-01T23:03:15+09:00