Agent Skills és SKILL.md: progresszív feltárás, mérve
Öt skill 128 374 tokennyi utasítást rejt, mégis 253 token contextet foglal. Ha rövidebb a leírás, az agent nem találja őket.
Ezen az oldalon
Vegyünk egy projektet, amelyben öt publikált skill van telepítve. Ennyibe kerülnek.
ls .claude/skills/next-best-practices next-cache-components vercel-composition-patterns
vercel-react-best-practices vercel-react-native-skillsskill level 1 level 2 level 3 files
next-best-practices 40 966 19,374 19
next-cache-components 28 2,334 0 0
vercel-composition-patterns 59 533 10,667 13
vercel-react-best-practices 68 1,670 53,670 75
vercel-react-native-skills 58 950 37,957 41
------ ------- --------
total 253 6,453 121,668Százhuszonnyolcezer tokennyi utasítás, példa és szabály — több, mint amennyi belefér egy 128 000 tokenes context windowba —, és mind az öt elérhetőségének állandó költsége 253 token, az egy százalék két tizede. Ebben a kurzusban semmi másnak nincs ilyen alakja. Egy tool-definícióért minden kérésnél fizetsz, akár használod, akár nem, a 26. fejezet pedig egy MCP server költségét 1 619 tokenben mérte még azelőtt, hogy bármit csinálna: harminckétszerese a fenti táblázat átlagos 1. szintű sorának.
Ez a fejezet arról a mechanizmusról szól, amely ezt az arányt létrehozza, arról a két módról, ahogyan elromlik, és arról a kérdésről, amelyet a mechanizmus kikényszerít, mégis szinte senki nem válaszol meg: ha adott egy tudásdarab, a négy hely közül hová tartozik.
Miért nincs ennek a fejezetnek programozási nyelve
Link a szakaszhoz: Miért nincs ennek a fejezetnek programozási nyelveA 14. fejezet felállította a kurzus második felének szabályát — a kapcsolatok, újrapróbálkozások és megszakítás TypeScriptben készülnek —, és megnevezett öt kivételt. Ez az egyik, és az ok nem ízlés kérdése.
A skill egy Markdown fájl. Nem olyan fájl, amely egy programot konfigurál, nem olyan fájl, amelyet egy program lefordít: hanem egy dokumentum, amelyet a modell olvas, ugyanúgy, ahogyan az általad beírt üzenetet olvassa. Ha programozási nyelvet adnánk ehhez a fejezethez, az azt jelentené, hogy nem értettük meg a formátumot, és pontosan ez a félreértés a leggyakoribb a skillekkel kapcsolatban. Lent minden Markdown és YAML, plusz egy kicsi shell script, amely éppen azért létezik, hogy megmutassa, hol van és hol nincs helye kódnak egy skillen belül.
A számla, amelyet megold, és ez a 16. fejezet számtana
Link a szakaszhoz: A számla, amelyet megold, és ez a 16. fejezet számtanaÍme egy valódi utasítás: hogyan írja egy cég a release note-jait. Ez eljárás, nem preferencia — rendezett lépéssora, taxonómiája, hangja, template-je és egy scriptje van, amely összegyűjti a nyersanyagot.
Tedd mindezt a system promptba, ahogy a legtöbb csapat teszi, és átveszi az irányítást a 16. fejezet számtana. A system prompt prefix, a prefixért pedig minden hívásnál fizetsz. A fejezethez írt mappán o200k_base segítségével mérve:
whole thing pasted into the system prompt 1,716 x 40 = 68,640 input tokens $0.1373
as a skill, activated once on turn 12 46 x 40
+ 324 (SKILL.md body)
+ 665 (two reference files read)
= 2,829 input tokens $0.0057
as a skill, never activated at all 46 x 40 = 1,840 input tokens $0.0037Huszonnégyszer olcsóbb, amikor használják, harminchétszer olcsóbb, amikor nem. Az árak a 16. fejezet árai: $2.00 egymillió input tokenenként.
Most jön az őszinte ellenvetés, mert egy fejezet, amely ezt kihagyná, reklám lenne. A prompt caching nagyrészt bezárja a pénzbeli rést. A system prompt stabil és elöl ül, ami a lehető legjobb cache-jelöltté teszi; cached inputnál egymilliónként $0.20 mellett ugyanaz a 68 640 token $0.1373 helyett $0.0168-ba kerül. Még mindig háromszorosa a skillnek, de már nem más nagyságrend.
Soha nem a pénz volt a legerősebb érv. Hanem ez:
A caching olcsóbbá teszi az állandó prefixet. Kisebbé nem.
A 40. körben a system-promptos verzióban még mindig 1 716 tokennyi release-note szabályzat ül a windowban egy teljesen másról szóló beszélgetés közben, versengve azért, amit a 24. fejezet a modell attention-költségvetésének nevezett. A skilles verzióban 46. Ha rossz dolgot cache-elsz, kedvezményt vettél egy figyelemelterelésre.
Képletként írva, ahol a körök száma, a metadata, a törzs, a teljes csomag, pedig a ténylegesen olvasott csomagolt fájlok halmaza:
Az egész fejezet annak a különbségéről szól, hogy a második tagot -nel szorozzuk-e, vagy eggyel, illetve nullával.
Mi valójában egy skill
Link a szakaszhoz: Mi valójában egy skillA skill egy könyvtár. A specifikáció elég rövid ahhoz, hogy teljes egészében kimondjuk:
release-notes/
├── SKILL.md # required: YAML frontmatter + Markdown instructions
├── scripts/ # optional: executable code
├── references/ # optional: documentation read on demand
├── assets/ # optional: templates, schemas, examples
└── ... # anything else you likeA SKILL.md YAML frontmatterrel kell kezdődjön, és pontosan két mező kötelező: name és description.1 További négy opcionális, és más mező nincs definiálva:
| Mező | Kötelező | Megkötés |
|---|---|---|
name | igen | 1–64 karakter, kisbetűk, számjegyek és kötőjelek; nincs kezdő, záró vagy dupla kötőjel; meg kell egyeznie a könyvtár nevével |
description | igen | 1–1024 karakter, nem üres; megmondja, mit csinál a skill és mikor kell használni |
license | nem | egy licenc neve, vagy egy csomagolt licencfájl neve |
compatibility | nem | legfeljebb 500 karakter: célzott termék, szükséges csomagok, hálózati hozzáférés |
metadata | nem | string kulcsok és string értékek szabad mapje a saját toolingodhoz |
allowed-tools | nem | előzetesen jóváhagyott toolok szóközzel elválasztott listája; kísérletiként jelölve |
Íme a release-notes skill, teljes egészében, harminc sornál rövidebb törzzsel:
---
name: release-notes
description: Write the release notes for a tagged version in this company's house style. Use when preparing a release, drafting a changelog entry, or when someone asks for the notes for a version number or a tag.
allowed-tools: Bash(git log:*) Bash(git tag:*) Read
---
# Release notes
## Procedure
1. Run `scripts/collect.sh <previous-tag> <new-tag>`. It prints one line per merged
pull request: number, title, author and the labels.
2. Drop every line whose labels contain `internal`, `ci` or `chore`.
3. Put each surviving line into exactly one of the four categories in
[references/categories.md](references/categories.md). A change that seems to fit two
belongs in the higher one; the order in that file is the order of precedence.
4. Rewrite each line as a sentence in the voice defined in
[references/voice.md](references/voice.md). The pull request title is a note to
the team; the release note is a note to a stranger.
5. Check the result against [references/examples.md](references/examples.md).
## The one rule that is not negotiable
Every note says what a person can now do, or what stopped happening to them. If a
sentence can only be understood by someone who has read the diff, it is not finished.Olvasd el, mi ez a törzs. Nem maga a szabályzat — hanem tartalomjegyzék műveleti sorrenddel. A szabályzat három olyan fájlban él, amelyet megnevez, de nem tartalmaz. Az első lépés pedig scriptnek adja át a munkát, mert egy script kódja soha nem kerül be a context windowba: csak a kimenete.2
Három szint, és mennyibe kerül mindegyik
Link a szakaszhoz: Három szint, és mennyibe kerül mindegyikA betöltési modellnek neve és három szakasza van. A specifikáció token-költségvetéssel együtt írja le őket:1
- Metadata, nagyjából 100 token:
nameésdescription, induláskor betöltve minden telepített skillhez. - Utasítások, ajánlottan 5 000 token alatt: a
SKILL.mdtörzse, betöltve, amikor a skill aktiválódik. - Erőforrások, szükség szerint: csomagolt fájlok, csak akkor betöltve, amikor valami igényli őket.
A referenciadokumentáció ugyanerre a táblára egy negyedik oszlopot is tesz — mikor töltődik be, tokenköltség, tartalom —, és a fontos sor a harmadik: semmi, amíg nincs elérve.3 A mondat, amely az egész fejezetet összefoglalja, szintén ott van:
A fájlok addig nem fogyasztanak contextet, amíg hozzájuk nem férnek, így a skillek átfogó API-dokumentációt, nagy adathalmazokat vagy kiterjedt példákat is tartalmazhatnak. Nincs context-büntetés olyan csomagolt tartalomért, amelyet nem használnak.3
A fejezet elején lévő mért táblázat ennek az állításnak az ellenőrzése öt olyan skillen, amelyet senki nem ehhez a cikkhez írt. Két sort érdemes egymás ellenében olvasni.
A next-best-practices törzse 966 token, és tizenkilenc, összesen 19 374 tokent tartalmazó fájlra linkel. Kérd meg, hogy javítson egy hydration errort, és az agent a törzset plusz a hydration-error.md fájlt olvassa el: 1 409 token a 20 340-ből, tizennégyszeres szorzó, a másik tizennyolc fájlt pedig soha nem nyitja meg.
A next-cache-components törzse 2 334 token, és egyáltalán nincsenek csomagolt fájljai. Érvényes skill, ráadásul jól megírt, de nincs 3. szintje, amit feltárhatna. Ez a technika őszinte korlátja: a progresszív feltárás csak akkor megtakarítás, ha van mit elhalasztani. Egy skill, amelynek tudása nem bontható fel, aktiváláskor a teljes törzsét kifizeti, és az egyetlen megmaradó kar az, hogy ne aktiválódjon.
Törd el: a leírás a teljes interface
Link a szakaszhoz: Törd el: a leírás a teljes interfaceAz 1. szint egy útválasztási döntés egyetlen mondatból. Semmi más nem befolyásolja egy skillről, hogy valaha megnyitják-e — sem a törzs minősége, sem a példák, sem a scriptek. Ezért a leírás nem dokumentáció. Ez a query surface, és lehet hibás.
A specifikáció ezt egy jó és egy rossz példa formájában mondja ki, a rossz pedig négy szó: description: Helps with PDFs.1 Ezt érdemes mérni, nem csak elfogadni.
Hat skill, mindegyikhez egy hihető leírás, amely megmondja, mit csinál és mikor kell használni. Huszonnégy kérés, skillenként négy, úgy megfogalmazva, ahogy egy ember fogalmazná, és soha nem nevezve meg a skillt. A modell látja a hat sort a system promptjában, és egy névvel vagy NONE-vel kell válaszolnia. Greedy decoding, hogy reprodukálható legyen. Aztán ugyanaz a huszonnégy kérés ugyanazzal a hat skillel, de a leírások a puszta tárgyukra visszavágva.
rich - sql-review: Review a SQL migration for locks, missing indexes and unsafe
defaults before it runs on the production database. Use when someone adds
or changes a migration, an index, or a table column.
thin - sql-review: Helps with SQL.rich 295 tokens of level 1 for six skills 18/24 correct = 75.0 % [55.1, 88.0]
thin 81 tokens of level 1 for six skills 10/24 correct = 41.7 % [24.5, 61.2]
paired: rich only 9, thin only 1, two-sided sign test p = 0.0215
answered NONE: rich 1 of 24, thin 9 of 24Először az intervallumokat olvasd, ahogy a 4. fejezet ragaszkodott hozzá, és ahogy a 29. fejezet is ragaszkodni fog: átfednek, és huszonnégy eset önmagában, összesített értékek alapján nem tud két rendszert rangsorolni. A párosított összehasonlítás dönti el, és ez a 15. fejezet eszköze: abból a tíz esetből, ahol a két ág eltért, kilenc a gazdag leírásokhoz ment, egy a vékonyakhoz. Ez a szokásos küszöbön megáll.
Most olvasd az utolsó sort, ami a tényleges eredmény. Vékony leírásokkal a modell a huszonnégy kérésből kilencnél NONE-szel válaszolt. Nem rossz skill: nincs skill. Íme négy közülük szó szerint:
"Check this migration before I run it against production." -> release-notes
"Will this CREATE INDEX lock writes?" -> NONE
"Is this ALTER TABLE safe to deploy at peak traffic?" -> NONE
"Is 'seamless and powerful' allowed in the app store listing?" -> next-best-practicesTelepítve volt egy tökéletes sql-review skill, törzzsel, példákkal és checklisttel, és soha nem nyílt meg, egymás után háromszor, annál a három kérdésnél, amelyre írták. A 2. és 3. szint irreleváns egy olyan skill számára, amelyet az 1. szint soha nem ér el.
A javítás költsége: 214 token, a 295 és 81 különbsége, hat skillre szétterítve. Ez a 18. fejezet megállapítása a másik oldalról érkezve. Ott pusztán egy tool leírásának megváltoztatása a dátumformázást 24-ből 2 helyesről 24-ből 24-re vitte. Itt pusztán egy skill leírásának megváltoztatása az aktiválást 24-ből 10-ről 18-ra viszi. Mindkét esetben a rendszer legolcsóbb javítása egy mondat, és mindkét esetben a mondatnak a triggert kell megneveznie, nem pusztán a tárgyat: nem azt, hogy mi a dolog, hanem azt, hogy mit mondott éppen a user, amikor alkalmazni kell.
Egy kitétel, amellyel ez a fejezet tartozik a saját mércéinek. Ez egy félmilliárd paraméteres modell, egy frontier modell pedig sokkal jobban route-ol, mint 75 %. A mechanizmust olvasd, ne a nagyságrendet: az útválasztási jel egy mondat hosszú, bármilyen modell olvassa is, és egyetlen modell sem tud olyan információ alapján választani, amelyet nem tettél bele abba a mondatba.
Törd el újra: a vészkijárat, amely 26 362 tokenbe kerül
Link a szakaszhoz: Törd el újra: a vészkijárat, amely 26 362 tokenbe kerülA második hiba az első ellentéte. A skill megtalálódik, a szintek helyesen vannak szétválasztva, az agent mégis elolvassa az egészet.
A vercel-react-best-practices valóban jól felépített skill. 1 670 tokenes törzse nyolc kategória prioritási táblája és egy gyors referencia, amely 70 szabályfájlt nevez meg, mindegyiket egy sorban. A szabályok mellette vannak a lemezen: 70 fájl, a legkisebb 132 token, a medián 319, a legnagyobb 1 052. Tegyél fel egy kérdést a barrel importokról, és az őszinte költség a törzs plusz egy fájl — 2 400 token alatt egy 53 670 tokenes csomaggal szemben.
Aztán a törzs utolsó sora ezt mondja:
## Full Compiled Document
For the complete guide with all rules expanded: `AGENTS.md`A AGENTS.md 26 362 token. Ez a 70 szabályfájl összefűzve: az összegük 25 784, a különbséget a köztük lévő címsorok adják. Vagyis a skill választást kínál az agentnek aközött, hogy elolvas egy medián szabályt 319 tokenért, vagy ugyanazt a tartalmat, az egészet, nyolcvanháromszoros áron — és ezt a választást olyan mondatban kínálja, amelyhez nincs költség társítva, és nincs feltétele annak, mikor érdemes élni vele.
Ez nem bug, és a fájl nem hibás; egy összeállított dokumentum valóban hasznos egy embernek, és olyan agentnek is, amelyet egy teljes codebase auditálására kértek. Ez egy 3. szintű fájl 2. szintű meghívóval, és a tanulság túlmutat ezen az egy skillen: minden SKILL.md-ből kifelé vezető útvonalnak meg kell mondania, mibe kerül és mikor éri meg, mert a modellnek nincs módja tudni, hogy egy fájlnév nyolcvanháromszor drágább, mint a fölötte lévő fájlnév.
Ugyanez a mappa egy kisebb tanulságot is hordoz az elavulásról. A törzs azt mondja: „70 szabály 8 kategóriában”, és 70-et listáz; a rules/ könyvtárban 72 fájl van, amelyek közül kettő scaffolding (_template.md és _sections.md); a sidecar metadata.json pedig azt mondja: „40+ szabály”. Ugyanannak a halmaznak három darabszáma egy mappában: az egyik helyes, az egyik számtani, az egyik egy korábbi verzióból maradt ott. A skill dokumentum, a dokumentumok pedig pontosan úgy rohadnak, mint egy kódkomment, amely elcsúszott a mellette lévő kódtól — azzal a különbséggel, hogy ezt egy olyan gép olvassa, amely nem vonja fel a szemöldökét.
A mezők, amelyeket a referencia-implementáció hozzáad, és a hordozhatósági csapda
Link a szakaszhoz: A mezők, amelyeket a referencia-implementáció hozzáad, és a hordozhatósági csapdaA nyílt specifikáció hat frontmatter mezőt definiál. A referencia-implementáció, a Claude Code, húszat fogad el.2 Öt csoportot érdemes név szerint ismerni, mert ezeknél szűnik meg a formátum pusztán dokumentumnak lenni:
Engedély és meghívás. A allowed-tools előzetesen jóváhagyja a toolokat arra a körre, amely meghívta a skillt, és a grant a következő üzenetnél törlődik; a disallowed-tools eltávolítja őket. A disable-model-invocation megakadályozza, hogy a modell magától betöltse, amivel a skill olyan paranccsá válik, amelyet ember futtat. A user-invocable: false az ellenkezőjét teszi: emberek elől rejtett, csak a modell számára elérhető, háttértudáshoz.
Izoláció és költség. A context: fork külön sub-agent contextben futtatja a skillt, saját windowval — a 25. fejezet sub-agent határa egyetlen YAML-sorként —, ahol a agent választja ki a típust, a background pedig eldönti, hogy a kör vár-e. A model és a effort megváltoztatja, melyik modell fut, amíg a skill aktív, csak arra a körre.
Az argumentumok (arguments, argument-hint) lehetővé teszik, hogy egy ember értékeket adjon át, amelyek behelyettesülnek a törzsbe; ettől használható a skill slash commandként. A scoping (paths) a globnak megfelelő fájlokra korlátozza az aktiválást. A dinamikus context injection pedig az, amely megváltoztatja a mentális modellt: egy !`git diff HEAD` alakú sor azelőtt fut le, hogy a törzset elküldenék, és a kimenete behelyettesül a szövegbe. A dokumentum template, és egy része olvasáskor számítódik ki.
Most a csapda, és ugyanaz a dokumentáció mondja ki: Claude Code-on kívül — a webes termékben, a Skills API-n keresztül, csomagoláskor — csak a hat specifikált mező megengedett, minden más mező hard error feltöltéskor.2 Vagyis egy skill, amely tökéletesen működik az egyik termékben, nem telepíthető ugyanannak a vendornek egy másik termékébe, és már a frontmatternél elbukik, nem olyasminél, amit a próza elolvasásával tesztelni tudnál. Ha hordozható skillt akarsz, a hat mező a teljes költségvetés. Ha nem, mondd ki a compatibility mezőben, amely pontosan ezért létezik.
A táblázat, amelyért ez a fejezet létezik
Link a szakaszhoz: A táblázat, amelyért ez a fejezet létezikNégy dolgot állandóan összekevernek egymással, és a zavar nem szókincsbeli szőrszálhasogatás: ha rosszul választasz, minden körben pénzbe kerül, vagy elveszít egy garanciát, amelyről azt hitted, megvan.
| System prompt | Skill | Tool | MCP server | |
|---|---|---|---|---|
| Mi ez | szöveg minden kérésben | egy mappa, amelynek gyökere egy SKILL.md | egy JSON Schema plusz egy endpoint a kódodban | egy protokollt beszélő processz vagy szolgáltatás |
| Mit csinál a modell | elolvassa, mindig | elolvassa, amikor úgy dönt, hogy a leírás illeszkedik | meghívja, és vár az eredményedre | meghívja, a hoston keresztül, szerverenként egy klienssel |
| Mibe kerül | a teljes hossza, minden körben, örökké | körönként kb. 50 token; a törzs egyszer, ha használják | a sémája minden körben; végrehajtás, amikor meghívják | minden séma plusz a server instructions-je, minden körben |
| Mit tud garantálni | semmit — tanács | semmit — tanács, amelyet a modell kihagyhat | mindent, amit a kódod érvényesít, mielőtt cselekszik | mindent, amit a server érvényesít |
| Ki írja | te | te, egy kolléga vagy egy vendor | te | valaki más, sok host számára |
| Fejezet | 15 | ez | 18 | 26 és 27 |
A két félkövér sor a teljes különbség. A skillt olvassák; a toolt meghívják. A skill próza, amely megérkezik a context windowba, és minden mással verseng az attentionért; a modell követheti, félreolvashatja vagy figyelmen kívül hagyhatja, és a rendszerben semmi nem veszi észre. A tool olyan hívás, amely teljesen kikerül a modell kezéből: a kódod argumentumokat kap, validálja őket, ellenőrzi az engedélyeket és dönt. A 18. fejezet úgy fogalmazta meg, hogy a modell javasol, a kódod rendelkezik, és pontosan ez a felosztás az, amivel egy skill nem rendelkezik.
Tehát hat valódi eset, feloldva:
„Válaszolj a user nyelvén. Soha ne mondj olyan árat, amelyet nem kaptál meg.”
Link a szakaszhoz: „Válaszolj a user nyelvén. Soha ne mondj olyan árat, amelyet nem kaptál meg.”System prompt. Minden körben alkalmazandó, inkább korlát, mint eljárás, és két mondat hosszú. Amire mindig szükség van, abban nincs mit progresszíven feltárni, és azért fizetni minden körben egy felfedezési sorért, hogy ne kelljen minden körben két mondatért fizetni, nem megtakarítás.
„Így írunk itt release note-okat.”
Link a szakaszhoz: „Így írunk itt release note-okat.”Skill. Eljárásjellegű, talán negyven körből egyben kell, felbontható hangra, taxonómiára és példákra, és próza, amelyet ember fog szerkeszteni. Ez az a forma, amelyre a formátumot tervezték, és a fenti mérés azt mutatja, mit takarít meg.
„Keress meg egy rendelést az azonosítója alapján a raktári adatbázisban.”
Link a szakaszhoz: „Keress meg egy rendelést az azonosítója alapján a raktári adatbázisban.”Tool. Determinisztikus függvény van mögötte, és a modellnek nem szabad improvizálnia a queryt. Skillként megírni — dokumentumként, amely elmagyarázza, hogyan kell lekérdezni a raktárt — annyit tesz, hogy a modell kezébe adod a sémát és reménykedsz. Egy séma plusz egy endpoint választ ad neki.
„Olvass és írj issue-kat a trackerünkben, minden agent-termékből, amelyet a cég használ.”
Link a szakaszhoz: „Olvass és írj issue-kat a trackerünkben, minden agent-termékből, amelyet a cég használ.”MCP server. A képesség nem a tiéd, több hostnak kell, és van authentication története. Ez az a probléma, amellyel a 26. fejezet nyitott; a protokoll a válasz rá, a 27. fejezet pedig kétszer is szállít egyet. Egy skillt nem tud felfedezni egy host, amely soha nem látta a filesystemedet — pontosan ezt a rést zárja a fejezet végén tárgyalt szabványosítás.
„A négyszáz oldalas brand manual.”
Link a szakaszhoz: „A négyszáz oldalas brand manual.”A négy közül egyik sem. Ez keresendő tudás, nem követendő eljárás, és olyan indexbe tartozik, amelyben az agent keres: 19. fejezet. 3. szintként becsomagolni megengedett, csábító és rossz, mert a modellnek pusztán a fájlnevek alapján kellene kitalálnia, melyik negyven fájl tartalmazza a választ. Ami jó skill: a kétoldalas eljárás, amely megmondja az agentnek, mikor keressen abban az indexben, mit jelent az alacsony similarity score, és hogyan hivatkozzon arra, amit talál.
„Soha ne téríts vissza kétszáz eurónál többet ember nélkül.”
Link a szakaszhoz: „Soha ne téríts vissza kétszáz eurónál többet ember nélkül.”Tool approval gate-tel, és soha nem skill. Ez a fontos eset. SKILL.md-ba írva a limit egy mondat, amelyet a modell elolvas és általában tiszteletben tart; a refund toolba írva egy elágazás, amely lefut, mielőtt bármilyen pénz megmozdulna. Egy limit, amelynek átlépése kínos lenne, nem dokumentáció. A szabály, amelyet érdemes megjegyezni: ha az utasítás figyelmen kívül hagyásának következménye rosszabb, mint egy rosszul formázott válasz, az utasítás nem dokumentumba tartozik.
Házi zsargonból szabvány, számokkal
Link a szakaszhoz: Házi zsargonból szabvány, számokkalA történet rövid, szokatlanul jól dátumozott, és ez az a rész, amelyet szinte senki nem mesél el.
Az Agent Skills 2025. október 16-án jelent meg egy vendor funkciójaként, abban a bejelentésben úgy definiálva, mint „utasítások, scriptek és erőforrások rendezett mappái, amelyeket az agentek dinamikusan felfedezhetnek és betölthetnek, hogy jobban teljesítsenek konkrét feladatokban”, a három szintet pedig egy megőrzésre érdemes analógiával írta le: „mint egy jól szervezett kézikönyv, amely tartalomjegyzékkel kezdődik, aztán konkrét fejezetekkel folytatódik, végül részletes függelékkel zárul”.4
2025. december 18-án ugyanaz az oldal frissült, és a formátumot nyílt szabványként jelentette be, saját specifikációval a agentskills.io címen, hozzájárulások előtt nyitott governance-szel és referencia-validatorral.3 2026. szeptember 7-én olvasva a szabvány client showcase-e negyvenhat terméket listáz — editorokat, terminálokat, cloud platformokat és mobile runtime-okat, köztük az Anthropic, az OpenAI, a Google és a Mistral first-party coding agentjeit —, mindegyik saját setup dokumentációra linkelve.1
Az MCP-vel való konvergencia nyíltan zajlik, ellenőrizhető számokkal:
| Mi ez | Megnyitva | Állapot 2026. szept. 7-én | |
|---|---|---|---|
| SEP-2076 | Agent Skills mint first-class MCP primitive: új skills/list és skills/get metódusok, egy skills capability, egy list_changed notification | 2026. január 13. | lezárva, 2026. február 24. |
| Skills Over MCP munkacsoport | meghatározza, hogyan „fedezhetők fel, terjeszthetők és fogyaszthatók” a skillek MCP-n keresztül; hetente ülésezik; tizenhét listázott tag, közülük kettő lead | interest group: 2026. február 1.; munkacsoport: 2026. április 16. | aktív |
| SEP-2640 | Skills Extension, Extensions Track: skill:// resource convention, extension identifier io.modelcontextprotocol/skills, discovery skills/list-en keresztül, content resources/read-n keresztül | 2026. április 23. | review alatt |
Az érdekes rész a lezárás, nem a javaslatok. A SEP-2076 egy negyedik primitive-et kért a tools, resources és prompts mellé. A belőle kialakult munkacsoport úgy döntött, a válasz nem: a skillek a már létező resources primitive-en utaznak, opt-in extensionként.5 A 26. fejezet ugyanezt az ösztönt mérte a protokoll saját changelogjában, ahol a samplinget, rootsot és loggingot deprecálták, nem megtartották. Egy szabványügyi testület, amely eltávolít egy saját maga által írt javaslatot, jól viselkedik; azért érdemes ezt a történetet a számokkal együtt elmondani, mert a máshol olvasott összefoglalók még mindig MCP primitive-ként írják le a skilleket.
Merre tovább
Link a szakaszhoz: Merre továbbMost már tudsz SKILL.md-t írni, három olyan szintre bontani, amelyek megtérítik az árukat, elolvasni valaki más skilljének frontmatterét és tudni, mely mezők nem élik túl, ha máshová töltik fel, valamint válaszolni arra a kérdésre, amely köré az egész fejezet épült — system prompt, skill, tool vagy server — okkal, nem megszokásból.
Azt viszont nem tudod megmondani, hogy a tiéd működik-e.
Ebben a fejezetben minden fontos állítás mérés volt, és a legfontosabb egy pontosság: 24-ből 18 a 24-ből 10 ellen, mindkettőn intervallummal és köztük párosított teszttel, mert két átfedő összesítés semmit nem dönt el. Ezt az eszközt kölcsönvettük. Egy skill leírása routing key, a törzse pedig olyan eljárás, amelyet a modell vagy követ, vagy nem; mindkettő olyan tulajdonság, amelyet csak úgy tudsz megismerni, ha sokszor lefuttatod a dolgot, és pontozod, mi jött vissza — ez pedig golden set, a futás előtt megírt grader, és az a metrika, amely azt kérdezi, hogy minden alkalommal működött-e, nem azt, hogy legalább egyszer.
A 29. fejezet erről szól, és azzal a számmal nyit, amelytől ennek a fejezetnek a módszere függ: egy agent, amely tízből hétszer sikeres, 70 %-osnak tűnik, az pass^10-ja — az esélye, hogy mind a tízszer sikerül — pedig nulla. Ugyanazon a kétszáz transcript-en három gradert is mér, és 0 %-ot, 13 %-ot és 26 %-ot kap anélkül, hogy egyetlen tokent újragenerálna. Mielőtt megbízol abban a mondatban, amelyet épp egy description-ba írtál, szükséged van arra az eszközre, amely meg tudja mondani, hogy rosszabb annál, amelyet lecseréltél.
Források és módszer
Link a szakaszhoz: Források és módszerEbben a fejezetben minden token-szám helyben készült tiktoken 0.14.0-val és a o200k_base encodinggal, 2026. szeptember 7-én: a fejezet elején felsorolt öt, harmadik féltől származó skillen, valamint a fejezethez írt release-notes skillen, amelynek teljes szövege fent részben reprodukálva van. Az 1. szintet az egyetlen - name: description sorként mértem, amelyet egy host a system promptba renderel; a 2. szint a SKILL.md törzse a frontmatter után; a 3. szint a mappában lévő minden más fájl. A költségek a 16. fejezet gpt-5.6-terra-ra mért árait használják, $2.00 egymillió input tokenenként és $0.20 egymillió cached input tokenenként, ezekre a darabszámokra alkalmazva — mért tokeneken végzett számtanról van szó, nem élő számla megfigyeléséről. A fejezet megírásához nem történt fizetős API-hívás.
Az aktiválási kísérlet Qwen/Qwen2.5-0.5B-Instruct-t futtatott fél precizitással egy consumer GPU-n, greedy decodinggal, 24 kéréssel hat skillen, kétszer — egyszer olyan leírásokkal, amelyek megmondják, mit csinál a skill és mikor alkalmazandó, egyszer pedig a specifikáció saját „rossz példa” stílusában puszta tárgyra vágott leírásokkal. Az intervallumok 95 %-os Wilson-intervallumok; a párosított összehasonlítás kétoldali exact sign test a tíz eltérő eseten; a Wilson-intervallum a 4. fejezeté, az exact paired sign test a 15. fejezeté, mindkettő változtatás nélkül újrahasználva. A nagyságrendeket egy nagyon kicsi modell tulajdonságaként olvasd, a módszert pedig átvihetőként.
Az itt mért öt skill harmadik féltől származó csomag, nem ehhez a fejezethez íródott: next-best-practices és next-cache-components a vercel-labs/next-skills repositoryból, valamint vercel-composition-patterns, vercel-react-best-practices és vercel-react-native-skills a vercel-labs/agent-skills repositoryból. Belső számaikat — 70 szabályfájl, AGENTS.md 26 362 tokennel, metadata.json 2026. januári dátummal és „40+ rules” állítással — a lemezen lévő fájlokból olvastam ki 2026. szeptember 7-én, és ezek az adott publikált verzió tulajdonságai, nem a szerzőik kritikái: mindegyik olyan drift, amely bármely dokumentációfában megjelenik, ha gyakrabban szerkesztik, mint ahányszor megszámolják.
Hivatkozások
Link a szakaszhoz: Hivatkozások-
Agent Skills Specification és Overview,
agentskills.io/specificationésagentskills.io, olvasva: 2026. szeptember 7. A könyvtárszerkezet forrása; a fent reprodukált frontmatter-táblázaté minden megkötéssel együtt (name1–64 karakter és a könyvtárral való egyezés,description1–1024 karakter,compatibilitylegfeljebb 500,allowed-toolskísérletiként jelölve); a jó és rosszdescriptionpéldáké; a háromszakaszos progresszív-feltárási leírásé token-költségvetéssel (metadata kb. 100 token, instructions ajánlottan 5 000 alatt, resources szükség szerint) és annak a tanácsnak a forrása, hogy aSKILL.mdmaradjon 500 sor alatt; annak a megjegyzésnek a forrása, hogy „the agent will load this entire file once it's decided to activate a skill”; ascripts/,references/ésassets/konvencióké; askills-ref validateparancsé; annak az állításnak a forrása, hogy a formátumot „was originally developed by Anthropic, released as an open standard, and has been adopted by a growing number of agent products”; és a client showcase-é, amely az olvasás dátumán negyvenhat terméket listázott. ↩ ↩2 ↩3 ↩4 -
Skills a Claude Code dokumentációban,
code.claude.com/docs/en/skills, olvasva: 2026. szeptember 7. A „mezők, amelyeket a referencia-implementáció hozzáad” szakaszban használt teljes mezőtábla forrása —when_to_use,argument-hint,arguments,disable-model-invocation,user-invocable,allowed-tools,disallowed-tools,model,effort,context,agent,background,hooks,paths,shell,metadata,license,compatibility—, a dynamic context injection leírásáé, amelyben a!`command`a törzs elküldése előtt fut, annak a szabálynak a forrása, hogy egyallowed-toolsgrant a következő üzenetnél törlődik, valamint a compliance note-é, amely szerint Claude Code-on kívül csak a hat specifikált mezőt fogadják el, és minden más hard errort okoz feltöltéskor vagy csomagoláskor. ↩ ↩2 ↩3 -
Agent Skills overview,
platform.claude.com/docs/en/agents-and-tools/agent-skills/overview, olvasva: 2026. szeptember 7. A négyoszlopos szinttábla forrása (Level 1 metadata, always, about 100 tokens per skill; Level 2 instructions, when triggered, under 5k tokens; Level 3+ resources, as needed, none until accessed); a teljes egészében idézett mondaté arról, hogy a csomagolt tartalom nem hordoz context-büntetést; az „until a Skill is triggered, only its name and description occupy context” állításé; annak az állításnak a forrása, hogy a script kódja soha nem kerül be a context windowba, csak a kimenete; valamint a security szakaszé, amely azt mondja, hogy csak megbízható forrásból származó skilleket használj, és figyelmeztet, hogy egy rosszindulatú skill „can direct Claude to invoke tools or execute code in ways that don't match the Skill's stated purpose” — a 30. fejezet tárgya, dokumentumon keresztül érkezve, nem tool-leíráson keresztül. ↩ ↩2 ↩3 -
Anthropic, Equipping agents for the real world with Agent Skills, 2025. október 16.,
anthropic.com/engineering/equipping-agents-for-the-real-world-with-agent-skills, olvasva: 2026. szeptember 7. A fent idézett definíció, a tartalomjegyzék/fejezetek/függelék analógia, az eredetileg leírt három szint, valamint annak a keretezésnek a forrása, hogy az agenteknek „more composable, scalable, and portable ways” kellenek domain expertise átadásához. A kísérő termékbejelentés aclaude.com/blog/skillscímen hordozza a 2025. október 16-i publikációs dátumot és a 2025. december 18-i frissítést, amely bevezette a szervezeti szintű managementet és a nyílt szabványt. ↩ -
Skills Over MCP Charter,
modelcontextprotocol.io/community/working-groups/skills-over-mcp, olvasva: 2026. szeptember 7. A fent idézett mission statement, a changelog-dátumok (interest group alakult: 2026. február 1., initial charter: 2026. április 14., working groupgá alakítva: 2026. április 16., SEP-2640 linkelve: 2026. április 25.), a leadership és a tizenhét listázott tag, a heti meeting cadence, valamint annak a sikerfeltételnek a forrása, amely a draft Skills Extensiont „a formal extension using existing Resources primitives” néven nevezi meg. A SEP-2076, Agent Skills as a First-Class MCP Primitive,github.com/modelcontextprotocol/modelcontextprotocol/pull/2076, 2026. január 13-án nyílt meg és 2026. február 24-én zárták le;skills/list-t,skills/get-t, egyskillsserver capabilityt és egyskills/list_changednotificationt javasolt, és a skillt úgy definiálta, mint „a named bundle of instructions plus references to tools, prompts, and resources that together teach an agent how to perform a domain-specific workflow”. A SEP-2640, Skills Extension,.../pull/2640, 2026. április 23-án nyílt meg az Extensions Tracken, és tartalmazza askill://resource conventiont és aio.modelcontextprotocol/skillsextension identifiert. A 26. fejezet ugyanezt a munkacsoportot a protokoll opcionális extensionjei között listázza. ↩