Agent Skills e SKILL.md: divulgación progresiva, medida
Cinco skills reais con 128.374 tokens de instrucións ocupan 253 tokens de contexto. Recorta as descricións e o agent deixa de atopalas.
Nesta páxina
Colle un proxecto que ten instaladas cinco skills publicadas. Isto é o que custan.
ls .claude/skills/next-best-practices next-cache-components vercel-composition-patterns
vercel-react-best-practices vercel-react-native-skillsskill level 1 level 2 level 3 files
next-best-practices 40 966 19,374 19
next-cache-components 28 2,334 0 0
vercel-composition-patterns 59 533 10,667 13
vercel-react-best-practices 68 1,670 53,670 75
vercel-react-native-skills 58 950 37,957 41
------ ------- --------
total 253 6,453 121,668Cento vinte e oito mil tokens de instrucións, exemplos e regras — máis do que cabe nunha context window de 128.000-token — e o custo fixo de ter as cinco dispoñibles é de 253 tokens, dúas décimas dun por cento. Nada máis neste curso ten esa forma. A definición dunha ferramenta págase en cada solicitude, se se usa ou non, e o Capítulo 26 mediu un MCP server en 1.619 tokens antes de facer nada: trinta e dúas veces a liña media de nivel 1 da táboa anterior.
Este capítulo trata sobre o mecanismo que produce esa proporción, sobre as dúas maneiras nas que rompe, e sobre a pregunta que o mecanismo obriga a facer e que case ninguén responde: dado un anaco de coñecemento, en cal de catro lugares debería estar.
Por que este capítulo non ten linguaxe de programación
Ligazón á sección: Por que este capítulo non ten linguaxe de programaciónO Capítulo 14 estableceu a regra para a segunda metade deste curso — conexións, reintentos e cancelación son TypeScript — e declarou cinco excepcións. Esta é unha delas, e a razón non é unha preferencia.
Unha skill é un ficheiro Markdown. Non un ficheiro que configura un programa, nin un ficheiro que un programa compila: un documento que o modelo le, igual que le a mensaxe que escribiches. Poñerlle unha linguaxe de programación a este capítulo significaría non ter entendido o formato, e ese malentendido é o máis común sobre as skills. Todo o que vén despois é Markdown e YAML, máis un pequeno script de shell que existe precisamente para amosar onde debe estar o código dentro dunha skill e onde non.
A factura que resolve, e é a aritmética do Capítulo 16
Ligazón á sección: A factura que resolve, e é a aritmética do Capítulo 16Esta é unha instrución real: como unha empresa escribe as súas notas de versión. É un procedemento, non unha preferencia: ten un conxunto ordenado de pasos, unha taxonomía, unha voz, un modelo e un script que recolle a materia prima.
Mete todo iso no system prompt, como fan a maioría dos equipos, e a aritmética do Capítulo 16 toma o control. Un system prompt é un prefixo, e un prefixo págase en cada chamada. Medido con o200k_base sobre o cartafol escrito para este capítulo:
whole thing pasted into the system prompt 1,716 x 40 = 68,640 input tokens $0.1373
as a skill, activated once on turn 12 46 x 40
+ 324 (SKILL.md body)
+ 665 (two reference files read)
= 2,829 input tokens $0.0057
as a skill, never activated at all 46 x 40 = 1,840 input tokens $0.0037Vinte e catro veces máis barato cando se usa, trinta e sete veces máis barato cando non se usa. As tarifas son as do Capítulo 16: $2.00 por millón de input tokens.
Agora a obxección honesta, porque un capítulo que a saltase sería publicidade. O prompt caching pecha case toda a fenda de diñeiro. Un system prompt é estable e vai ao comezo, o que o converte no mellor candidato posible para cache; a $0.20 por millón de input en cache, os mesmos 68.640 tokens custan $0.0168 no canto de $0.1373. Aínda tres veces máis que a skill, pero xa non unha orde de magnitude distinta.
O diñeiro nunca foi o argumento máis forte. É este:
O caching abarata un prefixo permanente. Non o fai máis pequeno.
No turno 40, a versión con system prompt segue tendo 1.716 tokens de política de notas de versión dentro da xanela durante unha conversa sobre algo completamente distinto, competindo polo que o Capítulo 24 chamou o orzamento de attention do modelo. A versión con skill ten 46. Fai cache do que non toca e acabas de mercar un desconto nunha distracción.
Escrito como fórmula, con turnos, os metadatos, o corpo, o paquete completo e o conxunto de ficheiros empaquetados que realmente se len:
Todo este capítulo é a diferenza entre multiplicar o segundo termo por e multiplicalo por un ou por cero.
Que é realmente unha skill
Ligazón á sección: Que é realmente unha skillUnha skill é un directorio. A especificación é o bastante curta como para expoñela enteira:
release-notes/
├── SKILL.md # required: YAML frontmatter + Markdown instructions
├── scripts/ # optional: executable code
├── references/ # optional: documentation read on demand
├── assets/ # optional: templates, schemas, examples
└── ... # anything else you likeSKILL.md debe comezar con YAML frontmatter, e requírense exactamente dous campos: name e description.1 Catro máis son opcionais e non se define ningún outro:
| Campo | Obrigatorio | Restrición |
|---|---|---|
name | si | 1–64 caracteres, letras minúsculas, díxitos e guións; sen guión inicial, final nin dobre; debe coincidir co nome do directorio |
description | si | 1–1024 caracteres, non baleiro; di que fai a skill e cando usala |
license | non | un nome de licenza, ou o nome dun ficheiro de licenza empaquetado |
compatibility | non | ata 500 caracteres: produto previsto, paquetes requiridos, acceso á rede |
metadata | non | un mapa libre de claves string a valores string, para o teu propio tooling |
allowed-tools | non | lista separada por espazos de ferramentas preaprobadas; marcado como experimental |
Esta é a skill de notas de versión, completa, co corpo por debaixo de trinta liñas:
---
name: release-notes
description: Write the release notes for a tagged version in this company's house style. Use when preparing a release, drafting a changelog entry, or when someone asks for the notes for a version number or a tag.
allowed-tools: Bash(git log:*) Bash(git tag:*) Read
---
# Release notes
## Procedure
1. Run `scripts/collect.sh <previous-tag> <new-tag>`. It prints one line per merged
pull request: number, title, author and the labels.
2. Drop every line whose labels contain `internal`, `ci` or `chore`.
3. Put each surviving line into exactly one of the four categories in
[references/categories.md](references/categories.md). A change that seems to fit two
belongs in the higher one; the order in that file is the order of precedence.
4. Rewrite each line as a sentence in the voice defined in
[references/voice.md](references/voice.md). The pull request title is a note to
the team; the release note is a note to a stranger.
5. Check the result against [references/examples.md](references/examples.md).
## The one rule that is not negotiable
Every note says what a person can now do, or what stopped happening to them. If a
sentence can only be understood by someone who has read the diff, it is not finished.Le o que é ese corpo. Non é a política: é unha táboa de contidos cunha orde de operacións. A política vive en tres ficheiros que o corpo nomea e non inclúe. E o primeiro paso pásalle traballo a un script, porque o código dun script nunca entra na context window: só entra a súa saída.2
Tres niveis, e canto custa cada un
Ligazón á sección: Tres niveis, e canto custa cada unO modelo de carga ten nome e tres fases. A especificación descríbeas cun orzamento de token asociado:1
- Metadatos, arredor de 100 tokens:
nameedescription, cargados no inicio para cada skill instalada. - Instrucións, recomendadas por debaixo de 5.000 tokens: o corpo de
SKILL.md, cargado cando se activa a skill. - Recursos, segundo sexan necesarios: ficheiros empaquetados, cargados só cando algo os require.
A documentación de referencia pon unha cuarta columna na mesma táboa — cando se carga, custo en token, contido — e a fila que importa é a terceira: nada ata que se accede.3 A frase que resume todo o capítulo tamén está aí:
Files don't consume context until accessed, so Skills can include comprehensive API documentation, large datasets, or extensive examples. There's no context penalty for bundled content that isn't used.3
A táboa medida ao comezo deste capítulo é esa afirmación comprobada contra cinco skills que ninguén escribiu para este artigo. Hai dúas filas que paga a pena ler unha fronte á outra.
next-best-practices ten un corpo de 966 tokens que enlaza con dezanove ficheiros que conteñen 19.374 tokens. Pídelle que arranxe un erro de hidratación e o agent le o corpo máis hydration-error.md: 1.409 tokens de 20.340, un factor de catorce, e os outros dezaoito ficheiros nunca se abren.
next-cache-components ten un corpo de 2.334-token e ningún ficheiro empaquetado. É unha skill válida e ben escrita, e non ten nivel 3 que divulgar. Ese é o límite honesto da técnica: a divulgación progresiva só aforra se hai algo que aprazar. Unha skill cuxo coñecemento non se descompón paga todo o seu corpo ao activarse, e a única panca que queda é non activala.
Rómpeo: a descrición é toda a interface
Ligazón á sección: Rómpeo: a descrición é toda a interfaceO nivel 1 é unha decisión de routing tomada a partir dunha frase. Nada máis dunha skill inflúe en se chega a abrirse: nin a calidade do corpo, nin os exemplos, nin os scripts. Así que a descrición non é documentación. É a superficie de consulta, e pode estar mal.
A especificación dio en forma dun bo exemplo e dun malo, e o malo son catro palabras: description: Helps with PDFs.1 Iso merece medirse, non simplemente aceptarse.
Seis skills, cada unha cunha descrición plausible que di que fai e cando usala. Vinte e catro solicitudes, catro por skill, formuladas como as formularía unha persoa e sen nomear nunca a skill. O modelo ve as seis liñas no seu system prompt e debe responder cun nome ou con NONE. Greedy decoding, para que reproduza. Despois, as mesmas vinte e catro solicitudes coas mesmas seis skills, e as descricións recortadas ao seu asunto máis cru.
rich - sql-review: Review a SQL migration for locks, missing indexes and unsafe
defaults before it runs on the production database. Use when someone adds
or changes a migration, an index, or a table column.
thin - sql-review: Helps with SQL.rich 295 tokens of level 1 for six skills 18/24 correct = 75.0 % [55.1, 88.0]
thin 81 tokens of level 1 for six skills 10/24 correct = 41.7 % [24.5, 61.2]
paired: rich only 9, thin only 1, two-sided sign test p = 0.0215
answered NONE: rich 1 of 24, thin 9 of 24Le primeiro os intervalos, como insistiu o Capítulo 4 e como volverá insistir o Capítulo 29: solápanse, e vinte e catro casos non poden ordenar dous sistemas só polos seus agregados. A comparación emparellada é a que o resolve, e é o instrumento do Capítulo 15: dos dez casos nos que os dous brazos discreparon, nove foron para as descricións ricas e un para as delgadas. Iso queda establecido no limiar habitual.
Agora le a última liña, que é o achado real. Con descricións delgadas, o modelo respondeu NONE en nove de vinte e catro solicitudes. Non a skill equivocada: ningunha skill. Aquí tes catro delas, palabra por palabra:
"Check this migration before I run it against production." -> release-notes
"Will this CREATE INDEX lock writes?" -> NONE
"Is this ALTER TABLE safe to deploy at peak traffic?" -> NONE
"Is 'seamless and powerful' allowed in the app store listing?" -> next-best-practicesHabía instalada unha skill sql-review perfecta, con corpo e exemplos e unha checklist, e nunca se abriu, tres veces seguidas, nas tres preguntas para as que fora escrita. Os niveis 2 e 3 son irrelevantes para unha skill á que o nivel 1 nunca chega.
O custo de arranxalo: 214 tokens, a diferenza entre 295 e 81, repartida entre seis skills. É o achado do Capítulo 18 chegando desde o outro lado. Alí, cambiar só a descrición dunha ferramenta levou o formato de datas de 2 correctas de 24 a 24 de 24. Aquí, cambiar só a descrición dunha skill leva a activación de 10 de 24 a 18. Nos dous casos, o arranxo máis barato do sistema é unha frase, e nos dous casos a frase ten que nomear o disparador e non só o asunto: non que é a cousa, senón que acaba de dicir o usuario cando aplica.
Unha advertencia que este capítulo lle debe aos seus propios estándares. Este é un modelo de medio milleiro de millóns de parámetros, e un modelo de fronteira fai routing moito mellor que o 75 %. Le o mecanismo, non a magnitude: o sinal de routing ten unha frase de longo sexa cal sexa o modelo que o lea, e ningún modelo pode seleccionar sobre información que non puxeches nesa frase.
Rómpeo outra vez: a válvula de escape que custa 26.362 tokens
Ligazón á sección: Rómpeo outra vez: a válvula de escape que custa 26.362 tokensO segundo fallo é o contrario do primeiro. A skill atópase, os niveis están ben divididos, e o agent léao todo igual.
vercel-react-best-practices é unha skill realmente ben construída. O seu corpo de 1.670-token é unha táboa de prioridades de oito categorías e unha referencia rápida que nomea 70 ficheiros de regras, unha liña cada un. As regras están no disco ao seu carón: 70 ficheiros, o menor de 132 tokens, mediana 319, o maior 1.052. Pregúntalle unha cuestión sobre importacións barrel e o custo honesto é o corpo máis un ficheiro: menos de 2.400 tokens fronte a un paquete de 53.670.
Entón a última liña do corpo di isto:
## Full Compiled Document
For the complete guide with all rules expanded: `AGENTS.md`AGENTS.md son 26.362 tokens. Son os 70 ficheiros de regras concatenados: a súa suma é 25.784, e a diferenza son os títulos entre eles. Así que a skill ofrécelle ao agent escoller entre ler unha regra mediana de 319 tokens e ler o mesmo contido, enteiro, a oitenta e tres veces o prezo — e ofrece esa elección nunha frase sen custo asociado e sen condición sobre cando tomala.
Iso non é un bug e o ficheiro non está mal; un documento compilado é realmente útil para unha persoa, e para un agent ao que se lle pediu auditar unha base de código enteira. É un ficheiro de nivel 3 cun convite de nivel 2, e a lección xeneralízase máis alá desta skill: cada camiño que sae dun SKILL.md debería dicir que custa e cando paga a pena, porque o modelo non ten maneira de saber que un nome de ficheiro é oitenta e tres veces máis caro que o nome de ficheiro que ten enriba.
O mesmo cartafol contén unha lección menor sobre obsolescencia. O corpo di "70 rules across 8 categories" e lista 70; o directorio rules/ contén 72 ficheiros, dos cales dous son andamiaxe (_template.md e _sections.md); e o sidecar metadata.json di "40+ rules". Tres contas do mesmo conxunto nun cartafol, unha correcta, unha aritmética e unha arrastrada dunha versión anterior. Unha skill é un documento, e os documentos podrecen exactamente igual que un comentario de código que se desfasou do código que ten ao lado, coa diferenza de que este léao unha máquina que non vai erguer unha cella.
Os campos que engade a implementación de referencia, e a trampa da portabilidade
Ligazón á sección: Os campos que engade a implementación de referencia, e a trampa da portabilidadeA especificación aberta define seis campos de frontmatter. A implementación de referencia, Claude Code, acepta vinte.2 Hai cinco grupos que convén coñecer polo nome, porque son onde o formato deixa de ser só un documento:
Permiso e invocación. allowed-tools preaproba ferramentas para o turno que invocou a skill e a concesión límpase na seguinte mensaxe; disallowed-tools elimínaas. disable-model-invocation impide que o modelo a cargue pola súa conta, convertendo a skill nun comando que executa unha persoa. user-invocable: false fai o contrario: oculta para persoas, dispoñible só para o modelo, para coñecemento de fondo.
Illamento e custo. context: fork executa a skill nun contexto de sub-agent separado coa súa propia xanela — o límite de sub-agent do Capítulo 25 como unha liña de YAML — con agent escollendo de que tipo e background decidindo se o turno espera. model e effort cambian que modelo se executa mentres a skill está activa, só para ese turno.
Argumentos (arguments, argument-hint) permiten que unha persoa pase valores que se substitúen no corpo, que é o que fai que unha skill sexa usable como comando slash. Ámbito (paths) limita a activación a ficheiros que coinciden cun glob. E a inxección dinámica de contexto é a que cambia o modelo mental: unha liña da forma !`git diff HEAD` execútase antes de enviar o corpo, e a súa saída substitúese no texto. O documento é un modelo, e unha parte calcúlase no momento da lectura.
Agora a trampa, e está formulada na mesma documentación: fóra de Claude Code — no produto web, a través da Skills API, no empaquetado — só se permiten os seis campos especificados, e calquera outro campo é un erro duro ao subir.2 Así que unha skill que funciona perfectamente nun produto falla ao instalarse noutro do mesmo provedor, e falla no frontmatter e non en algo que poderías comprobar lendo a prosa. Se queres que unha skill sexa portátil, os seis campos son todo o orzamento. Se non, dilo en compatibility, que existe exactamente para iso.
A táboa pola que existe este capítulo
Ligazón á sección: A táboa pola que existe este capítuloCatro cousas confúndense entre si constantemente, e a confusión non é pedantería de vocabulario: escoller mal custa diñeiro en cada turno, ou cústache unha garantía que pensabas que tiñas.
| System prompt | Skill | Ferramenta | MCP server | |
|---|---|---|---|---|
| Que é | texto en cada solicitude | un cartafol cuxa raíz é un SKILL.md | un JSON Schema máis un endpoint no teu código | un proceso ou servizo que fala un protocolo |
| Que fai o modelo | léao, sempre | léaa, cando decide que a descrición coincide | chámaa, e agarda polo teu resultado | chámao, a través do host, un cliente por server |
| Que custa | toda a súa lonxitude, cada turno, para sempre | arredor de 50 tokens por turno; o corpo unha vez, se se usa | o seu schema, cada turno; execución cando se chama | cada schema máis o instructions do server, cada turno |
| Que pode garantir | nada: é consello | nada: é consello que o modelo pode saltar | todo o que o teu código impón antes de actuar | todo o que o server impón |
| Quen o escribe | ti | ti, un compañeiro ou un provedor | ti | outra persoa, para moitos hosts |
| Capítulo | 15 | este | 18 | 26 e 27 |
As dúas filas en negra son toda a distinción. Unha skill lese; unha ferramenta invócase. Unha skill é prosa que chega á context window e compite pola attention con todo o demais que hai nela; o modelo pode seguila, interpretala mal ou ignorala, e nada no sistema se decata. Unha ferramenta é unha chamada que sae completamente das mans do modelo: o teu código recibe argumentos, valídaos, comproba permisos e decide. O Capítulo 18 formulouno como que o modelo propón e o teu código dispón, e esa división é exactamente o que unha skill non ten.
Así que seis casos reais, resoltos:
"Responde na lingua do usuario. Nunca indiques un prezo que non se che dera."
Ligazón á sección: "Responde na lingua do usuario. Nunca indiques un prezo que non se che dera."System prompt. Aplícase en cada turno, é unha restrición máis ca un procedemento, e ten dúas frases de longo. Algo que aplica sempre non ten nada que divulgar progresivamente, e pagar por unha liña de descubrimento en cada turno para evitar pagar por dúas frases en cada turno non é un aforro.
"Como escribimos aquí as notas de versión."
Ligazón á sección: "Como escribimos aquí as notas de versión."Skill. Procedimental, necesaria quizais nun turno de corenta, descompoñible en voz, taxonomía e exemplos, e é prosa que unha persoa editará. Esta é a forma para a que se deseñou o formato, e a medición anterior é o que aforra.
"Busca un pedido polo seu identificador na base de datos do almacén."
Ligazón á sección: "Busca un pedido polo seu identificador na base de datos do almacén."Ferramenta. Hai unha función determinista detrás e o modelo non debe improvisar a consulta. Escribir isto como skill — un documento que explica como consultar o almacén — dálle ao modelo o schema e espera. Un schema máis un endpoint dálle unha resposta.
"Ler e escribir incidencias no noso tracker, desde cada produto de agent que usa a empresa."
Ligazón á sección: "Ler e escribir incidencias no noso tracker, desde cada produto de agent que usa a empresa."MCP server. A capacidade non é túa, varios hosts necesítana e ten unha historia de autenticación. Ese é o problema co que abría o Capítulo 26, un protocolo é a resposta, e o Capítulo 27 envía un dúas veces. Unha skill non pode ser descuberta por un host que nunca viu o teu sistema de ficheiros, que é precisamente a fenda que o traballo de estándares ao final deste capítulo está pechando.
"O manual de marca de catrocentas páxinas."
Ligazón á sección: "O manual de marca de catrocentas páxinas."Ningún dos catro. É coñecemento que consultar, non un procedemento que seguir, e pertence a un índice que o agent busca: Capítulo 19. Empaquetalo como nivel 3 está permitido, resulta tentador e é incorrecto, porque o modelo tería que adiviñar cal de corenta ficheiros contén a resposta só polos seus nomes. O que si é unha boa skill é o procedemento de dúas páxinas que lle di ao agent cando buscar nese índice, que significa unha puntuación de similitude baixa e como citar o que atopa.
"Nunca reembolses máis de douscentos euros sen unha persoa."
Ligazón á sección: "Nunca reembolses máis de douscentos euros sen unha persoa."Unha ferramenta cunha porta de aprobación, e nunca unha skill. Este é o caso que importa. Escrito nun SKILL.md, o límite é unha frase que o modelo le e normalmente respecta; escrito na ferramenta de reembolso, é unha rama que se executa antes de que se mova diñeiro ningún. Un límite que che daría vergoña se se cruzase non é documentación. A regra, que paga a pena memorizar: se a consecuencia de ignorar a instrución é peor ca unha resposta mal formatada, a instrución non pertence a un documento.
Da xerga da casa a un estándar, cos números
Ligazón á sección: Da xerga da casa a un estándar, cos númerosA historia é curta, extraordinariamente ben datada, e é a parte que case ninguén conta.
Agent Skills publicouse o 16 de outubro de 2025 como funcionalidade dun provedor, definida nese anuncio como "cartafoles organizados de instrucións, scripts e recursos que os agents poden descubrir e cargar dinamicamente para render mellor en tarefas específicas", cos tres niveis descritos mediante unha analoxía que convén conservar: "como un manual ben organizado que comeza cunha táboa de contidos, segue con capítulos específicos e remata cun apéndice detallado".4
O 18 de decembro de 2025 a mesma páxina actualizouse para anunciar o formato como estándar aberto, cunha especificación propia en agentskills.io, gobernanza aberta a contribucións e un validador de referencia.3 Lida o 7 de setembro de 2026, a mostra de clientes do estándar lista corenta e seis produtos — editores, terminais, plataformas cloud e runtimes móbiles, incluíndo os coding agents first-party de Anthropic, OpenAI, Google e Mistral — cada un enlazando coa súa propia documentación de configuración.1
A converxencia con MCP estase facendo en aberto, con números que podes comprobar:
| Que é | Aberto | Estado o 7 set 2026 | |
|---|---|---|---|
| SEP-2076 | Agent Skills as a First-Class MCP Primitive: novos métodos skills/list e skills/get, unha capacidade skills, unha notificación list_changed | 13 de xaneiro de 2026 | pechado, 24 de febreiro de 2026 |
| Skills Over MCP working group | define como as skills se "descobren, distribúen e consomen a través de MCP"; reúnese semanalmente; dezasete membros listados, dous deles leads | grupo de interese 1 de febreiro de 2026; working group 16 de abril de 2026 | activo |
| SEP-2640 | Skills Extension, Extensions Track: unha convención de recurso skill://, identificador de extensión io.modelcontextprotocol/skills, descubrimento a través de skills/list e contido a través de resources/read | 23 de abril de 2026 | en revisión |
O interesante é o peche, non as propostas. SEP-2076 pedía un cuarto primitivo xunto a ferramentas, recursos e prompts. O working group que xurdiu del decidiu que a resposta era non: as skills viaxan sobre o primitivo de recursos que xa existe, como extensión opt-in.5 O Capítulo 26 mediu o mesmo instinto no changelog do propio protocolo, onde sampling, roots e logging se deprecaron no canto de conservarse. Un organismo de estándares que elimina unha proposta que el mesmo redactou está comportándose ben, e a razón para contar esta historia cos números diante é que os resumos que lerás noutros sitios aínda describen as skills como un primitivo de MCP.
Cara a onde imos agora
Ligazón á sección: Cara a onde imos agoraAgora podes escribir un SKILL.md, dividilo en tres niveis que se pagan sós, ler o frontmatter da skill doutra persoa e saber que campos non sobrevivirán ao subila a outro sitio, e responder á pregunta arredor da que se construíu todo o capítulo — system prompt, skill, ferramenta ou server — cunha razón e non cun hábito.
O que non podes facer é saber se a túa funciona.
Cada afirmación importante deste capítulo foi unha medición, e a máis importante foi unha precisión: 18 de 24 contra 10 de 24, cun intervalo en cada unha e unha proba emparellada entre elas, porque dous agregados que se solapan non deciden nada. Ese instrumento tomouse prestado. A descrición dunha skill é unha chave de routing, o seu corpo é un procedemento que o modelo pode seguir ou non, e ambas as dúas son propiedades que só podes descubrir executando a cousa moitas veces e puntuando o que volveu: un conxunto dourado, un avaliador que escribiches antes da execución, e a métrica que pregunta se funcionou todas as veces e non polo menos unha vez.
O Capítulo 29 é iso, e abre co número do que depende o método deste capítulo: un agent que ten éxito sete de cada dez veces parece un 70 %, e o seu pass^10 — a probabilidade de ter éxito nas dez — é cero. Tamén mide tres avaliadores sobre as mesmas duascentas transcricións e obtén 0 %, 13 % e 26 % sen rexenerar un só token. Antes de confiar na frase que acabas de escribir nun description, necesitas o instrumento que che diga que é peor ca a que substituíches.
Fontes e método
Ligazón á sección: Fontes e métodoCada reconto de token deste capítulo produciuse localmente con tiktoken 0.14.0 e a codificación o200k_base, o 7 de setembro de 2026: sobre as cinco skills de terceiros listadas ao comezo deste capítulo, e sobre a skill release-notes escrita para este capítulo, cuxo texto completo se reproduce parcialmente arriba. O nivel 1 mídese como a única liña - name: description que un host renderiza no system prompt; o nivel 2 é o corpo de SKILL.md despois do frontmatter; o nivel 3 son todos os demais ficheiros do cartafol. Os custos usan as tarifas medidas no Capítulo 16 para gpt-5.6-terra, $2.00 por millón de input tokens e $0.20 por millón de input tokens en cache, aplicadas a eses recontos: son aritmética sobre tokens medidos, non observacións dunha factura real. Non se chamou ningunha API de pago para escribir este capítulo.
O experimento de activación executou Qwen/Qwen2.5-0.5B-Instruct en media precisión nunha GPU de consumo, greedy decoding, 24 solicitudes sobre seis skills, dúas veces: unha con descricións que din que fai a skill e cando aplica, outra coas descricións recortadas a un asunto cru ao estilo do "poor example" da propia especificación. Os intervalos son Wilson ao 95 %; a comparación emparellada é unha proba exacta dos signos bilateral sobre os dez casos discordantes; o intervalo de Wilson é o do Capítulo 4 e a proba exacta dos signos emparellada é a do Capítulo 15, ambos reutilizados sen cambios. Le as magnitudes como propiedade dun modelo moi pequeno e o método como transferible.
As cinco skills medidas aquí son paquetes de terceiros, non escritos para este capítulo: next-best-practices e next-cache-components de vercel-labs/next-skills, e vercel-composition-patterns, vercel-react-best-practices e vercel-react-native-skills de vercel-labs/agent-skills. Os seus recontos internos — 70 ficheiros de regras, AGENTS.md con 26.362 tokens, metadata.json datado en xaneiro de 2026 e afirmando "40+ rules" — léronse dos ficheiros no disco o 7 de setembro de 2026 e son propiedades desa versión publicada, non críticas aos seus autores: cada un deles é o tipo de deriva que aparece en calquera árbore de documentación que se edita máis a miúdo do que se conta.
Referencias
Ligazón á sección: Referencias-
Agent Skills Specification e Overview,
agentskills.io/specificationeagentskills.io, lidos o 7 de setembro de 2026. Fonte da estrutura de directorio; da táboa de frontmatter reproducida arriba con cada restrición (name1–64 caracteres e coincidencia co directorio,description1–1024 caracteres,compatibilityata 500,allowed-toolsmarcado como experimental); dos bos e malos exemplos dedescription; da descrición de divulgación progresiva en tres fases co seu orzamento de token (metadatos arredor de 100 tokens, instrucións por debaixo de 5.000 recomendadas, recursos segundo sexa necesario) e do consello de manterSKILL.mdpor debaixo de 500 liñas; da nota de que "the agent will load this entire file once it's decided to activate a skill"; das convenciónsscripts/,references/eassets/; do comandoskills-ref validate; da afirmación de que o formato "was originally developed by Anthropic, released as an open standard, and has been adopted by a growing number of agent products"; e da mostra de clientes, que listaba corenta e seis produtos na data de lectura. ↩ ↩2 ↩3 ↩4 -
Skills na documentación de Claude Code,
code.claude.com/docs/en/skills, lida o 7 de setembro de 2026. Fonte da táboa completa de campos usada na sección "os campos que engade a implementación de referencia":when_to_use,argument-hint,arguments,disable-model-invocation,user-invocable,allowed-tools,disallowed-tools,model,effort,context,agent,background,hooks,paths,shell,metadata,license,compatibility; da descrición da inxección dinámica de contexto con!`command`executándose antes de enviar o corpo, da regra de que unha concesiónallowed-toolsse limpa na seguinte mensaxe, e da nota de cumprimento de que fóra de Claude Code só se aceptan os seis campos especificados e calquera outro provoca un erro duro na subida ou no empaquetado. ↩ ↩2 ↩3 -
Resumo de Agent Skills,
platform.claude.com/docs/en/agents-and-tools/agent-skills/overview, lido o 7 de setembro de 2026. Fonte da táboa de niveis coas súas catro columnas (Nivel 1 metadatos, sempre, arredor de 100 tokens por skill; Nivel 2 instrucións, cando se dispara, por debaixo de 5k tokens; Nivel 3+ recursos, segundo sexa necesario, nada ata que se accede); da frase citada completa sobre que o contido empaquetado non supón penalización de contexto; de "until a Skill is triggered, only its name and description occupy context"; da afirmación de que o código dun script nunca entra na context window e só o fai a súa saída; e da sección de seguridade, que che di que uses skills só de fontes de confianza e advirte de que unha skill maliciosa "can direct Claude to invoke tools or execute code in ways that don't match the Skill's stated purpose" — o tema do Capítulo 30, chegando a través dun documento e non dunha descrición de ferramenta. ↩ ↩2 ↩3 -
Anthropic, Equipping agents for the real world with Agent Skills, 16 de outubro de 2025,
anthropic.com/engineering/equipping-agents-for-the-real-world-with-agent-skills, lido o 7 de setembro de 2026. Fonte da definición citada arriba, da analoxía táboa de contidos/capítulos/apéndice, dos tres niveis tal como se describiron orixinalmente, e do marco de que os agents necesitan formas "more composable, scalable, and portable ways" de recibir coñecemento experto de dominio. O anuncio de produto complementario enclaude.com/blog/skillsleva a data de publicación do 16 de outubro de 2025 e a actualización do 18 de decembro de 2025 que introduciu a xestión en toda a organización e o estándar aberto. ↩ -
Skills Over MCP Charter,
modelcontextprotocol.io/community/working-groups/skills-over-mcp, lida o 7 de setembro de 2026. Fonte da declaración de misión citada arriba, das datas do changelog (grupo de interese formado o 1 de febreiro de 2026, charter inicial o 14 de abril de 2026, convertido en working group o 16 de abril de 2026, SEP-2640 enlazada o 25 de abril de 2026), do liderado e dos dezasete membros listados, da cadencia semanal de reunións, e do criterio de éxito que nomea o borrador Skills Extension como "a formal extension using existing Resources primitives". SEP-2076, Agent Skills as a First-Class MCP Primitive,github.com/modelcontextprotocol/modelcontextprotocol/pull/2076, abriuse o 13 de xaneiro de 2026 e pechouse o 24 de febreiro de 2026; propuxoskills/list,skills/get, unha capacidade de serverskillse unha notificaciónskills/list_changed, e definiu unha skill como "a named bundle of instructions plus references to tools, prompts, and resources that together teach an agent how to perform a domain-specific workflow". SEP-2640, Skills Extension,.../pull/2640, abriuse o 23 de abril de 2026 no Extensions Track e leva a convención de recursoskill://e o identificador de extensiónio.modelcontextprotocol/skills. O Capítulo 26 lista o mesmo working group entre as extensións opcionais do protocolo. ↩