Google 在其 AI 开发框架 Genkit 中支持 Agent Skills,让 AI 能「按需挂载技能包」
- AI Agent 的说明书越堆越多,全塞进上下文既烧 Token 又让模型分心。Google 给自家框架 Genkit 接上了 Agent Skills:说明书放磁盘上,用到哪份调哪份。
- 这套技能标准是 Anthropic 发起的,Google 四个语言版本全接,接入只要一行参数。
- 官方拿 2012 年被毁容的「猴子耶稣」原画当测试题,模型自己认出是油画、唤出对应修复技能。
说明书全塞给 AI,塞不下也没必要
Google 开发者博客发布了一份极其实用的上手教程:自家开源 AI 应用框架 Genkit 正式支持 Agent Skills,由 Anthropic 发起、已经开放成行业标准的「AI 技能包」格式。简单来说,过去你得把所有操作手册塞进提示词,现在手册躺在磁盘上,用到哪份才加载哪份,接入只要一行参数。教程用 Go 语言给了两个能直接跑的例子:一个菜谱机器人,一个会自己挑修复方案的 AI 艺术修复师。
它要解决的问题每个做 Agent 的人都撞过:Agent 接的活越多,要给它的说明书就越多,操作规程、参考指南、各种文档。全部常驻在上下文窗口里,三个毛病一起来:Token 白烧(每次请求都把整摞文档再读一遍)、注意力被稀释(真正相关的那几行淹在几百页里)、答错的概率反而上升。就像一个员工每天上班先把公司全部规章制度从头背一遍,其实他今天只用得上其中一页。
Agent Skills 解决的就是这件事:把专业知识打包成一个个技能,平时躺在后台,被用到的那一刻才加载。如果你用过 Claude Code 的 Skills,这套东西会非常眼熟,格式就是同一个,Anthropic 把它开放成了标准(agentskills.io),Genkit 这次接的正是这套。站内之前拆过 Anthropic 官方拿技能搭验证循环的实战:
一个技能就是一个文件夹
那么这个「按需加载」的技能长什么样?答案简单得出乎意料:一个技能就是一个文件夹,里面必须有一份 SKILL.md 文件。这份文件分两截,头部 frontmatter,用 --- 围起来的一小段元数据,写着技能叫什么、什么时候该用我;正文 body,真正的操作指令。文件夹里还可以放三类可选资源:scripts/(可执行脚本)、references/(参考文档)、assets/(模板素材)。
skill-name/ ├── SKILL.md # Required: metadata + instructions ├── scripts/ # Optional: executable code ├── references/ # Optional: documentation ├── assets/ # Optional: templates, resources └── ... # Any additional files or directories
