技能三大杀招:让Agent发现新招、告别翻车、打包大神经验!

技能三大杀招:让Agent发现新招、告别翻车、打包大神经验!

💡 原文中文,约4000字,阅读约需10分钟。
📝

内容提要

技能已从简单的Markdown文件演变为介于提示词与程序之间的“灰色地带”,能帮助Agent发现新能力、提供标准操作程序以减少不稳定、封装专家经验,并积累用户个性化知识。截至2026年,技能生态迅速扩张,但质量参差不齐,且面临标准制定和权益分配等挑战。

🔎

延伸解读

技能的本质:从提示词到程序的灰色地带

文章指出,技能已不再是简单的Markdown文件,而是介于提示词和完整程序之间的光谱。从纯文本说明到可执行代码,技能涵盖了多种形态,例如Last30days这类迷你程序、Symphony这类规范文件,以及包含hooks和tools的插件。这种模糊性使得技能难以精确定义,但正是这种灵活性让它能适应不同任务需求。理解这一点,有助于开发者根据实际场景选择合适的技能形态,避免陷入“技能只是提示词”的误区。

技能的价值:发现能力、稳定执行与经验封装

技能的核心价值体现在三个方面:一是通过展示Agent的潜在能力,解决用户“不知道能做什么”的问题,如youtube-notetaker和cc-blender-skill;二是通过标准操作程序(SOP)减少Agent的不稳定性,Google的CI/CD流水线就是质量控制的范例;三是封装专家经验,让通用模型快速成为领域专家,如Garry Tan的gstack项目。这些功能让技能成为Agent工作流中不可或缺的组成部分。

技能生态的隐忧:质量参差与权益问题

尽管技能数量激增,但质量堪忧。据agentskillreport.com分析,22%的技能无法通过基本验证,52%的token是非功能性内容,占用上下文窗口。此外,技能可能被滥用,例如虚假宣传性能的案例,以及打包他人经验可能引发的权益分配问题。这些风险提示用户在选择和使用技能时需谨慎,同时也凸显了制定统一标准和规范的必要性。

Q&A

技能在AI Agent中扮演什么角色?

技能是帮助Agent完成任务的信息文件夹,介于提示词和完整程序之间,能提供可复用的知识和可调用的工作流,帮助Agent发现新能力、提供标准操作程序、封装专家经验,并积累用户个性化知识。

为什么说技能不仅仅是Markdown文件?

因为技能已经演变为一个从纯文本到可执行代码的光谱,可以包含脚本、工具、参考文档等,例如Last30days是带代码和工具的迷你程序,Symphony是Markdown但能作为产品规格,插件还包含hooks和tools。

技能如何帮助Agent发现新能力?

技能通过展示Agent能执行的操作,将“回忆”问题变成“识别”问题,让用户知道Agent还能做什么,例如youtube-notetaker可以将视频转为结构化笔记,cc-blender-skill可以用自然语言驱动Blender建模。

技能如何提高Agent的稳定性?

技能通过提供标准操作程序(SOP),在任务有多种完成方式时指定特定路径,减少Agent的随机行为,例如对接外部资源时避免Agent无视MCP协议。Google还通过CI/CD流水线进行质量控制,确保技能可靠。

技能如何封装专家经验?

技能将特定领域的专业知识打包,使通用模型能像专家一样工作,例如SEO技能、网络安全技能、Garry Tan的gstack项目将YC的创始人评审文化编码为31个技能。

技能如何积累用户个性化知识?

技能可以整合来自Agent执行轨迹和用户反馈的信息,形成情景记忆,例如自动化销售外呼邮件排期的技能符合用户工作风格,Hermes框架实现了经验提取到自动改进的闭环。

技能生态目前存在哪些问题?

技能数量虽多但质量参差不齐,22%连基本验证都过不了,52%的token是非功能性内容;此外,技能可能被用来包装虚假成果,如DeepSeek V4 Pro的翻车事件;还有权益分配问题,当技能打包个人经验时,被打包者的权益难以保障。

技能标准制定的现状如何?

Anthropic在2025年10月推出Claude Skills,12月开源Agent Skills Specification V1.0;2026年8月Vercel联合多家巨头推出Agent Plugins 1.0规范,由Linux基金会下属的AAIF管理,旨在统一技能和工具格式。

🏷️

标签

➡️

继续阅读