公司里一群人开始疯狂写 Skills,我却想起了十年前那份 200 页的操作手册
上周一开周会一个下属在投屏上展示他写的 Skill洋洋洒洒翻了五页还没翻完。三千多字。PDF 解析原理、Python 库对比、编码规范、错误处理策略……应有尽有。写完以后他特别得意说这是他花了一整个周末打磨出来的“以后 AI 就不会犯错了”。我看着那份 Skill突然想起了十年前的一件事。那时候我刚做技术主管接手了一个烂摊子项目。前任留下了一份 200 页的操作手册从如何启动开发环境到数据库备份策略事无巨细应有尽有。我当时觉得这家公司太规范了捡到宝了。入职第三个月线上出了一个事故。我翻遍了那 200 页手册没有答案。后来是一个干了六年的老运维叼着烟看了一眼报错日志说了句哦这个啊把那个配置改成 false 就行了。三分钟搞定。那个瞬间我明白了一件事。那 200 页手册里真正有用的东西其实不超过十页。其余一百九十页都是正确的废话——写的人图个安心看的人图个心理安慰但对真正解决问题毫无用处。而现在我看着公司里一群人疯狂写 Skills那种熟悉的荒诞感又回来了。我先把话说在前面。我不是反对 Skills。正相反我们团队可能是国内最早一批在生产环境里大规模用 Skills 的。我自己也写也维护也踩坑。但问题在于大多数人在用写 GPT-3.5 时代经验的方式来写 2026 年的 Skill。这是完全搞错了对象。你问一个 2026 年 7 月的主流模型——GLM-5.2、Claude Opus 4.8、GPT-5.5、DeepSeek V4 Pro——“怎么解析 PDF”、“怎么写 React 组件”、“SQL 注入怎么防”它不需要任何 Skill 就能答得比你详细。根据最近的数据Claude Opus 4.8 在 SWE-bench 上达到了 69% 到 80% 以上DeepSeek V4 Pro 在 LiveCodeBench 上达到了 93.5%。这些模型的知识储备早就不是瓶颈了。Skill 真正需要解决的只有四个问题什么时候触发、按谁的规矩来、用什么工具按什么顺序、什么不能做。其他的全是冗余。但现在的现实是很多人写的 Skill正好反过来。不该写的写了一堆该写的没写清楚。我见过最离谱的几个案例有人在一个 PDF 解析 Skill 里花了 300 字解释 PDF 文件结构是什么、Header 和 Body 怎么区分、常用的 Python 库有哪几个。模型知道这些。你写进去除了浪费 context window唯一的作用就是让你自己觉得我写得真详细。还有人喜欢写正确的废话——“注意代码质量”“遵循最佳实践”“写出优雅的代码”。这就像你跟一个高级工程师说你要写好代码哦。说了等于没说反而稀释了真正重要的指令。更典型的是一种叫事无巨细的步骤分解——“首先你要创建文件然后你要写入内容接着你要检查是否存在”。这种手把手的东西适合 GPT-3.5 时代。对 2026 年的模型来说它不仅没用还有害——它限制了模型根据实际情况灵活调整的能力。还有一种我称之为超级全能 Skill的东西。一个 Skill 里管 PDF 解析、Excel 生成、Word 文档、图片处理、邮件发送——触发条件模糊行为约束冲突最后什么都没约束住。而最可怕的是那些永远不更新、永远不废弃的 Skill。项目规范变了、工具升级了、模型换代了但 Skill 还躺在那里写着两年前的旧约定。过时的 Skill比没有 Skill 更危险。为什么长 Skill 会出问题其实不是什么玄学。三年前Stanford 和 UC Berkeley 发了一篇论文叫《Lost in the Middle》——翻译过来就是丢在中间。他们发现语言模型在处理长文本时有个很诡异的特性对开头和结尾的信息记得特别清楚对中间的信息严重遗忘。就像一个 U 形曲线——两头高中间塌下去。后来越来越多的研究证实了这件事。2024 年 MIT 和 Google 找到了根因模型的注意力机制天然偏向开头和结尾这不是 bug是数学结构决定的。2026 年普林斯顿大学的最新测试更吓人——在超长上下文中中间 40% 篇幅的信息召回率只有首尾段的 23%。这意味着什么你写了一个 3000 字的 Skill塞进了系统提示词里。对话刚开始的时候它还在开头位置模型还能看到。但随着对话越来越长——五轮、十轮、二十轮——你的 Skill 被越来越深地推进了中间地带。然后它就开始消失了。不是真的消失是模型的注意力已经不在它身上了。不仅如此当多个长 Skill 同时加载时注意力被进一步稀释。就像一个经理同时管三十个人——人数越多每个人分到的关注就越少。一个 3000 token 的长 Skill在长对话中的有效遵循率会跌到只有 10%。你辛辛苦苦写了一个周末的东西模型只看到了十分之一。而一个 300 字的 Checklist同样的场景下遵循率是它的五倍。这就引出了我想说的核心。Skill 真正的未来形态不是操作手册而是Checklist。这两个东西的区别不止是长度。它们的底层假设完全不同。操作手册的假设是你不会做我需要手把手教你。Checklist 的假设是你会做我只是提醒你别忘了关键点。对 2026 年的模型来说第一个假设已经过时了。你不需要教一个高级工程师怎么写代码你只需要提醒他这个项目的命名用 camelCaseAPI 返回格式是{ code, data, msg }删文件之前必须确认。就这些。没了。我给你看一个具体的对比。这是我见过的一个典型的手册型 Skill大概 1200 字“PDF 是由 Adobe 公司开发的文档格式……PDF 的结构包括 Header、Body……常用 Python 库有 pdfplumber……首先确认文件路径……然后打开文件……检查是否加密……逐页提取……注意代码质量……确保可读性……处理异常……”而同样的功能改成 Checklist180 字就够了“触发条件用户要求解析 PDF。约束文件路径必须由用户提供加密文件必须询问密码表格用 extract_tables 不用 extract_text中文指定 encodingutf-8超过 50 页分批处理。输出文件路径 页数 摘要。”删掉了什么PDF 格式原理模型知道、Python 库介绍模型知道、“注意代码质量”正确的废话、详细步骤分解模型自己会规划。保留了什么什么时候触发、哪几条规则不能违反、输出长什么样。这就是 Checklist——只保留模型无法自行推断的关键信息。这个结论背后其实是一个更大的趋势。过去三年模型能力的变化完全改变了 Skill 的定位。2023 年 GPT-3.5 时代模型弱需要手把手教Skill 像操作手册。2024 年 GPT-4 和 Claude 3 时代模型开始能自己规划Skill 可以精简到关键约束。2025 年推理模型时代模型能深度推理和编排工具Skill 只需要触发条件和核心约定。到了现在2026 年GLM-5.2、Claude Opus 4.8、GPT-5.5、DeepSeek V4 Pro 这些模型在大多数场景下已经不需要你教了。Skill 的价值从指导完全变成了约束。模型越强Skill 越短。这是一个不可逆的趋势。如果你是团队的管理者或者你正在公司里推行 Skills 体系我有几个很具体的建议第一先问需不需要再问怎么写。大部分场景其实不需要 Skill。模型已经很聪明了别给它加多余的枷锁。第二写 Skill 的人必须是一线实践者。脱离一线的人写的 Skill大概率是正确的废话。只有天天用模型干活的人才知道模型在哪里会犯错、哪里需要约束。第三用对比实验验证。同一个任务有 Skill 和无 Skill 各跑十次对比成功率和输出质量。没有显著提升的直接废弃。第四定期做减法。每季度审查一次所有 Skills问自己这个 Skill 删了会怎样如果答案是没影响那就删了。第五警惕Skill 工程师这个角色的出现。如果公司开始设专人大量产出 Skill这几乎一定是过度工程。Skill 应该是实践的副产品不是专门的产出物。说到工具我自己团队现在主要在用的是 TRAE。选择它的原因很简单——它的内置 Skills 就是精简的web-dev、pdf、xlsx每个都是触发明确、约束精准、不废话。以平均 400 token 的长度在长上下文下保持 50% 的有效遵循率是主流工具里表现最好的。而且它把 Skill 和 MCP 分开了——MCP 负责能力扩展Skill 负责行为约束。各司其职互不混淆。配合 Claude Opus 4.8、GPT-5.5 这些强模型精简 Skill 强模型本身就是最优组合。这就是我想说的。最后回到开头那个故事。十年前那本 200 页的操作手册其实不是被看完的是被忘掉的——每天都有新的问题出现每天都有旧的页面过期最后所有人都只用那十页真正有用的内容剩下的扔在抽屉里接灰。Skills 也一样。当公司里有人开始鼓吹我们要写一百个 Skills的时候你应该问的不是怎么写而是——“这一百个里面有多少是模型本来就会的”删掉那些。剩下的用 Checklist 写。那才是真正有价值的 Skill。以上。如果觉得有用欢迎转发给那个正在写三千字 Skill 的同事。

相关新闻

SkillOpt:微软联合上交同济复旦让技能文档自进化,SpreadsheetBench技能从Codex迁移到Claude Code涨59.7分

SkillOpt:微软联合上交同济复旦让技能文档自进化,SpreadsheetBench技能从Codex迁移到Claude Code涨59.7分

52个测试格,全部最佳或并列最佳。 这不是某家厂商在跑分榜上刷了一个数字,而是微软联合上海交通大学、同济大学和复旦大学做的一件事,把agent技能的训练过程,从「写提示词」变成了「像训练神经网络一样优化文本」。 论文链接&…

2026/8/6 9:05:35 阅读更多 →
电梯编码器信号故障诊断与处理实战指南

电梯编码器信号故障诊断与处理实战指南

1. 电梯启动抖动问题背后的真相电梯启动瞬间的异常抖动一直是维保人员头疼的典型故障。很多同行第一反应就是调整变频器参数,但从业十五年来,我处理过上百例类似案例,真正由参数问题导致的不到三成。更多时候,问题出在那根不起眼的…

2026/8/10 21:43:32 阅读更多 →
HALO框架:企业级AI幻觉检测与分层纠正技术解析

HALO框架:企业级AI幻觉检测与分层纠正技术解析

今天来看一个在企业级AI应用中很有价值的技术方案——HALO(Hallucination-Aware Layered Oversight),这个由微软研究院提出的框架专门解决LLM在关键业务场景中的幻觉问题。如果你在企业环境中部署过AI助手或智能客服系统,应该都遇…

2026/8/10 16:34:28 阅读更多 →

最新新闻

VC++ 6.0在现代Windows系统上的安装、配置与遗留项目维护实战指南

VC++ 6.0在现代Windows系统上的安装、配置与遗留项目维护实战指南

1. 项目概述:为什么今天还要谈VC 6.0?如果你是一位有十年以上经验的C开发者,看到“VC 6.0”这个标题,脑海里可能会立刻浮现出那个经典的蓝色启动界面,以及随之而来的一丝怀旧和一丝“头疼”。Visual C 6.0,…

2026/8/13 1:39:58 阅读更多 →
实战解析:如何高效应用652GB台湾3D建筑模型数据(3DTiles格式)

实战解析:如何高效应用652GB台湾3D建筑模型数据(3DTiles格式)

1. 项目缘起:从“一张白纸”到“立体台湾”的数据挑战最近在做一个智慧城市相关的项目,需要用到高精度的三维建筑模型作为数字孪生的基底。找了一圈国内的公开数据,要么精度不够,要么覆盖不全,要么格式老旧难以直接使用…

2026/8/13 1:39:58 阅读更多 →
MFC图形编程实战:从金刚石图案绘制掌握Windows GDI核心

MFC图形编程实战:从金刚石图案绘制掌握Windows GDI核心

1. 项目概述:从“金刚石图案”到MFC图形编程的实战最近在整理一些老项目,翻到了一个用C和MFC实现“金刚石图案”绘制的程序。这听起来像是一个计算机图形学的经典入门练习,但实际做下来,你会发现它远不止画个图那么简单。它几乎串…

2026/8/13 1:39:58 阅读更多 →
SQL窗口函数实战指南:排名、聚合、导航与分布函数核心应用

SQL窗口函数实战指南:排名、聚合、导航与分布函数核心应用

1. 窗口函数:从“是什么”到“为什么用它”如果你写过SQL,尤其是处理过需要“既看整体,又看局部”的数据分析任务,那你大概率已经和窗口函数打过交道,或者至少听说过它的大名。窗口函数,也叫分析函数&#…

2026/8/13 1:39:58 阅读更多 →
如何用VideoDownloadHelper轻松下载网页视频:3分钟掌握浏览器视频保存技巧

如何用VideoDownloadHelper轻松下载网页视频:3分钟掌握浏览器视频保存技巧

如何用VideoDownloadHelper轻松下载网页视频:3分钟掌握浏览器视频保存技巧 【免费下载链接】VideoDownloadHelper Chrome Extension to Help Download Video for Some Video Sites. 项目地址: https://gitcode.com/gh_mirrors/vi/VideoDownloadHelper 还在为…

2026/8/13 1:39:58 阅读更多 →
2026年随身WiFi实测指南:从5G多网聚合到API管理全解析

2026年随身WiFi实测指南:从5G多网聚合到API管理全解析

这次我们来看一个2026年热门随身WiFi的实测项目。随身WiFi作为移动办公、户外直播、差旅出行的核心网络工具,其性能、稳定性和性价比直接决定了使用体验。这篇文章不聊虚的,直接聚焦于2026年市场上几款主流或新晋的随身WiFi产品,通过实测对比…

2026/8/13 1:38:58 阅读更多 →

日新闻

Visual Studio新建项目解决方案为空:系统性排查与修复指南

Visual Studio新建项目解决方案为空:系统性排查与修复指南

1. 问题现象与本质剖析如果你是一位.NET开发者,或者正准备踏入这个领域,那么Visual Studio(后面简称VS)绝对是你绕不开的伙伴。但有时候,这个伙伴会跟你开一个不大不小的玩笑:你满怀期待地点击“创建新项目…

2026/8/13 0:00:09 阅读更多 →
长春建设厅网站:普通人买房办事必看的真实指南与避坑攻略

长春建设厅网站:普通人买房办事必看的真实指南与避坑攻略

说实话,每次提起“长春建设厅网站”这几个字,我心里都挺有感触的。不是因为它有多高大上,也不是因为那里藏着什么不可告人的秘密,恰恰相反,是因为它太“接地气”了,或者说,它是咱们普通人想要在这个城市好好生活、安稳买房时,必须得翻过的一座“数据山”。很多新朋友第…

2026/8/13 0:00:09 阅读更多 →
Windows家庭版远程桌面多用户破解完整指南:RDPWrap终极解决方案

Windows家庭版远程桌面多用户破解完整指南:RDPWrap终极解决方案

Windows家庭版远程桌面多用户破解完整指南:RDPWrap终极解决方案 【免费下载链接】rdpwrap.ini RDPWrap.ini for RDP Wrapper Library by StasM 项目地址: https://gitcode.com/GitHub_Trending/rd/rdpwrap.ini 你是否曾为Windows家庭版无法支持多用户远程桌面…

2026/8/13 0:00:09 阅读更多 →

周新闻

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁

5分钟告别提取码焦虑:baidupankey如何智能破解百度网盘资源锁 【免费下载链接】baidupankey 在线查询网盘提取码(维护中 rm repo) 项目地址: https://gitcode.com/gh_mirrors/ba/baidupankey 你是否曾经在深夜寻找一份重要资料&#x…

2026/8/12 1:11:09 阅读更多 →
如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南 【免费下载链接】chinese_license_plate_generator 中国车牌生成器 项目地址: https://gitcode.com/gh_mirrors/ch/chinese_license_plate_generator 中国车牌生成器是一个基于Python的开源项目&#xff0c…

2026/8/12 1:11:09 阅读更多 →
收藏!小白程序员轻松入门大模型,从Harness工程开始实践

收藏!小白程序员轻松入门大模型,从Harness工程开始实践

文章强调学习大模型不应只关注模型本身,而应重视模型外的系统搭建,即Harness。提出AgentModelHarness的实用公式,详细介绍Harness的四个层次:持久化层、执行层、控制层和观察与验证层。文章还探讨了上下文工程、工具设计、AGENTS.…

2026/8/12 1:11:08 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/11 17:09:45 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/12 1:11:10 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/11 17:09:45 阅读更多 →