SKILL.md
PulseAugur coverage of SKILL.md — every cluster mentioning SKILL.md across labs, papers, and developer communities, ranked by signal.
15 天有情绪数据
-
Anthropic 的 Claude Cowork 新增“Record a Skill”功能,实现 AI 工作流自动化
Anthropic 在其 Claude Cowork 应用中推出了一项名为“Record a Skill”的新功能,允许用户通过屏幕录制、语音旁白和交互捕获来演示任务。该功能将这些演示提炼成一个可重用的 SKILL.md 文件,然后 Claude 可以按需执行。这项创新解决了手动创建这些技能文件的难题,使领域专家能够通过展示而非书写指令来更有效地外化他们的知识。
-
Anthropic 发布 Claude Skills API 以实现自定义技能管理
Anthropic 已正式发布 Claude Skills API,允许开发者直接通过 API 创建、版本化和管理自定义技能,而无需自行托管基础设施。此功能现已普遍可用,可使 Claude 在其代码沙箱内运行专业化任务。该 API 简化了技能的上传和版本化流程,自定义技能将获得生成的 ID,而 Anthropic 管理的技能则使用基于日期的版本。
-
开发者创建SkillEval以对LLM代理提示进行单元测试
一位开发者创建了一个名为SkillEval的测试框架,以解决代理技能缺乏严格测试的问题,代理技能本质上是提示而不是传统代码。该工具允许开发者针对定义的提示和固定装置运行代理技能,断言特定的结果,例如工具使用、成本和文件修改。目标是通过提供具体结果,而不是依赖主观评估,为提示开发带来更客观、可验证的标准,类似于代码更改。
-
AI代理技能需要严格测试,不能仅凭一次成功运行
测试AI代理技能需要进行多次尝试,而不仅仅是一次成功的运行,因为一次成功但反复失败的技能比没有技能更糟糕。有效的测试包括评估技能在各种输入下的表现,包括旨在暴露故障模式的对抗性案例。一个健壮的技能应该对正确输出有明确的预期,有一个检查可验证声明而非自我断言的机制,并且在可能改变其行为的基础模型更新后应重新测试。
-
Qwen Code 0.21.11 增加了 Agent Plugins v1 支持,但有注意事项
Qwen Code 版本 0.21.11 引入了对 Agent Plugins v1 的原生支持,允许用户安装和链接这些包,而无需转换其清单文件。然而,并非 Agent Plugin 的所有组件都能保证在 Qwen Code 中运行,因为它主要支持直接子 Agent Skills 和特定的 MCP 服务器类型。建议开发者将此版本视为一个可移植核心版本,并在广泛部署前严格测试兼容性、验证包的完整性并维护项目范围的回滚。
-
AI Agent Skill 加载调试清单揭晓
本文讨论了开发 AI Agent 时遇到的一个特定调试问题,特别是关于 Agent Skill 的加载。作者 Ramdai Bista 强调了一种静默失败模式,即某个 Skill 可能无法正确加载,但没有任何错误消息,这使得诊断变得困难。文章旨在提供一个调试清单,帮助开发者识别和解决此类问题,并引用了名为 SKILL.md 的文件作为故障排除过程的一部分。
-
AI Agent Skills Pose Security Risks, Audit Recommended
文章警告说,代理技能(AI代理使用的代码片段)应被视为不受信任的代码。它建议在安装任何此类技能之前进行三步审计,以减轻安全风险。作者强调了这些技能中嵌入恶意代码的潜在危险,特别是那些与Web请求等外部资源交互的技能。
-
Claude 代码:推荐面向开发者的 6 大技能
一份指南为开发者推荐了六个特定的 Claude 代码技能,强调在每个开发阶段只安装一个技能的重要性,以避免不可预测的行为。选择标准优先考虑官方或广泛使用的插件,而不是社区构建的插件,并建议用户仅在出现特定、重复性任务时添加更多技能。推荐的技能包括用于强制执行开发纪律的“superpowers”(超级能力)、用于构建自定义技能的“skill-creator”(技能创建器)以及用于生成具有特定美学的 UI 的“frontend-desig…
-
Anthropic 的 Claude 将技能上下文限制在 500 行
Anthropic 的 Claude AI 模型存在上下文窗口限制,要求用户将他们的 "Claude Code SKILL.md" 文件保持在 500 行以内。臃肿的技能会消耗整个会话的上下文,影响性能。建议开发者将大型技能拆分成更小的、可引用的组件以提高效率。
-
Claude Code 用户可以禁用模型调用以节省 token
这是对 Claude Code 用户的一项提醒,旨在避免污染他们的默认会话上下文。通过在 `SKILL.md` 文件中设置 `disable-model-invocation: true`,用户可以防止特定技能被包含在他们的 Claude Code 上下文中。此配置可确保该技能作为斜杠命令运行,但不会在每次会话启动时消耗 token。
-
新框架将 AI Agent 架构分为五个层级
AI Agent 的架构可以通过五个不同的层级来理解:Prompt(提示)、Context(上下文)、Loop(循环)、Graph(图)和 Harness(约束)。这个框架通过识别哪个层级对故障负责,帮助开发者诊断和修复问题。Prompt engineering 专注于指令的措辞,而 context engineering 则处理呈现给模型的信息的选择和管理。Loop 层级控制 Agent 的执行时序,Graph 层级管理不同工作单元…
-
构建回归测试夹具以测试代理技能的安全性
本文提出了一种在将第三方代理技能集成到系统中之前测试其安全性的方法。作者建议创建一个回归测试夹具,在受控环境中执行技能,以检测未经授权的数据泄露、凭证访问或破坏性命令等恶意活动。提出的夹具包括正面和负面样本,以及一个“金丝雀”凭证文件,用于确定性地标记任何读取或传输敏感信息的尝试。
-
Anthropic 的 Claude Code 插件强制执行独特的网站设计
Anthropic 发布了 Claude Code 的前端设计插件,旨在防止 AI 生成通用的网站美学。该插件强制执行一个深思熟虑的设计流程,要求 Claude 在编写任何 CSS 之前,首先定义一个独特的视觉标识,包括调色板、排版和标志性元素。然后,该插件会提示 Claude 批评自己的设计选择,以确保它们偏离常见的 AI 生成的默认设置,旨在为用户提供更具特色的网站布局。
-
Claude Code 升级为三层代理系统,权限增强
Claude Code 代理技能存储库的开发者已将其更新为三层系统,并将其重命名为 nasrulhazim/claude。此次升级解决了之前基于技能的方法遇到的限制,特别是在区分代码审查和代码修改方面,并实现了跨多个项目的重复任务的扇出。新结构采用了精简的代理,将技能作为其剧本加载,代理具有定义的工具权限,以防止在审查期间进行代码修改等意外操作。更新包括一个用于无缝升级的安装脚本,并将技能集扩展到 29 个,其中 20 个代理涵盖了软…
-
Claude Code 插件开发揭示命名、执行和文件系统问题
一位开发者在打包其 Claude Code 插件时遇到了三个问题,其中两个问题源于插件名称成为技能调用的前缀以及 CLI 的执行上下文发生变化。修复方法包括使用插件名称显式限定技能调用,并使用 `npx` 来确保执行正确的 CLI 版本。第三个问题是关于 Linux 上命名冲突的广泛流传的警告,但发现这与文件系统边界有关,而非命名约定,是一种误解。
-
Genkit Go 使用 Agent Skills 减少代币成本和上下文膨胀
Genkit Go 推出了 Agent Skills,这是一种旨在减少上下文窗口膨胀和代币成本的模块化方法。此功能利用 SKILL.md 捆绑包将专业功能与主上下文分离,从而实现信息的渐进式揭示。
-
Qwen Code 推出 '/learn' 功能,用于保存 AI 生成的指令
Qwen Code 推出了新的 '/learn' 功能,允许用户将从对话或外部来源获得的特定指令、规则或流程保存到单独的 SKILL.md 文件中。这旨在保留宝贵的知识,例如复杂的存储库分析或迁移规则,而无需重新建立聊天上下文。然而,如果源材料存在缺陷,该功能也存在轻易复制错误或过时信息的风险。
-
AI技能和插件需要“引擎”来行动,而不仅仅是指令
作者认为,AI“技能”和“插件”经常与实际工具混淆,导致AI代理工作流程中的效率低下和“上下文债务”。技能应该指导代理如何使用某个能力,而插件应该打包并提供该能力,需要一个底层的“引擎”或可执行组件来执行操作。随着代理生态系统的扩展,这种区分至关重要,可以防止模型将注意力浪费在理解指令上,而不是执行任务上。
-
SKILL.md:Markdown 文件成为强大、上下文感知型 AI 工具
SKILL.md 文件,本质上是一个 markdown 文档,被强调为一种强大且被低估的工具,用于增强 AI 功能,特别是与 Claude 等模型配合使用。这种格式允许用户将指令、参考资料甚至可执行脚本打包到单个文件中,该文件可以上下文加载,而不是持续存在于模型的提示中。这种方法被认为是一种经济高效且高效的方式,可以在不直接修改模型的情况下,赋予 AI 新技能,例如遵循品牌指南、与 SDK 交互或保持特定的写作风格。
-
Claude 代码:通过将规则移出 CLAUDE.md 来优化 AI 代理指令
作者提出了一种更有效的管理 Claude 等 AI 代理指令的方法,建议 CLAUDE.md 文件应保留用于适用于每次交互的不变规则。其他类型的指导应移至不同位置:情境命令属于“skills”,确定性检查属于“hooks”,参考资料属于“docs”。这种方法旨在通过优化上下文窗口使用和防止规则稀释来降低成本并提高代理指令的有效性。