Skill
PulseAugur coverage of Skill — every cluster mentioning Skill across labs, papers, and developer communities, ranked by signal.
9 天有情绪数据
-
支付宝AI助手“小政”优化婚姻登记服务
支付宝AI助手“小政”上线婚姻登记新服务,利用其MCP能力对接全国十省市官方服务渠道。该举措旨在通过对话式AI,让用户能够预约、查询政策、查找登记地点,从而简化婚姻登记流程。目前,“小政”已协助100多家政务机构办理超过16000项服务事项,并正拓展至特定公共服务场景。
-
新型 LLM 代理 SKILL 采用多模型方法优化逻辑综合
研究人员开发了 SKILL,这是一种利用多个大型语言模型和强化学习来优化逻辑综合的新型代理。该系统采用 GPT-4o 进行战略规划,Claude Sonnet 4 进行详细推理,以及 Gemini 2.5 Pro 和基于 PPO 的 RL 代理与综合工具进行交互。SKILL 包含一个自纠正模块来监控反馈并实施恢复策略,在基准测试中比现有的专家流程提高了 12.4%。
-
Cursor Learn Mode 开源,用于教授桌面工作流
一款名为 Cursor Learn Mode 的开源工具已发布,旨在通过记录用户操作来教授桌面工作流。该工具兼容 Windows 和 macOS,可以捕获演示过程并将其保存为可重放的“技能”。记录的操作不会由工具本身执行,并且在此过程中会进行敏感信息 redaction。
-
HarmonyOS 通过 AI 驱动的“服务厨房”简化开发
HarmonyOS 正通过一种新的“服务厨房”方法来增强其开发者体验,利用原子服务跨框架 (ASCF) 允许开发者重用来自小程序等其他平台的现有代码。该框架结合了 AI 驱动的 HarmonyOS 开发助手,旨在简化开发流程、降低成本并加速交付。该平台还引入了用于模块化、即插即用功能的 Skill 能力,以及面向小型企业的 AI 驱动的零代码开发,使他们能够通过自然语言描述来创建服务。
-
新框架改进了长SKILL文档的AI合规性检测
研究人员开发了SkillCDG,一个新颖的基于图的框架,旨在提高企业代理系统中长SKILL文档合规性检测的效率和准确性。该框架将业务策略表示为两层约束依赖图,从而实现更快的路由和详细的依赖分析。SkillCDG已证明其性能优于现有方法,检测F1分数最高可提高12.8个百分点,同时显著减少了高达64.3%的token消耗。研究还强调了一个扩展趋势,即模型性能与策略图的复杂性相关,这表明自适应训练策略可以增强小型模型的能力。
-
企业AI落地:利用DESIGN.md和SKILL赋能设计体系
本文探讨了如何在企业环境中利用DESIGN.md和SKILL来增强AI时代设计体系的影响力。旨在分享实际落地策略和真实应用中的经验教训。
-
据报道,GPT 5.6 Luna将通过新的Agent Plugins提供给免费ChatGPT用户
一项新的人工智能开发GPT 5.6 Luna据称可供ChatGPT网页版的免费用户无限制使用。这项进展包括引入Agent Plugins,它结合了Skill和MCP的功能。该消息通过Mastodon帖子发布。
-
Claude Code技能面临描述限制,影响AI选择工具的能力
Claude Code是Anthropic的Claude AI中的一项功能,其技能的描述文本处理能力有限。存在两个主要限制:每个技能的描述限制为1,536个字符,以及所有技能的总预算,占模型上下文窗口的1%。当超过这些限制时,Claude Code会悄悄地删除描述,从使用频率最低的技能开始,从而使AI更难选择它们。用户可以使用/doctor和/context等命令诊断这些问题,并通过修剪描述、通过`skillOverrides`将技能…
-
AI通过DeltaChat和Webxdc集成增强国际象棋游戏玩法
用户正在探索将AI集成到他们的国际象棋游戏中,特别是使用DeltaChat和Webxdc等工具。他们正在通过逆向工程chatmail和客户端功能来提高他们的国际象棋技能。
-
AI 代理在处理工具噪音时遇到困难,导致成本增加和混乱
文章讨论了 AI 代理工具链中上下文膨胀的问题,过多的工具信息会压倒语言模型并增加 token 成本。文章指出,像 Google Calendar 的 events.list 这样的工具暴露了许多属性,其中大部分对于简单查询来说是不相关的。作者认为这种“模式噪音”会混淆模型并浪费计算资源,主张采用更有效的方法来管理工具的相关性。
-
公交代理实验者在 MCP 工具失败后撤销了 SKILL 层
一位实验者在使用基于 MCP 框架构建的公交代理时遇到了问题。在引入 SKILL 层来管理 MCP 工具使用后,代理开始倾向于使用网络搜索而非 MCP 工具,导致实时公交信息不准确。实验者撤销了更改,以更精简的形式重新引入了 SKILL 层,并恢复了可靠的 MCP 工具使用,尽管某些边缘情况仍需完善。
-
Apidog 通过新的 CLI 和 SKILL 增强 API 开发,以应对复杂工作流
Apidog 开发了新的命令行界面 (CLI) 和 SKILL 系统来补充其现有的 MCP 工具,旨在处理更复杂的 API 开发工作流。MCP 擅长标准化工具连接以完成简单任务,而新的 CLI + SKILL 则专为涉及验证、读回和执行确认的多步研发流程而设计。这个增强的 CLI 允许 AI Agent 与 API 资产进行交互,创建或更新测试集,在写入前验证更改,并确认执行结果,从而将复杂性从 AI 模型转移到工程系统。
-
使用可重用的“技能”可以使 AI 代理更具可扩展性和可维护性
本文提出了一种构建 AI 代理的新方法,即将它们的行为打包成可重用的“技能”,而不是依赖于庞大、单一的提示词。一个技能封装了特定的功能,例如审查简历或提供水族馆建议,以及指令、示例和安全边界。这种关注点分离,其中技能处理可重用行为,用户记忆存储上下文特定信息,旨在使 AI 代理对于重复性任务更具可维护性、可扩展性和适应性。
-
微软报告:员工已准备好迎接AI,但公司落后 · 追踪2个来源
微软最新报告显示,尽管员工已准备好在职场拥抱AI,但许多组织和领导者却落后于形势。该报告基于对2万名AI用户进行的调查以及对Microsoft 365数据的分析,发现58%的AI用户正在完成以前不可能完成的工作,而在中国这一比例上升至72%。然而,只有26%的员工认为其领导层对AI的理解与他们自己一致。微软强调,成功的AI整合需要将其视为一种组织能力,而不仅仅是一个技术工具,组织环境比个人心态更能驱动AI的价值。
-
AI技能设计模式与评估框架详解
本系列文章介绍了创建可预测、高质量AI技能的设计模式。第一篇文章详细介绍了五种核心模式:单一职责、契约驱动、渐进增强、可观察设计和防御性输出。这些模式旨在确保AI技能可靠地执行单一任务,具有明确定义的输入和输出,能够优雅地处理不完整信息,提供流程透明度,并标记不确定的信息以确保用户安全。第二篇文章侧重于评估AI技能,提出了一个双层框架,评估触发器准确性(技能是否被正确调用)和任务完成质量。它概述了触发器评估的指标,如召回率和精确率,并…
-
AI 代理:会议见解与 API 集成策略
来自 Habr 的两篇文章讨论了 AI 代理的开发和应用。第一篇涵盖了 OpenTalks.AI 2026 会议,重点关注实际的机器学习应用和 AI 平台管理。第二篇文章比较了 MCP 和 CLI + Skill 两种将 AI 代理与内部 API 集成的方法,通过基准测试分析资源效率和性能。
-
Kouzi 3.0 推出,助力内容创作者
Kouzi 3.0 已正式上线,为内容创作者提供从构思到发布后分析的全方位工作流程管理工具。该平台支持跨设备协作,让创作者能够无缝地在 PC 和移动设备上进行选题、内容创作、审核和分析等任务。新版本旨在简化内容创作者的日常运营。
-
Skill 库将 AI 提示词视为可重用对象
Skill 库引入了一种将 AI 提示词视为可重用对象的方法,类似于参数化 SQL 查询。这种方法将提示词模板与应用程序逻辑分离,从而无需更改核心代码即可轻松进行测试、版本控制和模型替换。开发人员可以定义一个单一的提示词结构,并在 Anthropic、OpenAI 和 Google 等提供商的不同 AI 模型上执行它,从而实现高效的模型更新和成本优化。
-
LivinGrimoire AI 模式使用提示工程进行模块化技能创建
LivinGrimoire 软件设计模式采用模块化 AI 引擎架构,其中独立的“技能”类定义特定行为。这些技能可以通过提示工程方法按需生成,允许用户用一行描述所需技能,并获得即插即用的 Python 代码片段。该模式概述了一种特定架构,包含用于逻辑、硬件、输入和传感器的不同“叶瓣”,以及触发输出、技能间通信和持久化的方法。
-
DeepSeek V4 首发适配落后:昇腾为何坚持不做 CUDA 兼容层?
华为的昇腾 AI 加速器正在开辟一条独特的道路,通过摒弃 CUDA 兼容性来构建独立的生态系统。该战略侧重于其最新的昇腾 950 芯片的深度架构更改,以满足大型模型不断变化的需求,例如改进的内存访问和低精度计算。通过开发自己的虚拟指令集、编译器和运行时,昇腾旨在实现自给自足,同时与主流框架保持一致以方便开发者。