智能体技能属于模块化、可复用的指令集合,使智能体能够使用预先定义的工具、工作流和 API 执行各类专业任务。 任务范围涵盖数据检索、路由优化、代码生成等。
自主智能体具备推理、规划和响应处理的能力,但想要在各类专业 AI 领域中稳定可靠地完成执行动作,就必须依托对应的智能体技能。 智能体技能确切定义了智能体应该如何处理特定任务:使用哪些工具、遵循哪些步骤以及需要遵守哪些约束条件。
智能体技能通常打包为结构化文本文件。 agentskills.io 开放规范定义了 SKILL.md 格式,该格式具备可移植性、易人工阅读的特性,文件包含以下内容:
技能可搭配配套说明文档 (例如技能卡),文档中会注明归属负责人、已知风险、功能限制,以及所有已完成的审核与核验相关信息。
当用户或编排系统分配任务时,智能体会将该任务匹配至可用技能,并依照预设工作流执行操作。技能是独立且可移植的,因此同一文件可在各类 AI 编码助手、多智能体框架和企业平台运行使用。这消除了重复开发的问题并简化了维护。
然后,技能通过注册表和目录 (例如 GitHub NVIDIA/skills、Skills.sh、ClawHub 和 Hugging Face) 分发,团队可在这些平台完成技能的检索、安装、版本控制和安全审计工作。这套机制以管理软件程序库同等严苛的标准,管控智能体的各项能力。最后,根据基准测试任务评估技能,以此确认这些技能能够优化智能体在目标任务下的运行表现。
黄仁勋解释了智能体的搭建架构:以模型为大脑,调度框架为躯体,工具和技能负责实际执行动作,运行时则如同工坊,统筹所有组件并使其协同运转成一套完整体系。
NVIDIA 验证的技能均附带独立签名,使用者可在安装前核验文件归属方身份和完整性。
企业级 AI 部署必须满足可审计性、可复现性与治理管控要求。智能体技能提供了一套结构化、文档化的方案用以扩展智能体能力,能够清晰标注每项能力的作用、来源以及合规达标情况,为安全、规范地大规模部署智能体打下坚实基础。
图 1. 智能体技能如何获得 NVIDIA 验证
快速链接
无论是在何处,只要 AI 智能体需要执行可重复的专业工作,智能体技能可应用于各种业务工作流和行业。
为了在更多用例中扩展智能体部署,专用技能允许每个智能体精确适合其领域,而无需增长其核心指令集或造成维护复杂性。
快速链接
NVIDIA 发布了针对 NVIDIA CUDA-X™ 库、AI Blueprint 和平台工具的经过验证的智能体技能目录,旨在为开发者提供可信、即用的能力,利用 NVIDIA 加速计算扩展智能体。经由 NVIDIA 认证的技能在发布前均会完成安全风险扫描,通过加密签名核验真伪,并配套技能卡片,记录权属信息、依赖组件以及验证状态。
| 智能体技术或领域 | 它的作用 | 可用技术 |
|---|---|---|
| 智能体专业化和优化 | 利用 NVIDIA NeMo 开放库,实现合成数据生成和数据管理、评估、定制和安全的智能体技能。 | NeMo Platform、NeMo Evaluator、NeMo Data Designer |
| 语音赋能 | 用于构建语音支持的智能体工作流的智能体技能,包括实时转录、多语言翻译和文本转语音合成。 有了这些技能,智能体就能听得懂、说得出、还能实时翻译,把语音变成了管线里的核心数据交流通道。 | Nemotron 语音技能 |
| 信息检索 | 面向开发者提供智能体技能套件,用于搭建并优化企业级智能体的检索工作流,包括创建可搜索的索引、检索相关上下文,以及对嵌入和重排序模型进行微调,以获得更准确、依据更充分的应答内容。 |
NVIDIA NeMo Retriever 技能 |
| 面向企业的智能体智能 | 面向开发者打造的智能体技能,支持企业级智能体快速进行内部知识推理,并安全接入合规授权工具与数据源,无需重构现有工作流。 | NVIDIA AI-Q Blueprint 技能 |
| 决策优化 | 用于将复杂的车辆路由、调度和数值优化问题转化为结构化数学参数和公式的智能体技能,提供加速的决策智能。 | NVIDIA cuOpt 技能 |
| 视频 AI 智能体 | 对于视频智能和自动化视觉检查,智能体技能可协助团队生成合成训练数据、微调视觉模型,同时搭建并运维视频 AI 智能体,对实时视频与存档录像完成检索、摘要提炼及内容分析工作。 | NVIDIA Metropolis VSS 技能 NVIDIA 物理 AI 数据工厂 NVIDIA TAO 视觉模型微调 NVIDIA DeepStream |
| 机器人仿真和工作流编排 | 用于构建和扩展机器人仿真工作流的智能体技能,从虚拟环境重建、机器人操控、物理与传感器仿真、合成训练数据生成、任务负载编排,以及在部署前的结果核验工作。 |
所有 NVIDIA Isaac Sim™ Skills PAI 视频增强缺陷 图像生成 设置用于合成数据生成传感器 仿真和视频渲染的基础设施 Isaac 移动性技能 利用 Osmo 神经重建大规模编排机器人 开发工作流 |
| AI 安全护栏 | 这类智能体技能用于为 AI 应用与智能体工作流增设安全管控能力,帮助开发者创建安全护栏,将自然语言描述的安全要求转换为定制策略,校验提示词和响应,并在内容被处理、输出或下游路由之前强制执行策略。 | NVIDIA 定制策略生成器技能 NVIDIA NeMo Guardrails 技能 |
AI 模型是推理引擎——它处理输入并生成输出。 AI 工具是一种特定的可调用的功能,例如 Web 搜索或数据库查询,作用是拓展模型能够执行操作的对象范围。
智能体技能是一组更高级别的指令集,教会智能体如何通过以定义的顺序协调一个或多个工具,以及工作流逻辑、访问要求和治理元数据,来实现目标。 将模型视为引擎,各类工具是引擎能够操控的独立操作杆,而技能则是一套标准化执行方案,保障任务稳定、可靠地完成。
AI 模型是处理输入、生成输出的推理引擎。 智能体技能则给出指令,指导模型在给定上下文中进行操作。 将模型视为推理引擎,将技能视为结构化的领域专业知识——这两者都是可靠、专业的任务执行所必需的。
大多数 AI 智能体工具支持技能,方法是将智能体指向本地或远程 SKILL.md 文件,或通过一条命令从注册服务器安装技能(例如:claude mcp add github.com/nvidia/skills/cuopt)。
安装后,智能体会读取技能说明,并在任务与技能的触发标准匹配时自动调用。 通常无需额外的配置。
是的依照 agentskills.io 这类开放规范所开发的技能,具备跨平台可移植特性,能够兼容各类 AI 代码助手、多智能体框架以及企业级平台。同一份技能文件无需修改,即可在各类环境中稳定正常运行。
一项经过验证的技能已经过安全风险审查,该技能已由其发布者通过加密签名,并与记录所有权、依赖项、局限性和验证状态的技能卡配对。 验证使开发者能够在安装之前确认技能是真实的、自发布以来未经修改的,并且可以安全地在其环境中运行。
技能卡是一个机器可读的文档,与已发布的智能体技能相结合,总结了其信任和治理元数据:谁构建了它、它的功能、它访问的工具和 APIs、已知限制、许可证,以及它是否通过了安全扫描或质量评估。技能卡帮助开发者和企业团队审计、批准和跟踪技能。
查看 github.com/NVIDIA/Trustworthy-AI 公开发布的 NVIDIA Skills Card 架构。
开发者可以使用开源、经过 NVIDIA 验证的智能体技能。
从开放模型到用于开发工作流的智能体技能,NVIDIA Agent Toolkit 能够帮助企业完成应用定制化开发与全流程管控。
了解生命科学智能体时代的专属工具与配套技能