一个AI Agent能做什么,取决于它能调用什么工具。Hermes Agent内置40+工具覆盖Web搜索(使用率62%)、系统Shell(28%)、记忆技能(41%)、视觉多模态(33%),并通过MCP协议连接6000+扩展工具。更关键的是107+可沉淀技能——从代码审查到技术写作,从SEO监控到定时日报。本文全面解析Hermes的工具调用能力图谱。
工具调用能力全景
Hermes Agent目前拥有107+个技能和40+个内置工具,形成了覆盖开发、创作、研究、运维、媒体五大领域的完整能力图谱。
与传统Agent框架对比:传统框架功能清单堆砌、单次调用简单链式;Hermes Agent支持多步规划、工具编排、状态管理,Skill由Agent自动创建和自改进。
40+内置工具分类详解
Web搜索与抓取(8个工具,使用率62%)
核心工具包括browser.navigate(网页导航)、web.search(网络搜索,使用率48%)。支持17个搜索引擎集成的multi-search-engine技能,Tavily API网络搜索。典型场景:实时信息检索、竞品分析、SEO监控。
系统/Shell(6个工具,使用率28%)
核心工具shell.exec(执行Shell命令)。典型场景:自动化脚本执行、系统运维、文件操作。安全建议:生产环境建议通过工具级隔离禁用或限制shell.exec。
记忆与技能(4个工具,使用率41%)
核心工具memory.save(保存记忆)。支撑三层记忆架构:会话记忆(短期)、持久记忆(长期MEMORY.md)、Skill记忆(程序性自动沉淀)。典型场景:跨会话用户画像、偏好学习、技能自动创建。
视觉与多模态(5个工具,使用率33%)
核心工具vision.analyze(图像分析)。典型场景:截图校验、UI测试、OCR识别、架构图理解。与browser工具配合实现自动化UI测试。
MCP扩展(6000+工具)
Model Context Protocol集成,支持6000+社区工具。管理命令:`hermes mcp add my-server --command "npx -y @some/mcp-server"`、`hermes mcp list`、`hermes mcp test my-server`、`hermes mcp configure my-server`。
107+技能体系
开发效率类
systematic-debugging——四阶段根因调试法,推荐指数☆☆☆☆☆。github-pr-workflow——GitHub PR全流程自动化,☆☆☆☆☆。github-code-review——PR代码审查,☆☆☆☆☆。writing-plans——写实现计划拆分大任务,☆☆☆☆☆。codebase-inspection——代码库分析,☆☆☆。
内容创作类
humanizer——去除AI写作痕迹,☆☆☆☆☆。tech-article-writing——技术文章写作,☆☆☆☆☆。architecture-diagram——SVG架构图生成,☆☆☆☆。baoyu-image-gen——AI图片生成,☆☆☆☆。baoyu-slide-deck——PPT图片生成,☆☆☆☆。
研究与信息收集类
tavily-search——Tavily API网络搜索,☆☆☆☆☆。multi-search-engine——17个搜索引擎集成,☆☆☆☆。arxiv——arXiv论文搜索,☆☆☆☆。tech-repo-research——GitHub仓库研究,☆☆☆☆。youtube-content——YouTube转录摘要,☆☆☆。
自动化与运维类
hermes-agent——自身配置指南,☆☆☆☆☆。self-improvement——自我改进工作流,☆☆☆☆☆。openclaw-auto-updater——定时自动更新,☆☆☆☆。kanban-worker——Kanban工作流,☆☆☆。webhook-subscriptions——Webhook订阅,☆☆☆。
工具与技能的管理实践
工具集管理
交互式管理:`hermes tools`进入管理界面。启用/禁用工具集:`hermes tools enable web`、`hermes tools disable browser`。精细控制不同Profile可配置不同工具集。
技能管理
查看已安装技能:`hermes skills list | grep my-skill`。配置技能:`hermes skills config /skill my-skill`。归档技能:`hermes skills archive my-skill`。技能采用渐进式加载——先通过skills_list()看到元数据,再skill_view(name)按需加载完整内容。
工具调用的实战场景
场景1——SEO监控自动化
Cron触发→browser抓取→vision校验→memory对比→Slack推送。每天9:00执行10个关键词,截图防反爬,对比昨日数据diff,异常告警。首次执行后Hermes沉淀skill:seo_daily_check,后续直接命中。
场景2——技术文章写作
预加载tavily-search、tech-article-writing、humanizer三个技能。搜索素材→撰写文章→去AI味润色→保存到指定目录。工具链:web.search获取资料→shell.exec创建文件→memory.save记录位置。
场景3——多Agent协作
Kanban看板实现工具调用编排:创建任务卡片分配给不同Profile→设置依赖关系→跟踪状态→多个Agent并行工作。扇出+扇入模式:N个研究任务并行→1个综合任务汇总。
模型切换与成本优化
Hermes模型无关,兼容200+模型,随时切换无需改代码:
模型切换成本对比| 模型组合 | 单任务成本 | 平均耗时 | 适用场景 |
|---|
| Claude Sonnet 4.6 | $0.45 | 28s | 复杂推理/长任务 |
| GPT-4o-mini | $0.12 | 19s | 日常自动化 |
| Kimi K2 / GLM-4 | ~$0.08 | 24s | 中文场景首选 |
| 本地 Qwen3-32B | $0.004 | 42s | 完全离线/隐私场景 |
工具调用与模型选择可解耦:复杂推理用Claude Sonnet,日常自动化用GPT-4o-mini,中文场景用Kimi/GLM,隐私场景用本地Qwen。