MLOps · 训练Hermes Agent
distributed-llm-pretraining-torchtitan
使用 torchtitan 提供原生 PyTorch 分布式 LLM 预训练,支持 4D 并行(FSDP2、TP、PP、CP)。适用于在 8 到 512+ GPU 上大规模预训练 Llama 3.1、DeepSeek V3 或自定义模型,支持 Float8、torch.compile 和分布式检查点。
适合使用 torchtitan 提供原生 PyTorch 分布式 LLM 预训练,支持 4D 并行(FSDP2、TP、PP、CP)。适用于在 8 到 512+ GPU 上大规模预训练 Llama 3.1、DeepSeek V3 或自定义模型,支持 Float8、torch.compile 和分布式检查点。
软件开发Hermes Agent
code-review
执行全面代码审查的指南,重点关注安全性和质量
适合执行全面代码审查的指南,重点关注安全性和质量
Apple 系统Hermes Agent
imessage
通过 macOS 上的 imsg CLI 发送和接收 iMessage/SMS。
适合通过 macOS 上的 imsg CLI 发送和接收 iMessage/SMS。
MLOps · 评测Hermes Agent
evaluating-llms-harness
在 60 多个学术基准(MMLU、HumanEval、GSM8K、TruthfulQA、HellaSwag)上评估大语言模型。用于模型质量基准测试、模型对比、报告学术结果或追踪训练进度。EleutherAI、HuggingFace 和主要研究实验室广泛采用的行业标准。支持……
适合在 60 多个学术基准(MMLU、HumanEval、GSM8K、TruthfulQA、HellaSwag)上评估大语言模型。用于模型质量基准测试、模型对比、报告学术结果或追踪训练进度。EleutherAI、HuggingFace 和主要研究实验室广泛采用的行业标准。支持……
MLOps · 向量库Hermes Agent
chroma
用于 AI 应用的开源嵌入数据库。存储嵌入向量和元数据,执行向量搜索和全文搜索,按元数据过滤。简单的四函数 API。可从笔记本扩展到生产集群。适用于语义搜索、RAG 应用或文档检索。最佳适用于……
适合用于 AI 应用的开源嵌入数据库。存储嵌入向量和元数据,执行向量搜索和全文搜索,按元数据过滤。简单的四函数 API。可从笔记本扩展到生产集群。适用于语义搜索、RAG 应用或文档检索。最佳适用于……
DogfoodHermes Agent
hermes-agent-setup
帮助用户配置 Hermes Agent —— CLI 使用、设置向导、模型/提供方选择、工具、技能、语音/STT/TTS、网关以及故障排除。
适合帮助用户配置 Hermes Agent —— CLI 使用、设置向导、模型/提供方选择、工具、技能、语音/STT/TTS、网关以及故障排除。
MLOps · 推理Hermes Agent
serving-llms-vllm
使用 vLLM 的 PagedAttention 和连续批处理实现高吞吐量大语言模型服务。用于部署生产级大语言模型 API、优化推理延迟/吞吐量,或在 GPU 内存有限的情况下服务模型。支持 OpenAI 兼容端点、量化(GPTQ/AWQ/FP8)、连续批处理、动态批处理等功能……
适合使用 vLLM 的 PagedAttention 和连续批处理实现高吞吐量大语言模型服务。用于部署生产级大语言模型 API、优化推理延迟/吞吐量,或在 GPU 内存有限的情况下服务模型。支持 OpenAI 兼容端点、量化(GPTQ/AWQ/FP8)、连续批处理、动态批处理等功能……
调研Hermes Agent
arxiv
使用 arXiv 的免费 REST API 搜索和检索学术论文。无需 API 密钥。可通过关键词、作者、类别或 ID 进行搜索。可与 `web_extract` 或 `ocr-and-documents` 技能结合,以读取完整论文内容。
适合使用 arXiv 的免费 REST API 搜索和检索学术论文。无需 API 密钥。可通过关键词、作者、类别或 ID 进行搜索。可与 `web_extract` 或 `ocr-and-documents` 技能结合,以读取完整论文内容。
生活Hermes Agent
find-nearby
使用 OpenStreetMap 查找附近地点(餐厅、咖啡馆、酒吧、药房等)。支持坐标、地址、城市、邮编或 Telegram 位置标记。无需 API 密钥。
适合使用 OpenStreetMap 查找附近地点(餐厅、咖啡馆、酒吧、药房等)。支持坐标、地址、城市、邮编或 Telegram 位置标记。无需 API 密钥。
MLOps · 训练Hermes Agent
fine-tuning-with-trl
使用 TRL 进行强化学习微调 LLM - SFT 用于指令调优,DPO 用于偏好对齐,PPO/GRPO 用于奖励优化,以及奖励模型训练。适用于需要 RLHF、对齐模型偏好或从人类反馈中训练的场景。兼容 HuggingFace Tr…
适合使用 TRL 进行强化学习微调 LLM - SFT 用于指令调优,DPO 用于偏好对齐,PPO/GRPO 用于奖励优化,以及奖励模型训练。适用于需要 RLHF、对齐模型偏好或从人类反馈中训练的场景。兼容 HuggingFace Tr…
软件开发Hermes Agent
plan
Hermes 的规划模式 — 检查上下文,在当前工作区/后端工作目录的 `.hermes/plans/` 中编写 Markdown 规划文件,且不执行任何工作。
适合Hermes 的规划模式 — 检查上下文,在当前工作区/后端工作目录的 `.hermes/plans/` 中编写 Markdown 规划文件,且不执行任何工作。
自主 AgentHermes Agent
claude-code
将编码任务委派给 Claude Code(Anthropic 的 CLI Agent)。适用于构建功能、重构代码、代码审查以及迭代式开发。需要已安装 claude CLI。
适合将编码任务委派给 Claude Code(Anthropic 的 CLI Agent)。适用于构建功能、重构代码、代码审查以及迭代式开发。需要已安装 claude CLI。
MLOps · 评测Hermes Agent
huggingface-tokenizers
针对研究和生产优化的快速分词器。基于 Rust 实现,可在 <20 秒内分词 1GB 数据。支持 BPE、WordPiece 和 Unigram 算法。可训练自定义词汇表,追踪对齐关系,处理填充/截断。与 transformers 无缝集成。用于……
适合针对研究和生产优化的快速分词器。基于 Rust 实现,可在 <20 秒内分词 1GB 数据。支持 BPE、WordPiece 和 Unigram 算法。可训练自定义词汇表,追踪对齐关系,处理填充/截断。与 transformers 无缝集成。用于……
MLOps · 向量库Hermes Agent
faiss
Facebook 开发的高效相似性搜索与密集向量聚类库。支持数十亿向量,支持 GPU 加速,提供多种索引类型(Flat、IVF、HNSW)。适用于快速 k-NN 搜索、大规模向量检索,或需要纯相似性搜索而无需……
适合Facebook 开发的高效相似性搜索与密集向量聚类库。支持数十亿向量,支持 GPU 加速,提供多种索引类型(Flat、IVF、HNSW)。适用于快速 k-NN 搜索、大规模向量检索,或需要纯相似性搜索而无需……
邮件Hermes Agent
himalaya
通过 IMAP/SMTP 管理电子邮件的 CLI 工具。使用 himalaya 列出、阅读、撰写、回复、转发、搜索和整理电子邮件。支持多个账户,并可通过 MML(MIME 元语言)进行消息编写。
适合通过 IMAP/SMTP 管理电子邮件的 CLI 工具。使用 himalaya 列出、阅读、撰写、回复、转发、搜索和整理电子邮件。支持多个账户,并可通过 MML(MIME 元语言)进行消息编写。
MLOps · 推理Hermes Agent
tensorrt-llm
使用 NVIDIA TensorRT 优化大语言模型推理,实现最高吞吐量和最低延迟。用于在 NVIDIA GPU(A100/H100)上进行生产部署,当您需要比 PyTorch 快 10-100 倍的推理性能,或需要支持量化(FP8/INT4)、飞行中批处理和多模型并发服务时使用……
适合使用 NVIDIA TensorRT 优化大语言模型推理,实现最高吞吐量和最低延迟。用于在 NVIDIA GPU(A100/H100)上进行生产部署,当您需要比 PyTorch 快 10-100 倍的推理性能,或需要支持量化(FP8/INT4)、飞行中批处理和多模型并发服务时使用……
调研Hermes Agent
blogwatcher
使用 blogwatcher CLI 监控博客和 RSS/Atom 订阅源的更新。添加博客、扫描新文章,并跟踪已阅读内容。
适合使用 blogwatcher CLI 监控博客和 RSS/Atom 订阅源的更新。添加博客、扫描新文章,并跟踪已阅读内容。
MCPHermes Agent
mcporter
使用 mcporter CLI 直接列出、配置、认证并调用 MCP 服务器/工具(支持 HTTP 或 stdio),包括临时服务器、配置编辑以及 CLI/类型生成。
适合使用 mcporter CLI 直接列出、配置、认证并调用 MCP 服务器/工具(支持 HTTP 或 stdio),包括临时服务器、配置编辑以及 CLI/类型生成。
MLOps · 训练Hermes Agent
grpo-rl-training
使用 TRL 进行 GRPO/RL 微调的专家指导,适用于推理和任务特定模型训练
适合使用 TRL 进行 GRPO/RL 微调的专家指导,适用于推理和任务特定模型训练
软件开发Hermes Agent
requesting-code-review
在完成任务、实现重大功能或合并前使用。通过系统化审查流程验证工作是否满足要求。
适合在完成任务、实现重大功能或合并前使用。通过系统化审查流程验证工作是否满足要求。
自主 AgentHermes Agent
codex
将编码任务委派给 OpenAI Codex CLI Agent。适用于构建功能、重构代码、代码审查以及批量修复问题。需要已安装 codex CLI 并配置 git 仓库。
适合将编码任务委派给 OpenAI Codex CLI Agent。适用于构建功能、重构代码、代码审查以及批量修复问题。需要已安装 codex CLI 并配置 git 仓库。
MLOps · 评测Hermes Agent
nemo-curator
用于大语言模型训练的 GPU 加速数据整理工具。支持文本/图像/视频/音频。具备模糊去重(快 16 倍)、质量过滤(30+ 启发式规则)、语义去重、PII 信息脱敏、NSFW 检测功能。通过 RAPIDS 在 GPU 上横向扩展。用于准备高质量训练数据……
适合用于大语言模型训练的 GPU 加速数据整理工具。支持文本/图像/视频/音频。具备模糊去重(快 16 倍)、质量过滤(30+ 启发式规则)、语义去重、PII 信息脱敏、NSFW 检测功能。通过 RAPIDS 在 GPU 上横向扩展。用于准备高质量训练数据……
MLOps · 向量库Hermes Agent
pinecone
用于生产级 AI 应用的托管向量数据库。完全托管,自动扩展,支持混合搜索(密集 + 稀疏),元数据过滤和命名空间。延迟极低(p95 <100ms)。适用于生产级 RAG、推荐系统或大规模语义搜索。最适合服务器……
适合用于生产级 AI 应用的托管向量数据库。完全托管,自动扩展,支持混合搜索(密集 + 稀疏),元数据过滤和命名空间。延迟极低(p95 <100ms)。适用于生产级 RAG、推荐系统或大规模语义搜索。最适合服务器……