MLOps · 评测Hermes Agent
evaluating-llms-harness
在 60 多个学术基准(MMLU、HumanEval、GSM8K、TruthfulQA、HellaSwag)上评估大语言模型。用于模型质量基准测试、模型对比、报告学术结果或追踪训练进度。EleutherAI、HuggingFace 和主要研究实验室广泛采用的行业标准。支持……
适合在 60 多个学术基准(MMLU、HumanEval、GSM8K、TruthfulQA、HellaSwag)上评估大语言模型。用于模型质量基准测试、模型对比、报告学术结果或追踪训练进度。EleutherAI、HuggingFace 和主要研究实验室广泛采用的行业标准。支持……
MLOps · 评测Hermes Agent
huggingface-tokenizers
针对研究和生产优化的快速分词器。基于 Rust 实现,可在 <20 秒内分词 1GB 数据。支持 BPE、WordPiece 和 Unigram 算法。可训练自定义词汇表,追踪对齐关系,处理填充/截断。与 transformers 无缝集成。用于……
适合针对研究和生产优化的快速分词器。基于 Rust 实现,可在 <20 秒内分词 1GB 数据。支持 BPE、WordPiece 和 Unigram 算法。可训练自定义词汇表,追踪对齐关系,处理填充/截断。与 transformers 无缝集成。用于……
MLOps · 评测Hermes Agent
nemo-curator
用于大语言模型训练的 GPU 加速数据整理工具。支持文本/图像/视频/音频。具备模糊去重(快 16 倍)、质量过滤(30+ 启发式规则)、语义去重、PII 信息脱敏、NSFW 检测功能。通过 RAPIDS 在 GPU 上横向扩展。用于准备高质量训练数据……
适合用于大语言模型训练的 GPU 加速数据整理工具。支持文本/图像/视频/音频。具备模糊去重(快 16 倍)、质量过滤(30+ 启发式规则)、语义去重、PII 信息脱敏、NSFW 检测功能。通过 RAPIDS 在 GPU 上横向扩展。用于准备高质量训练数据……
MLOps · 评测Hermes Agent
sparse-autoencoder-training
提供使用 SAELens 训练和分析稀疏自编码器(SAE)的指导,将神经网络激活分解为可解释特征。用于发现可解释特征、分析超叠加现象,或研究语言模型中的单义表示……
适合提供使用 SAELens 训练和分析稀疏自编码器(SAE)的指导,将神经网络激活分解为可解释特征。用于发现可解释特征、分析超叠加现象,或研究语言模型中的单义表示……
MLOps · 评测Hermes Agent
weights-and-biases
使用自动日志记录追踪机器学习实验,实时可视化训练过程,通过实验扫描优化超参数,并使用 W&B 管理模型注册表——协作式 MLOps 平台
适合使用自动日志记录追踪机器学习实验,实时可视化训练过程,通过实验扫描优化超参数,并使用 W&B 管理模型注册表——协作式 MLOps 平台