serving-llms-vllm
使用 vLLM 的 PagedAttention 和连续批处理实现高吞吐量大语言模型服务。用于部署生产级大语言模型 API、优化推理延迟/吞吐量,或在 GPU 内存有限的情况下服务模型。支持 OpenAI 兼容端点、量化(GPTQ/AWQ/FP8)、连续批处理、动态批处理等功能……
汇集公开精选榜单与 Hermes Agent 内置能力。先看用途和适用场景,再复制安装命令或打开原文核对。
693 个结果
使用 vLLM 的 PagedAttention 和连续批处理实现高吞吐量大语言模型服务。用于部署生产级大语言模型 API、优化推理延迟/吞吐量,或在 GPU 内存有限的情况下服务模型。支持 OpenAI 兼容端点、量化(GPTQ/AWQ/FP8)、连续批处理、动态批处理等功能……
使用 arXiv 的免费 REST API 搜索和检索学术论文。无需 API 密钥。可通过关键词、作者、类别或 ID 进行搜索。可与 `web_extract` 或 `ocr-and-documents` 技能结合,以读取完整论文内容。
GitHub Copilot在VSCode中的高效使用教程,从安装配置到提示词优化和常用快捷键。
飞书多维表格接入AI字段后可以自动分类、生成内容、提取信息,把日常数据表升级为智能助手。
直播间留不住人、转化率低,八成是脚本问题。本教程拆解高转化直播间的结构:开场留人、产品讲解、逼单成交、下播预告四个环节的话术模板与节奏设计。
Dify是开源的LLM应用开发平台,支持可视化搭建RAG知识库问答系统。本教程从部署安装到知识库配置、提示词编排、API发布,详解完整开发流程。
DeepSeek开源的Agent框架Harness上线即破15万星,不需要写代码,一行命令就能让AI自动整理文件、分析Excel、生成网页。
v0.dev全栈原型开发实战:用自然语言生成React+Tailwind前端,再导出到Next.js项目运行的完整教程。
WPS AI 3.0完整使用教程,覆盖Word文档润色、Excel智能公式、PPT大纲一键生成、PDF解读、会议纪要,用自然语言搞定所有日常办公任务。
Recraft让AI直接生成矢量图(SVG),无限放大不模糊,本教程带你从基础生成到图标集批量产出完整实战。
使用 OpenStreetMap 查找附近地点(餐厅、咖啡馆、酒吧、药房等)。支持坐标、地址、城市、邮编或 Telegram 位置标记。无需 API 密钥。
使用 TRL 进行强化学习微调 LLM - SFT 用于指令调优,DPO 用于偏好对齐,PPO/GRPO 用于奖励优化,以及奖励模型训练。适用于需要 RLHF、对齐模型偏好或从人类反馈中训练的场景。兼容 HuggingFace Tr…
Hermes 的规划模式 — 检查上下文,在当前工作区/后端工作目录的 `.hermes/plans/` 中编写 Markdown 规划文件,且不执行任何工作。
SDXL+ComfyUI搭建本地AI绘画工作流,从安装到批量出图全流程,适合设计师和技术人员。
用AI撰写抖音直播脚本:开场话术、产品介绍节奏、抽奖互动、逼单话术标准化,主播执行效率翻倍。
Cursor的Composer模式能跨多个文件同步编辑,是AI编程工具的代际升级。本教程详解Composer、Agent模式、@Files、@Web等高阶用法。
Qwen3 2026年Q2发布,720亿参数版本在中文场景超越GPT-4o。本教程详解用Ollama+vLLM混合部署Qwen3-72B-Instruct,从硬件选型到API服务搭建,企业数据不出内网。
Claude Code新增/design命令,用自然语言描述UI需求就能直接生成可编辑设计稿,还能一键转成HTML/CSS代码。
Kimi浏览器插件让AI随叫随到,网页划线即可提问,长文一键生成结构化摘要,大幅提升信息获取效率。
Excel数据验证教程:用下拉列表、条件验证、自定义公式约束数据录入,从源头防止错误数据,建立可靠的数据采集模板。
从表格搭建、字段设计到自动化提醒与权限控制,本教程讲透如何用腾讯文档智能表格把团队日常协作流程固化下来。
将编码任务委派给 Claude Code(Anthropic 的 CLI Agent)。适用于构建功能、重构代码、代码审查以及迭代式开发。需要已安装 claude CLI。
针对研究和生产优化的快速分词器。基于 Rust 实现,可在 <20 秒内分词 1GB 数据。支持 BPE、WordPiece 和 Unigram 算法。可训练自定义词汇表,追踪对齐关系,处理填充/截断。与 transformers 无缝集成。用于……
Facebook 开发的高效相似性搜索与密集向量聚类库。支持数十亿向量,支持 GPU 加速,提供多种索引类型(Flat、IVF、HNSW)。适用于快速 k-NN 搜索、大规模向量检索,或需要纯相似性搜索而无需……
条目根据公开目录和原始文档摘要整理,保留来源与原文入口。安装前请查看原文中的依赖、权限和安全说明;热度指标仅用于发现内容,不代表绝对质量。