🎯 Use Case
Hermes
Skill
serving-llms-vllm
vLLM: high-throughput LLM serving, OpenAI API, quantization.
vLLMInference ServingPagedAttentionContinuous BatchingHigh ThroughputProductionOpenAI APIQuantizationTensor Parallelism文件路径
skills/mlops/inference/serving-llms-vllm/SKILL.md