OMA Skills Hub by OMA · Open Modus Accelerator
🎯 Use Case Hermes Skill

tensorrt-llm

High-throughput LLM inference on NVIDIA GPUs.

仓库: NousResearch/hermes-agent · v1.0.1 · by Orchestra Research · MIT

Inference ServingTensorRT-LLMNVIDIAInference OptimizationHigh ThroughputLow LatencyProductionFP8INT4In-Flight BatchingMulti-GPU
文件路径
optional-skills/mlops/tensorrt-llm/SKILL.md

查看源文件 (raw) ↗