🎯 Use Case
Hermes
Skill
optimizing-attention-flash
Speed up long-sequence transformer training and inference.
OptimizationFlash AttentionAttention OptimizationMemory EfficiencySpeed OptimizationLong ContextPyTorchSDPAH100FP8Transformers文件路径
optional-skills/mlops/flash-attention/SKILL.md