分享一个给 Agent 用的 Kubernetes Skill,专门解决 LLM 生成 K8s 配置时常见的标签不对齐、端口不一致、安全默认值缺失等问题。它的方法论叫 failure-mode-first,先用 6 类已知故障模式预先诊断风险,再生成 YAML,减少幻觉。配套了 20 份按需加载的参考文档,覆盖安全、网络、RBAC、健康检查、存储等。
点评:作者对 Skill 机制的理解相当不错,把领域知识按需加载,激活成本压到几百 token。比起单纯让 LLM 记住 K8s 最佳实践,failure-mode-first 这种先验证再生成的工作流是更加可靠。虽然 LLM 对 K8s 的通识不错,但是结合这样的专家型 Skill,还能进一步提升可靠性。