dashboard-builder
为 Grafana、SigNoz 等平台构建能够回答实际运维人员问题的监控仪表板。适用于将指标转化为可用的仪表板,而非华而不实的展示板。
它会碰到什么
扫了多少1 个文本文件,1 KB
它会碰到什么不碰外部(只输出文字)
命中总数0 处
命中统计严重 0 · 高 0 · 中 0 · 低 0
这一栏是扫描器报的事实,不是结论。命中多不等于有毒(安全工具、规则库、示例脚本本来就会包含危险写法),命中少也不等于干净。它和你手上的凭据、文件、网络有什么关系,需要你自己看。
技能内容
仪表盘构建器
当任务需要构建一个可供操作人员使用的仪表盘时使用此方案。
目标不是"展示所有指标",而是回答以下问题:
- 系统健康吗?
- 瓶颈在哪里?
- 发生了什么变化?
- 应该采取什么行动?
使用场景
- "构建一个Kafka监控仪表盘"
- "为Elasticsearch创建一个Grafana仪表盘"
- "为这个服务制作一个SigNoz仪表盘"
- "将这个指标列表转化为真正的运维仪表盘"
约束条件
- 不要从视觉布局开始;要从操作人员的问题出发
- 不要仅仅因为指标存在就包含所有可用指标
- 不要在没有结构的情况下混合健康、吞吐量和资源面板
- 不要发布没有标题、单位和合理阈值的面板
工作流程
1. 定义操作问题
围绕以下方面组织:
- 健康/可用性
- 延迟/性能
- 吞吐量/容量
- 饱和度/资源
- 服务特定风险
2. 研究目标平台架构
首先检查现有仪表盘:
- JSON结构
- 查询语言
- 变量
- 阈值样式
- 分区布局
3. 构建最小可用面板
推荐结构:
- 概览
- 性能
- 资源
- 服务特定分区
4. 剔除装饰性面板
每个面板都应回答一个真实问题。如果不能,则移除。
示例面板集
Elasticsearch
- 集群健康
- 分片分配
- 搜索延迟
- 索引速率
- JVM堆/GC
Kafka
- 代理数量
- 副本不足的分区
- 消息流入/流出
- 消费者滞后
- 磁盘和网络压力
API网关/入口
- 请求速率
- p50/p95/p99延迟
- 错误率
- 上游健康
- 活跃连接数
质量检查清单
- \[ ] 有效的仪表盘JSON
- \[ ] 清晰的分区分组
- \[ ] 包含标题和单位
- \[ ] 阈值/状态颜色有意义
- \[ ] 存在常用过滤器的变量
- \[ ] 默认时间范围和刷新频率合理
- \[ ] 没有对操作人员无价值的装饰性面板
相关技能
research-opsbackend-patternsterminal-ops
想直接用这个技能?
本站把开放许可(MIT / Apache 等)的技能按仓库打包整理到网盘,点一下转存到你自己的网盘,不用一个个从 GitHub 拉。许可未声明的技能只给原始仓库链接,不打包。
同名技能的其他版本
有 3 个不同仓库或目录里都有叫 dashboard-builder 的技能。它们内容并不相同,别混用:
- affaan-m/ECC — Grafana、SigNoz、および同様のプラットフォーム用の実際のオペレータ質問に答える監視ダッシュボードを構築します。メトリクスを虚栄ボードではなく機能するダッシュボードに変え
- affaan-m/ECC — Build monitoring dashboards that answer real operator questions for Grafana, SigNoz, and s