We are looking for a Grafana Engineer with experience in designing and managing enterprise monitoring and observability solutions. The ideal candidate will have expertise in Grafana, dashboard development, alerting, cloud monitoring, and modern observability tools.
Roles and Responsibilities
- Design and maintain Grafana dashboards, reports, and visualizations.
- Configure Grafana Alerting and notification channels.
- Integrate Grafana with Prometheus, Loki, Tempo, Elasticsearch/OpenSearch, SQL databases, and cloud monitoring platforms.
- Implement monitoring for Kubernetes, containers, cloud infrastructure, and applications.
- Develop observability solutions for metrics, logs, and traces.
- Automate monitoring using Terraform, Ansible, or similar IaC tools.
- Perform root cause analysis and optimize monitoring performance.
- Collaborate with DevOps, SRE, Infrastructure, and Application teams.
- Maintain monitoring documentation, standards, and runbooks.
Required Skills
- Strong experience with Grafana administration and dashboard development.
- Hands-on experience with Prometheus, Loki, Tempo, OpenTelemetry, and Elasticsearch/OpenSearch.
- Knowledge of PromQL, LogQL, and observability best practices.
- Experience with AWS, Azure, or GCP.
- Familiarity with Kubernetes, CI/CD, and DevOps practices.
- Scripting skills in Python, Bash/Shell, or PowerShell.
- Experience with Terraform, Ansible, or other automation tools.
- Strong troubleshooting, communication, and problem-solving skills.
Preferred Skills
- Grafana Enterprise experience.
- Exposure to APM tools such as Dynatrace, Datadog, AppDynamics, or New Relic.
- Experience with AIOps and enterprise observability platforms.
Keywords: Grafana, Prometheus, Loki, Tempo, OpenTelemetry, Kubernetes, Observability, Monitoring, Alerting, PromQL, LogQL, Terraform, AWS, Azure, GCP, DevOps, SRE.