Commit Graph
56 Commits
Author SHA1 Message Date
Frederic BranczykandGitHub 833ac33fe0 Merge pull request #62 from ericchiang/coc
automated PR: update CoC and legalese
2018-01-05 08:45:17 +01:00
Frederic Branczyk 285272bf28 *: migrate kube-prometheus to Prometheus Operator repo 2017-03-07 13:21:23 +01:00
Frederic Branczyk 9e11e17a71 *: normalize namings 2017-03-03 16:43:52 +01:00
Frederic BranczykandGitHub 333bd23434 Merge pull request #56 from rutsky/nodes-memory
Split used memory on used, caches and buffers
2017-03-02 16:10:34 +01:00
Frederic BranczykandGitHub 2e2dfbcfa5 Merge pull request #57 from rutsky/wrap-dashboard
add script for wrapping saved from Grafana dashboard specifications
2017-03-02 16:08:54 +01:00
Frederic BranczykandGitHub 4832e0250e Merge pull request #54 from dmcnaught/master
Removing anpiserver cert error documentation; no longer occurs
2017-03-02 09:15:09 +01:00
Frederic Branczyk 43d13293c0 remove grafana watcher 2017-03-01 14:33:10 +01:00
Frederic Branczyk 4291965e8b manifests: don't skip apiserver cert verification 2017-03-01 11:14:26 +01:00
Frederic BranczykandGitHub 4a7a702dbb Merge pull request #33 from brancz/generate-k8s-config
Generate k8s config & operator v0.6.0
2017-02-28 15:37:35 +01:00
Frederic Branczyk b240d0937c hack: improve minikube deploy scripts 2017-02-28 10:42:36 +01:00
Frederic Branczyk 34fd0ebcd0 hack: allow deploying the example app in non-default namespace 2017-02-28 10:42:36 +01:00
Frederic Branczyk d4b581fa49 use ServiceMonitors to generate Prometheus Kubernetes config 2017-02-28 10:42:33 +01:00
Frederic BranczykandGitHub d93a9adadc Merge pull request #49 from dmcnaught/master
Documentation for adding kube-prometheus to K8s on AWS w KOPS.
2017-02-24 15:52:43 +01:00
Frederic BranczykandGitHub 5ae79a9461 Merge pull request #47 from brancz/fix-all-nodes
dashboards: fix all nodes dashboard
2017-02-22 10:33:42 +01:00
Frederic Branczyk 0fb8305465 dashboards: fix all nodes dashboard 2017-02-21 17:46:57 +01:00
Frederic BranczykandGitHub a357e72027 Merge pull request #46 from brancz/used-memory
fix memory/disk gauges and use rate
2017-02-21 15:03:07 +01:00
Frederic Branczyk 615f45e605 prefer = over =~ 2017-02-21 14:59:58 +01:00
Frederic Branczyk f5f00ec1bc prefer rate over irate 2017-02-21 14:26:07 +01:00
Frederic Branczyk 37feb034cd make node gauges usage based 2017-02-21 14:15:52 +01:00
Frederic BranczykandGitHub 3a38e173f9 Merge pull request #40 from tsloughter/master
upgrade grafana image to 4.1.1
2017-02-17 15:38:09 +01:00
Frederic Branczyk a468d489d6 hack/cluster-monitoring: hide expected errors and print meaning 2017-01-03 14:42:44 +01:00
Frederic BranczykandGitHub b5259148a1 Merge pull request #27 from brancz/kubectl-apply
hack/*: use kubectl apply where possible
2017-01-03 13:30:15 +01:00
Frederic Branczyk 9e319acaa9 hack/*: use kubectl apply where possible
There is an issue with kubectl apply and third party resources, so for
the time being we use create for TPRs, but apply for all manifests that
it can handle.
2017-01-03 13:22:40 +01:00
Frederic BranczykandGitHub 0efaf385eb Merge pull request #26 from chancez/fix_hack_deploy_kubeconfig
Don't pass $KUBECONFIG to kubectl --kubeconfig flag
2017-01-02 09:09:08 +01:00
Frederic Branczyk a200051578 *: cleanup and unify minikube and self-hosted discovery 2016-12-23 20:06:32 +01:00
Frederic BranczykandGitHub 7516052da2 Merge pull request #22 from brancz/update-configs
Update configs/alerts
2016-12-14 18:17:05 -08:00
Frederic Branczyk dca2c152cf assets: adapt to recent changes
Recently the ConfigMap for the prometheus config was changed, but not in
the assets, where it should have happened.
2016-12-14 18:13:28 -08:00
Frederic Branczyk 1c6bc7a387 kubernetes alerts: don't alert on multiple
bootkube starts two replicas of the scheduler and controllers manager
2016-12-14 18:10:50 -08:00
Frederic BranczykandGitHub 417e3feb4b Merge pull request #19 from brancz/v0.1.0-fixes
correctly discover the Alertmanager cluster and ServiceMonitors
2016-12-12 23:07:18 -08:00
Frederic Branczyk b867f6c9ec correctly discover the Alertmanager cluster and ServiceMonitors 2016-12-12 23:01:30 -08:00
Frederic Branczyk 0faefbb713 use prometheus-operator v0.1.0
v0.1.0 introduced handling Alertmanager clusters.
2016-12-12 20:43:36 -08:00
Frederic BranczykandGitHub 1b72c350bc Merge pull request #17 from bernielomax/bernielomax/fix-invalid-tag
Fixed docker image tag for "quay.io/prometheus/node-exporter".
2016-12-11 19:53:47 -08:00
Frederic Branczyk cbf8673094 manifests/exporters: update node-exporter version 2016-12-09 17:09:06 -08:00
Frederic Branczyk a40ca507c6 manifests/k8s: add service for discovering kube-dns metrics
The ports reflect the upstream kube-dns manifests of bootkube and
kubernetes/kubernetes.
2016-12-02 14:13:35 +01:00
Frederic Branczyk d0c1fb522b manifests: add Alertmanager manifests and discovery
The latest version of the Prometheus Operator requires Prometheus
>=v1.4.0 for the Alertmanger discovery feature.
2016-12-02 14:12:30 +01:00
Frederic Branczyk 0c1bb5c1c9 manifests: remove prometheus.io/scrape annotations
These annotations made sense in pre v1.3.0 Prometheus releases, however,
with >=v1.3.0 and the Prometheus Operator these annotations are more
confusing then helpful.
2016-12-02 14:10:53 +01:00
Frederic Branczyk 20f88eed10 *: set lower resource requests 2016-12-02 14:08:14 +01:00
Frederic BranczykandGitHub 9f7b21737e Merge pull request #15 from mrwacky42/patch-1
Spleling
2016-11-21 14:48:27 +01:00
Frederic BranczykandGitHub add3f250e7 Merge pull request #13 from grobie/grobie/fix-kubernetes-rules
Fix broken kubernetes.rules
2016-11-04 13:46:17 +01:00
Frederic BranczykandGitHub cd1457b356 Merge pull request #11 from coreos/fabxc-patch-1
Fix always firing alerts
2016-11-04 11:11:03 +01:00
Frederic BranczykandGitHub e360f1963d Merge pull request #6 from grobie/prometheus-config-asset
Extract prometheus.yaml into assets
2016-11-03 16:06:07 +01:00
Frederic Branczyk cd4941eba4 mention minikube restrictions 2016-11-02 16:34:28 +01:00
Frederic Branczyk 7cb9eff923 add explanation and guide on prerequisites 2016-11-02 14:12:43 +01:00
Frederic BranczykandGitHub 5291bc3227 Merge pull request #4 from brancz/etcd2-alerts
add etcd2 alerts
2016-11-02 11:14:18 +01:00
Frederic Branczyk 2e5bcc1671 add etcd2 alerts 2016-11-02 11:03:13 +01:00
Frederic BranczykandGitHub bb752d6f56 Merge pull request #2 from brancz/k8s-components
monitor and alert on k8s components
2016-11-02 11:02:56 +01:00
Frederic Branczyk 4a7ede4ffd add kubernetes alerts 2016-11-02 10:59:29 +01:00
Frederic Branczyk 1795a62841 manifests: add headless services for k8s components
This way they are discoverable via the kubernetes endpoints discovery of
Prometheus.
2016-11-02 10:31:13 +01:00
Frederic Branczyk cd0325db49 manifests: rename controllers to operators and use deployments 2016-11-01 19:34:48 +01:00
Frederic Branczyk 12cd0fd34f add ConfigMap generate script
This also contains the generated ConfigMaps for the grafana dashboards
as well as for alerts. These will be updated in subsequent changes as
sets of alerts and dashboards are added/updated in the respective
subdirectories in `/assets`.
2016-10-28 16:54:40 +02:00
Frederic Branczyk a41db2ea5c new grafana dashboards for kubernetes cluster/deployments/pods 2016-10-24 15:30:39 +02:00
Frederic Branczyk 3a13331f11 manifests/grafana: add generic kubernetes deployments dashboard 2016-10-20 16:22:02 +02:00
Frederic Branczyk 18652f9b84 grafana-watcher: wait for Grafana to be available and initialize 2016-10-20 11:18:05 +02:00
Frederic Branczyk a4ddbad0ab grafana-watcher: add datasource handling 2016-10-20 10:57:02 +02:00
Frederic Branczyk 1963f86da9 add initial version of Grafana updater 2016-10-19 18:02:41 +02:00
Frederic Branczyk a0b1a93799 add node-exporter, kube-state-metrics, and alertmanager controller
Also ensure that all workloads have memory requirements and limits.
2016-10-18 14:50:28 +02:00