一、监控之open-falcon

open-falcon

一、简介

官网:http://open-falcon.org/

文档:http://book.open-falcon.org/zh_0_2/

1.1、介绍

监控系统是整个运维环节,乃至整个产品生命周期中最重要的一环,事前及时预警发现故障,事后提供翔实的数据用于追查定位问题。监控系统作为一个成熟的运维产品,业界有很多开源的实现可供选择。当公司刚刚起步,业务规模较小,运维团队也刚刚建立的初期,选择一款开源的监控系统,是一个省时省力,效率最高的方案。之后,随着业务规模的持续快速增长,监控的对象也越来越多,越来越复杂,监控系统的使用对象也从最初少数的几个SRE,扩大为更多的DEVS,SRE。这时候,监控系统的容量和用户的“使用效率”成了最为突出的问题。

监控系统业界有很多杰出的开源监控系统。我们在早期,一直在用zabbix,不过随着业务的快速发展,以及互联网公司特有的一些需求,现有的开源的监控系统在性能、扩展性、和用户的使用效率方面,已经无法支撑了。

因此,我们在过去的一年里,从互联网公司的一些需求出发,从各位SRE、SA、DEVS的使用经验和反馈出发,结合业界的一些大的互联网公司做监控,用监控的一些思考出发,设计开发了小米的监控系统:open-falcon。

open-falcon的目标是做最开放、最好用的互联网企业级监控产品引用

一、与其他监控系统对比(2016年)

1.2、特点

灵活的数据采集,支持自定义数据上报
支持策略模板、模板继承和覆盖
高效的告警判别,支持告警暂停、维护周期设置
组件支持水平拓展
大部分用golang编写,部署相对简单

1.3、架构图

1.4、目前存在不足

主要优缺点介绍博客:

网址1:http://blog.x2know.org/2016/06/25/open-falcon/

网址2:https://www.jianshu.com/p/623b96175915

原文地址:https://www.cnblogs.com/pansn/p/13054512.html