- 大公司的运维监控一般是采用自研或商用软件方案。相比较自研,商用其实更省心,出现问题直接甩锅就好,所以我们建议还是直接购买成熟的运维监控系统即可,不仅确保数据安全,还能方便使用。一般建立运维监控体系可以从以下四个方面来考虑。 大公司的运维监控一般是采用自研或商用软件方案。相比较自研,商用其实更省心,出现问题直接甩锅就好,所以我们建议还是直接购买成熟的运维监控系统即可,不仅确保数据安全,还能方便使用。一般建立运维监控体系可以从以下四个方面来考虑。
- 2021年3月,IT Central Station发布了IT基础监控(IT Infrastructure Monitoring)、网络监控(Network Monitoring)、Server 监控(Server Monitoring)、云监控(Cloud Monitoring) 软件榜单,排名完全基于众多专业同行和买家的真实用户评价,Zabbix4项均排名第一!(IT Central ... 2021年3月,IT Central Station发布了IT基础监控(IT Infrastructure Monitoring)、网络监控(Network Monitoring)、Server 监控(Server Monitoring)、云监控(Cloud Monitoring) 软件榜单,排名完全基于众多专业同行和买家的真实用户评价,Zabbix4项均排名第一!(IT Central ...
- 2026年,企业IT架构的信创替代进入全面收官阶段,混合云、云原生、微服务成为标配。据行业调研数据,2025年中国可观测市场规模达到87.6亿元,金融、电信、互联网三大行业采购占比合计69.4%;2026年市场规模预计攀升至112.4亿元,同比增长28.2%。同期,全球AIOps市场规模增至193.3亿美元,年复合增长率21.1%,其中72%的企业已将AI Agent用于IT运维场景。Gar... 2026年,企业IT架构的信创替代进入全面收官阶段,混合云、云原生、微服务成为标配。据行业调研数据,2025年中国可观测市场规模达到87.6亿元,金融、电信、互联网三大行业采购占比合计69.4%;2026年市场规模预计攀升至112.4亿元,同比增长28.2%。同期,全球AIOps市场规模增至193.3亿美元,年复合增长率21.1%,其中72%的企业已将AI Agent用于IT运维场景。Gar...
- 针对企业云运维普遍存在监控盲区、故障响应滞后、性能数据分散、缺乏趋势预测、告警配置混乱等核心业务痛点,依托 AI Shell 和华为云 CES 监控技能,实现 ECS 实例实时监控、性能分析、智能告警、故障快速响应全流程自动化,有效提升运维效率,保障业务连续性。 针对企业云运维普遍存在监控盲区、故障响应滞后、性能数据分散、缺乏趋势预测、告警配置混乱等核心业务痛点,依托 AI Shell 和华为云 CES 监控技能,实现 ECS 实例实时监控、性能分析、智能告警、故障快速响应全流程自动化,有效提升运维效率,保障业务连续性。
- 基于 CCE 上运行的 Java 微服务,深入配置华为云 AOM 监控大盘、APM 调用链追踪、LTS 日志采集、自定义告警规则,构建"指标+日志+链路"三位一体的可观测性体系。涵盖 APM Agent 接入、JVM 监控看板、业务埋点、智能告警配置、真实故障排查案例,附 8 个实用监控模板和 3 个踩坑实录。 基于 CCE 上运行的 Java 微服务,深入配置华为云 AOM 监控大盘、APM 调用链追踪、LTS 日志采集、自定义告警规则,构建"指标+日志+链路"三位一体的可观测性体系。涵盖 APM Agent 接入、JVM 监控看板、业务埋点、智能告警配置、真实故障排查案例,附 8 个实用监控模板和 3 个踩坑实录。
- 想象一下:你的SpringBoot应用就像一个996的程序员,每天24小时不间断工作。某天它突然“猝死”了,而你却不知道它是何时倒下、为何倒下、倒下前有没有喊“救命”... 这就是没有监控的可怕之处! 想象一下:你的SpringBoot应用就像一个996的程序员,每天24小时不间断工作。某天它突然“猝死”了,而你却不知道它是何时倒下、为何倒下、倒下前有没有喊“救命”... 这就是没有监控的可怕之处!
- Prometheus是由Cloud Native Computing Foundation(CNCF)托管的开源系统监控和警报工具包,采用时序数据库存储监控数据,通过多维度数据模型和灵活的查询语言PromQL提供强大的指标分析能力。 Prometheus是由Cloud Native Computing Foundation(CNCF)托管的开源系统监控和警报工具包,采用时序数据库存储监控数据,通过多维度数据模型和灵活的查询语言PromQL提供强大的指标分析能力。
- 在 Linux 中监控 CPU、内存、磁盘、网络的指令非常丰富,以下是 最常用、实用的监控指令,按 “指标分类 + 指令详解 + 核心用法” 整理,新手也能快速上手:一、CPU 监控(核心:查看负载、使用率、进程占用)1. top(实时监控,最常用)功能:实时显示系统整体 CPU 负载、进程 CPU 占用排名(默认每 3 秒刷新)。核心用法:top # 直接运行,进入实时监控界面界面关键信... 在 Linux 中监控 CPU、内存、磁盘、网络的指令非常丰富,以下是 最常用、实用的监控指令,按 “指标分类 + 指令详解 + 核心用法” 整理,新手也能快速上手:一、CPU 监控(核心:查看负载、使用率、进程占用)1. top(实时监控,最常用)功能:实时显示系统整体 CPU 负载、进程 CPU 占用排名(默认每 3 秒刷新)。核心用法:top # 直接运行,进入实时监控界面界面关键信...
- Ceph是一个分布式存储系统,诞生于2004年,最早致力于开发下一代高性能分布式文件系统的项目。经过多年的发展之后,已得到众多云计算和存储厂商的支持,成为应用最广泛的开源分布式存储平台。随着云计算的发展,ceph乘上了OpenStack的春风,进而成为了开源社区受关注较高的项目之一。Ceph可以将多台服务器组成一个超大集群,把这些机器中的磁盘资源整合到一块儿,形成一个大的资源池(PB级别),... Ceph是一个分布式存储系统,诞生于2004年,最早致力于开发下一代高性能分布式文件系统的项目。经过多年的发展之后,已得到众多云计算和存储厂商的支持,成为应用最广泛的开源分布式存储平台。随着云计算的发展,ceph乘上了OpenStack的春风,进而成为了开源社区受关注较高的项目之一。Ceph可以将多台服务器组成一个超大集群,把这些机器中的磁盘资源整合到一块儿,形成一个大的资源池(PB级别),...
- 帮助文档全面换新,更清晰、更贴合用户场景的阅读体验,让云监控更简单、更高效。 帮助文档全面换新,更清晰、更贴合用户场景的阅读体验,让云监控更简单、更高效。
- Prometheus 的默认时区设置为亚洲 / 上海时区(UTC+8),需要从两个层面进行配置:Prometheus 服务器本身的时区设置和前端展示(如 Grafana)的时区设置。以下是具体方法:一、设置 Prometheus 服务器的系统时区Prometheus 本身本身不直接提供时区配置参数,它默认使用服务器的系统时区。因此,首先需要确保运行 Prometheus 的服务器时区为 As... Prometheus 的默认时区设置为亚洲 / 上海时区(UTC+8),需要从两个层面进行配置:Prometheus 服务器本身的时区设置和前端展示(如 Grafana)的时区设置。以下是具体方法:一、设置 Prometheus 服务器的系统时区Prometheus 本身本身不直接提供时区配置参数,它默认使用服务器的系统时区。因此,首先需要确保运行 Prometheus 的服务器时区为 As...
- Arthas sysprop(查看和修改JVM的系统属性) Arthas sysprop(查看和修改JVM的系统属性)
- Arthas heapdump(dump java heap, 类似 jmap 命令的 heap dump 功能) Arthas heapdump(dump java heap, 类似 jmap 命令的 heap dump 功能)
- Arthas dashboard(当前系统的实时数据面板) Arthas dashboard(当前系统的实时数据面板)
- Arthas thread(查看当前JVM的线程堆栈信息) Arthas thread(查看当前JVM的线程堆栈信息)
上滑加载中
推荐直播
-
华为云码道Skill实战与极速交付,智能开发全链路实战2026/07/22 周三 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;姜浩-华为云HCDG核心组成员
直播深度解读华为云码道6月产品新特性,从Skill市场安装专家技能,带你零距离体验从需求,开发,审查,重构全链路闭环的开发过程。从零构建并交付一个完整项目,让您体验从代码提交到服务上线的“极速”之旅。
回顾中 -
聚开发者之力,创具身新未来2026/07/23 周四 15:00-17:00
张豪杰/程文/王军/刘新春/黄钦开 /张晓天
本次华为云具身智能开发平台CloudRobo培训面向具身智能开发者,带您全流程体验机器人本体R2C小时级接入、环境重建与轨迹生成仿真数据生产、PB级数据管理、数据评测、模型训推、强化学习和Benchmark一键评测等功能,并体验业界主流具身模型应用。
回顾中
热门标签