可观测性是系统工程中的一个核心概念,指通过系统对外暴露的输出信息(如日志、指标、追踪数据)来推断和理解其内部运行状态的能力。其关键特征包括:度量指标(Metrics)的采集与分析、分布式追踪(Tracing)的链路还原,以及日志(Logging)的结构化记录。可观测性广泛应用于分布式系统、微服务架构及云原生环境,是系统监控、故障诊断与性能优化的重要基础。
在AI工具使用场景下用户对服务端的可观测性几乎为零,无法获知排队时间、实际模型版本和系统负载
在传统微服务架构中,开发者可通过日志、指标和链路追踪这三大支柱诊断性能问题
可观测性概念源自控制工程,由控制论学家鲁道夫·卡尔曼于1960年代正式定义
可观测性的三大支柱框架包括Metrics(指标)、Logs(日志)和Traces(链路追踪)