tag

Observability

共 45 篇文章。
全部文章GoGodotGolangTutorialRustSaaSRust TutorsPrdLua游戏客户端MinigameLong Term Novel Writing ExperienceSpore Trilogy Creative Writing Notes孢子三部曲
GraphQL

GraphQL 可观测性与链路追踪:从 resolver 指标到全链路

GraphQL 可观测性实战:与 REST 可观测性的差异、GraphQL 特有的追踪维度(操作/字段/resolver 级)、Apollo Tracing 与 OpenTelemetry 集成、resolver 级耗时与 N+1 的观测、操作级指标(类型/复杂度/缓存命中率)、错误与告警聚合、全链路追踪(traceId 贯穿网关→resolver→DB)、以及可观测性驱动的性能优化闭环。

8 分钟阅读
GraphQL Observability Tracing
infra

可观测性平台建设与组织落地:从工具堆砌到全员可用的自助观测体系

深度讲解可观测性平台化(Observability as a Platform)与组织落地:从'工具堆砌'到'平台能力'的跃迁、可观测性平台的三大支柱(统一采集/统一存储/统一查询)、自助服务与开发者体验、标准埋点与命名规范治理、观测数据的 SLO 与成本治理、组织演进与平台工程团队,以及一套可观测性平台建设路线图。

7 分钟阅读
observability platform-engineering developer-experience
infra

可观测性安全:数据脱敏、最小化采集与访问控制的纵深防线

深度讲解可观测性系统的安全设计与数据治理:可观测性系统的攻击面、日志与追踪中的敏感数据(PII/凭证/密钥)、最小化采集与脱敏策略、Telemetry Pipeline 的访问控制与加密、后端存储的加密与保留、权限模型与审计、合规要求(GDPR 等),以及一套可观测性安全纵深防御。

6 分钟阅读
observability security PII
database

PostgreSQL 监控与诊断体系:pg_stat_activity、慢查询、pg_stat_statements 与 Prometheus 告警

构建完整的 PostgreSQL 监控与诊断体系:pg_stat_database 与 pg_stat_activity 关键指标解读、慢查询日志与 log_min_duration_statement、auto_explain 自动执行计划、pg_stat_statements 语句级统计、Prometheus + postgres_exporter + Grafana 仪表盘搭建、核心告警规则(连接数/复制延迟/死元组)、诊断常用 SQL 与常见问题定位方法论。

7 分钟阅读
postgresql monitoring observability
infra

结构化日志与语义约定:从文本日志到可查询、可关联、可分析的日志体系

深度讲解结构化日志(Structured Logging)与语义约定:为什么文本日志不可查询、结构化日志的 JSON 字段规范、OpenTelemetry 日志语义约定、Trace/日志关联(Trace ID 注入)、日志上下文与字段命名、多语言日志库配置、日志脱敏与合规、以及日志查询与分析的落地。

7 分钟阅读
observability logging structured-logging
infra

监控黄金信号与 RED/USE 方法论:业务与资源指标的指标设计

深度讲解可观测性指标的方法论设计:Google 四大黄金信号(Latency/Traffic/Errors/Saturation)、RED(Rate/Errors/Duration)、USE(Utilization/Saturation/Errors)与四类指标类型,如何在业务监控与资源监控中落地、每个服务/每类资源该采哪些指标、告警阈值与容量规划,以及方法论之间的选择与组合。

7 分钟阅读
observability monitoring golden-signals
Observability

生成式 AI 可观测性:LLM 调用追踪、Token 成本监控、质量与安全评估

传统应用的可观测性(Metrics/Logs/Traces)在 LLM 应用面前依然成立,但要新增三个 LLM 特有的观测维度:Token 与成本(每次调用消耗多少、花了多少钱)、模型质量(回答对不对、是否幻觉、是否符合预期)、模型安全(提示注入、有害内容、PII 泄露)。大模型是"黑盒 …

8 分钟阅读
genai llm observability
DevOps

DevOps 专题索引:从 CI/CD 到 SRE 的全栈实践

DevOps 是连接开发与运维的桥梁,旨在通过自动化、文化变革与工具链整合,实现软件交付的高速、高质与持续改进。本专题涵盖 Docker 容器化与镜像优化、Kubernetes 编排调度与生产运维、CI/CD 流水线设计与 GitOps 实践、Prometheus/Grafana 可观测性体系、Chaos Engineering 混沌工程与系统韧性验证、SRE 服务水平目标与错误预算、基础设施即代码(Terraform/Pulumi/ Ansible),以及数据平台搭建与运维自动化,并延伸至密钥管理与供应链安全、云原生安全左移、分布式追踪与全链路可观测、SLO 与错误预算工程、内部开发者平台(IDP)与备份容灾自动化,帮助团队构建现代化的云原生交付能力。

16 分钟阅读
devops sre cicd