第7.5阶段为系统添加了追踪功能,使用OpenTelemetry和Grafana Tempo实现请求链路分析。第8阶段将应用迁移至AWS,使用Terraform部署EKS、RDS、ECR等资源,通过ArgoCD和External Secrets Operator管理部署和密钥,并支持CI/CD、安全扫描及生产加固。
本文介绍了在Amazon EKS上构建开源可观测性数据栈的实践,使用VictoriaMetrics、Grafana Loki和Grafana Tempo处理指标、日志和链路数据。通过OpenTelemetry Operator实现微服务的零代码接入,并在Grafana中关联trace、log和metrics,提升故障排查效率。数据存储在Amazon S3和EBS gp3,整体架构清晰,运维负担较低。
Grafana于2025年6月12日发布Tempo 2.8,显著降低内存消耗超过50%,并扩展了TraceQL功能,新增追踪检索、层级分析支持及指标函数。更新增强了安全性和性能,社区反响积极,体现了Grafana对用户体验的重视。
Grafana Tempo 2.8发布了TraceQL改进、性能提升和bug修复。新增TraceQL特性支持按父span ID搜索和计算时间总和,优化了内存使用以减少OOM错误,移除了serverless功能并更改了默认端口。
Grafana Tempo 2.7发布,重点在性能和操作改进,新增TraceQL功能,包括avg_over_time、min_over_time和max_over_time指标函数。性能方面减少资源消耗,改进查询前端资源和标签值查找,更新OpenTelemetry配置,增强正则表达式匹配性能。未来将推出RF1重构,期待TraceQL性能进一步提升。
该项目是一个完整的监控和追踪应用,利用OpenTelemetry、Grafana Tempo、Prometheus和Grafana进行分布式追踪和指标的收集与存储,支持可视化和分析。技术栈包括Go语言、Docker Compose和PostgreSQL。
Grafana Tempo 2.6发布了性能改进和TraceQL的新功能。TraceQL现在支持事件发现、查询跨度链接和搜索数组。此版本还包括操作模式和内存消耗的改进。Tempo的主要目标是将TraceQL指标推向GA,并重新架构RF1。用户可以加入Tempo社区会议获取更多信息。Grafana Cloud提供免费的永久套餐,包括50GB的跟踪日志和10K系列的指标。
完成下面两步后,将自动完成登录并继续当前操作。