<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0"><channel><title>SRE Architecture</title><link>https://sreai.net/en/categories/sre-architecture/</link><description>Practical notes on SRE, cloud-native reliability, and AI infrastructure.</description><language>en</language><lastBuildDate>Thu, 13 Aug 2026 23:52:33 +0800</lastBuildDate><item><title>Deep Learning in SRE Intelligent Operations Practice</title><link>https://sreai.net/en/posts/aiops-practice/</link><guid isPermaLink="true">https://sreai.net/en/posts/aiops-practice/</guid><pubDate>Mon, 20 Jul 2026 00:00:00 +0000</pubDate><description>As microservice architectures and cloud-native scale grow, traditional threshold-based alerting can no longer meet the need for rapid incident response. This article explores how deep learning-based anomaly detection systems help SRE teams shift from reactive responses to proactive prediction.</description><category>SRE Architecture</category><category>SRE</category><category>AIOps</category><category>机器学习</category></item><item><title>Cloud-Native Chaos Engineering Practice Guide</title><link>https://sreai.net/en/posts/chaos-engineering/</link><guid isPermaLink="true">https://sreai.net/en/posts/chaos-engineering/</guid><pubDate>Thu, 18 Jun 2026 00:00:00 +0000</pubDate><description>Use Chaos Mesh to simulate network latency, node failures, and Pod anomalies to continuously verify system resilience and automated self-healing mechanisms.</description><category>SRE Architecture</category><category>SRE</category><category>混沌工程</category><category>Kubernetes</category></item><item><title>Building Millisecond-Level Observability with Prometheus + eBPF</title><link>https://sreai.net/en/posts/ebpf-observability/</link><guid isPermaLink="true">https://sreai.net/en/posts/ebpf-observability/</guid><pubDate>Fri, 10 Jul 2026 00:00:00 +0000</pubDate><description>Combine eBPF zero-overhead kernel probes with Prometheus federation clusters to build millisecond-level full-stack observability covering network, storage, and application layers.</description><category>SRE Architecture</category><category>eBPF</category><category>Prometheus</category><category>Observability</category></item><item><title>Kubernetes High Availability and Fault Auto-Healing Practice</title><link>https://sreai.net/en/posts/kubernetes-ha/</link><guid isPermaLink="true">https://sreai.net/en/posts/kubernetes-ha/</guid><pubDate>Thu, 25 Jun 2026 00:00:00 +0000</pubDate><description>Deep dive into control plane multi-active deployment, etcd cluster tuning, Pod anti-affinity strategies, and custom Controller-based fault self-healing best practices.</description><category>SRE Architecture</category><category>Kubernetes</category><category>SRE</category><category>High-Availability</category></item><item><title>GitOps Workflow Best Practices for Kubernetes Cluster Management</title><link>https://sreai.net/en/posts/gitops-workflow/</link><guid isPermaLink="true">https://sreai.net/en/posts/gitops-workflow/</guid><pubDate>Sat, 25 Jul 2026 00:00:00 +0000</pubDate><description>Explore GitOps best practices for Kubernetes cluster management, using ArgoCD to achieve declarative deployment and automated rollback, improving release efficiency and operational stability.</description><category>SRE Architecture</category><category>GitOps</category><category>Kubernetes</category><category>CI/CD</category></item><item><title>Terraform Infrastructure as Code Best Practices</title><link>https://sreai.net/en/posts/terraform-best-practices/</link><guid isPermaLink="true">https://sreai.net/en/posts/terraform-best-practices/</guid><pubDate>Sun, 26 Jul 2026 00:00:00 +0000</pubDate><description>Master core Terraform IaC practices including state management, modular design, remote backend configuration, and CI/CD integration</description><category>SRE Architecture</category><category>Terraform</category><category>IaC</category><category>DevOps</category></item><item><title>Envoy Service Mesh Traffic Management in Practice</title><link>https://sreai.net/en/posts/envoy-service-mesh/</link><guid isPermaLink="true">https://sreai.net/en/posts/envoy-service-mesh/</guid><pubDate>Sun, 26 Jul 2026 00:00:00 +0000</pubDate><description>Build a service mesh with Envoy proxy for advanced traffic management, canary releases, and observability</description><category>SRE Architecture</category><category>Envoy</category><category>Service Mesh</category><category>Observability</category></item><item><title>Vector: Next-Gen Observability Data Pipeline</title><link>https://sreai.net/en/posts/vector-observability/</link><guid isPermaLink="true">https://sreai.net/en/posts/vector-observability/</guid><pubDate>Sun, 26 Jul 2026 00:00:00 +0000</pubDate><description>Deep dive into Vector's pipeline architecture, high-performance data transport, and unified observability strategy</description><category>SRE Architecture</category><category>Vector</category><category>Observability</category><category>Logging</category></item></channel></rss>