Production Kubernetes
Provisioning CCE-кластеров, upgrades, node pools, scheduling, resources, RBAC, Helm и troubleshooting.
Открыть case studyОткрыт к удалённым DevOps / Platform / SRE позициям
DevOps-инженер с опытом Kubernetes, Infrastructure as Code, CI/CD, cloud networking, observability и инфраструктуры data/AI-платформ.
Последние почти два года - Сбер, команда GigaData. Cloud.ru Advanced и Evolution. До этого - self-managed Kubernetes в on-premise средах.
Selected experience
Санитизированные описания реальной работы без внутренних адресов, конфигураций и данных работодателя.
Provisioning CCE-кластеров, upgrades, node pools, scheduling, resources, RBAC, Helm и troubleshooting.
Открыть case studyOn-premise кластеры через Kubespray и kubeadm, HAProxy/Keepalived, Harbor, FluxCD и GitLab CI/CD.
Открыть case studyrclone/S3, tuning ресурсов и concurrency, retries, recovery, verification, DNS и private endpoints.
Открыть case studyTerraform/OpenTofu, VPC, peering, routing, NAT/SNAT, DNS, load balancers и private connectivity.
Открыть case studyPrometheus, VictoriaMetrics, Grafana, remote write, alerting, cardinality и incident investigation.
Открыть case studyGitLab CI/CD, Airflow, Ray и Spark-related workloads со стороны инфраструктуры и platform operations.
Открыть case studyCareer
Практический путь от разработки и инфраструктурной поддержки к специализации на production Kubernetes и Platform Engineering.
Production Kubernetes/CCE, Cloud.ru, Terraform/OpenTofu, GitLab CI/CD, data-platform infrastructure, observability и S3/OBS.
Self-managed Kubernetes, Kubespray, kubeadm, GitLab CI/CD, FluxCD, Harbor, HAProxy/Keepalived и multi-environment delivery.
Python, Node.js, Vue.js, Docker, Nginx, Linux, databases, monitoring и deployment приложений.
Technology map
Kubernetes · CCE · kubeadm · Kubespray · Docker · Helm · FluxCD
Terraform · OpenTofu · Cloud.ru Advanced / Evolution · Yandex Cloud · Ansible
GitLab CI/CD · Runner · Kubernetes Agent · Jenkins · OpenShift
Prometheus · VictoriaMetrics · Grafana · PromQL / MetricQL
VPC · Peering · Routing · NAT/SNAT · DNS · Load Balancers · Private Endpoints
Airflow · Ray · Spark workloads · Kafka · PostgreSQL · Redis · ClickHouse · S3/OBS
Точный scope: работа с Ray, Spark, Kafka и базами данных велась преимущественно со стороны DevOps/platform - deployment, Kubernetes integration, networking, access, monitoring, resources и infrastructure troubleshooting.
Runnable evidence
Независимо воссозданный пример на synthetic data: copy, safe rerun, недоступный destination, recovery, corruption detection и integrity verification.
Contact
Удалённая работа из Волгограда предпочтительна. Рассматриваю DevOps, Platform, SRE и инфраструктурные MLOps-роли.