Kirill Volkov

Kirill Volkov

DevOps Engineer
Скачать CV (PDF)Download CV (PDF)

О себеAbout

DevOps / Platform Engineer с более чем 7-летним опытом работы в корпоративном банковском секторе и высоконагруженных производственных средах. Специализируюсь на эксплуатации Kubernetes-платформ, внедрении GitOps-подходов, автоматизации CI/CD, построении систем мониторинга (Observability) и обеспечении надёжности производственных систем.

Имею опыт управления контейнерной инфраструктурой корпоративного масштаба (более 20 Kubernetes-кластеров, сотни микросервисов, тысячи CI/CD-пайплайнов), обеспечивая поддержку нескольких команд разработки в средах с жёсткими SLA. Обладаю практической экспертизой в Kubernetes, GitLab CI, ArgoCD, Vault, Prometheus, Grafana и автоматизации Linux.

DevOps / Platform Engineer with 7+ years of experience in the corporate banking sector and high-load production environments. I specialize in operating Kubernetes platforms, implementing GitOps practices, automating CI/CD, building monitoring systems (Observability), and ensuring the reliability of production systems.

I have experience managing enterprise-scale containerized infrastructure (20+ Kubernetes clusters, hundreds of microservices, thousands of CI/CD pipelines), supporting multiple development teams in environments with strict SLAs. I have hands-on expertise in Kubernetes, GitLab CI, ArgoCD, Vault, Prometheus, Grafana, and Linux automation.

НавыкиSkills

Cloud Native & Containers Kubernetes, Helm, Rancher, Docker, Docker Compose, Service Mesh (Istio), NGINX Ingress
CI/CD & GitOps GitLab CI/CD, ArgoCD, Jenkins (базовый уровень), GitOps, многоэтапные пайплайны, CI-шаблоны, автоматизация развёртывания, стратегии отката (Rollback) GitLab CI/CD, ArgoCD, Jenkins (basic level), GitOps, multi-stage pipelines, CI templates, deployment automation, Rollback strategies
Infrastructure & Automation Linux, Bash, Python, Ansible (базовый уровень), Terraform (базовый уровень), Systemd, Cron, Linux Hardening Linux, Bash, Python, Ansible (basic level), Terraform (basic level), Systemd, Cron, Linux Hardening
Observability & Monitoring Prometheus, Grafana, Splunk, Graylog, Zabbix, Alerting, Monitoring as Code, пользовательские метрики, агрегация логов Prometheus, Grafana, Splunk, Graylog, Zabbix, Alerting, Monitoring as Code, custom metrics, log aggregation
Security & Secrets Management Vault, RBAC, Secret Injection, политики доступа, TLS-сертификаты, cert-manager Vault, RBAC, Secret Injection, access policies, TLS certificates, cert-manager
Kubernetes Operations Шаблонизация Helm, диагностика Ingress, Canary / Blue-Green, HPA/VPA, backup & Disaster Recovery, Capacity Planning, Troubleshooting, PVC/Storage Helm templating, Ingress troubleshooting, Canary / Blue-Green deployments, HPA/VPA, backup & Disaster Recovery, Capacity Planning, Troubleshooting, PVC/Storage
Databases & Messaging PostgreSQL, Oracle, InfluxDB, Ignite, GridGain, Redis (базовый уровень), Kafka (базовый уровень) PostgreSQL, Oracle, InfluxDB, Ignite, GridGain, Redis (basic level), Kafka (basic level)

Опыт работыWork Experience

DevOps Engineer
Sovcombank Technology
Январь 2023 — настоящее времяJanuary 2023 — Present
  • Поддерживал и развивал более 20 Kubernetes-кластеров с сотнями микросервисов для десятков команд разработки
  • Участвовал в миграции сервисов на GitOps-подход с использованием ArgoCD
  • Проектировал и оптимизировал GitLab CI/CD-пайплайны: ускорение выполнения, инъекция секретов, кэширование, автоматизация развёртывания
  • Разрабатывал Helm-чарты и переиспользуемые компоненты развёртывания, включая кастомные чарты
  • Внедрил и сопровождал HashiCorp Vault для управления секретами в нескольких окружениях (dev/test/stage/prod)
  • Настраивал и развивал стек мониторинга (Prometheus, Grafana, Graylog, Splunk), ускорил диагностику инцидентов
  • Диагностика и устранение неисправностей в продуктивных Kubernetes-средах: Ingress, сеть, RBAC, cert-manager, Istio, ресурсы, storage
  • Участвовал в on-call дежурствах, обеспечивал соблюдение SLA
  • Автоматизировал операционные процессы с помощью Bash, Python и Ansible
  • Maintained and developed 20+ Kubernetes clusters hosting hundreds of microservices used by dozens of development teams
  • Participated in migrating services to a GitOps approach using ArgoCD; supported and improved deployment processes
  • Designed, optimized, and maintained GitLab CI/CD pipelines: speeding up pipeline execution, implementing secrets injection, optimizing caching, automating deployment
  • Developed and maintained Helm charts and reusable deployment components, including custom charts for non-standard services
  • Implemented and maintained HashiCorp Vault for secrets management across multiple environments (dev/test/stage/prod)
  • Set up and evolved the monitoring stack (Prometheus, Grafana, Graylog, Splunk), improving quality and speeding up incident diagnosis
  • Performed diagnostics and troubleshooting in production Kubernetes environments: Ingress, networking, RBAC, cert-manager, Istio, resources, storage
  • Participated in on-call duty, ensured SLA compliance
  • Automated operational processes using Bash, Python, and Ansible
System Engineer
Sberbank Technologies
Февраль 2022 — Январь 2023February 2022 — January 2023
  • Поддерживал производственные сервисы в высоконагруженной банковской среде (десятки тысяч транзакций в секунду)
  • Развивал систему мониторинга: Prometheus, Grafana, Splunk, InfluxDB, Zabbix
  • Проектировал дашборды, улучшал метрики и алертинг
  • Писал Bash-скрипты для сбора пользовательских метрик и автоматизации мониторинга
  • Сократил MTTR за счёт улучшения алертинга и наблюдаемости
  • Работал с базами данных Oracle и InfluxDB, участвовал в RCA после инцидентов
  • Supported production services in a high-load banking environment processing tens of thousands of transactions per second
  • Developed the monitoring system: Prometheus, Grafana, Splunk, InfluxDB, Zabbix
  • Designed dashboards, improved metrics and alerting
  • Wrote Bash scripts for collecting custom metrics and automating monitoring
  • Reduced MTTR by improving alerting and overall observability
  • Worked with Oracle and InfluxDB databases, participated in RCA after incidents
Support Engineer
Sberbank Technologies
Февраль 2021 — Февраль 2022February 2021 — February 2022
  • Оказывал круглосуточную (24/7) поддержку более чем 40 бизнес-критичных банковских систем
  • Мониторинг и сопровождение продакшена с помощью Zabbix, Grafana, Splunk
  • Обрабатывал инциденты, включая failover и переключение трафика
  • Автоматизировал процессы мониторинга и отчётности
  • Работал с Linux, Oracle, PostgreSQL: анализ логов, диагностика, устранение неисправностей
  • Provided round-the-clock (24/7) support for 40+ business-critical banking systems
  • Monitored and supported production systems using Zabbix, Grafana, Splunk
  • Handled incidents, including failover procedures and traffic switching
  • Automated monitoring and reporting processes
  • Worked with Linux, Oracle, PostgreSQL: log analysis, diagnostics, troubleshooting
Support Engineer
BCS
Октябрь 2019 — Февраль 2021October 2019 — February 2021
  • Обеспечивал стабильность и мониторинг инфраструктуры онлайн-торговых систем (Zabbix, Grafana)
  • Мониторинг серверов и сетевых шлюзов, проактивное выявление аномалий
  • Анализ логов, устранение неисправностей, удалённая диагностика инцидентов
  • Контролировал доступность торговой платформы QUIK
  • Участвовал в поддержке бизнес-критичных финансовых сервисов
  • Ensured the stability and monitoring of production infrastructure for online trading systems (Zabbix, Grafana)
  • Monitored servers and network gateways, proactively identified operational anomalies
  • Performed log analysis, troubleshooting, remote incident diagnostics
  • Monitored the availability and correct operation of the QUIK trading platform
  • Participated in supporting business-critical financial services