01
Эксплуатация и надёжностьOperations & Reliability
Круглосуточные дежурства, разбор инцидентов L3, поиск первопричин, планирование ресурсов и документированные процедуры восстановления.On-call operations, L3 incident investigation, root-cause analysis, capacity planning and documented recovery procedures.
↗
02
Платформы и поставкаPlatforms & Delivery
Docker Swarm, Traefik, Nginx, Ansible, GitLab CI/CD и GitOps-процессы с проверкой конфигурации, аудитом изменений и управляемым откатом.Docker Swarm, Traefik, Nginx, Ansible, GitLab CI/CD and GitOps workflows with configuration checks, change auditing and controlled rollback.
↗
03
НаблюдаемостьObservability
Zabbix, Grafana, Prometheus и Graylog: технические и бизнес-метрики, централизованные журналы, оповещения и эксплуатационные панели.Zabbix, Grafana, Prometheus and Graylog: technical and business metrics, centralized logs, alerting and operational dashboards.
↗
04
Сети и безопасностьNetworks & Security
WireGuard/IPsec, BGP/BFD, сегментация, фильтрация L3–L7, WAF, управление секретами, сканирование образов и анализ сетевых инцидентов.WireGuard/IPsec, BGP/BFD, segmentation, L3–L7 filtering, WAF, secrets management, image scanning and network incident analysis.
↗
05
Данные и восстановлениеData & Recovery
ZFS RAIDZ, MySQL/MariaDB Galera, Oracle DB, Restic и S3: производительность, резервное копирование, контроль выполнения и тестовые восстановления.ZFS RAIDZ, MySQL/MariaDB Galera, Oracle DB, Restic and S3: performance, backups, execution controls and recovery testing.
↗
06
Диагностика и кодDiagnostics & Code
Bash, Python, Go, PHP и C++; анализ журналов, системных вызовов, сетевого трафика и аварийных дампов с помощью GDB.Bash, Python, Go, PHP and C++; analysis of logs, system calls, network traffic and core dumps with GDB.
↗