Масштаб и платформа
Kubernetes, отказоустойчивые и локальные установки, запас мощностей, нагрузочные тесты до релиза.
Александр Гоманов, Санкт-Петербург. В ИТ с 2009 года, последние четыре года — руководитель отделов инфраструктуры и DevOps/SRE. Сейчас в SimpleOne, корпорация ITG. Ищу постоянную работу в штате.
Опыт
Инфраструктура и платформа продукта: подготовка к Kubernetes, хранилище, процессы выпуска, запас мощностей. До этого в ITGLOBAL.COM (та же корпорация) руководил отделом управляемых сервисов.
Общая ИТ-команда холдинга (юридически оформлен в Kadam): бюджеты, инструменты, процессы и инфраструктура для всех компаний группы.
Сервисные контракты по России и СНГ. Ресурсы, сроки, бюджеты, риски.
Linux и Windows, мониторинг, дежурные смены, автоматизация рутины. Качество поддержки за это время выросло с 80% до 95%.
Как это выглядело изнутри — разборы кейсов →
Цифры
Надёжность
Деньги
Масштаб
Команда и процессы
Кейсы
Полная подборка — на странице кейсов →
15 репозиториев, 20+ критичных блокеров, бэклог по приоритетам. Тестовый контур запустили в срок.
Открыть → Деньги · хранилище18 корзин, ≥400 ГБ. До 180 ГБ можно освободить, рост поймали до того, как кончилось место.
Открыть → Деньги · экономикаПервая модель прибылей и убытков, план-факт, маржинальность по услугам. Бесплатные работы прекратились.
Открыть → Надёжность · мониторингМодели здоровья и алерты, разбор аварии PostgreSQL/Patroni, ручные действия заменили автоматикой.
Открыть → Процессы · очередиРазделил поддержку и разработку, завёл очереди и метрики. Техдолг −88%, медиана 7 → 5,9 дня.
Открыть → Услуга · SLAОт требований до эксплуатации: реакция за 7 минут круглосуточно, +48% выручки на час инженера.
Открыть →Зоны ответственности
Kubernetes, отказоустойчивые и локальные установки, запас мощностей, нагрузочные тесты до релиза.
Понятные затраты, связка мощностей с бюджетом, биллинг, маржинальность услуг, чистка лишнего.
SLO/SLA, метрики, логи, алерты, модели здоровья сервисов, разбор аварий и работа с их причинами.
Структура, зоны ответственности, разделение поддержки и разработки, KPI, очереди, эскалации.
Технологии
Безопасность — часть моего бэкграунда с 2009 года: анализ рисков, харденинг, защита периметра, устойчивость под нагрузкой, разбор атак и очерёдность исправлений. Я не пентестер. Смотрю на инфраструктуру глазами того, кому её потом эксплуатировать.
Форматы
Руководящую роль в штате продуктовой или сервисной компании, удалённо или гибрид. Проекты и консультации беру как дополнение, а не вместо основной работы.
Руководитель инфраструктуры, DevOps, платформы или SRE
Аудит, стабилизация, настройка процессов с фиксированным сроком
Инженерный советник для технического директора и техлида
Консалтинг и проекты — отдельно на gomandev.ru
Контакты
P.S. Если нужен не сотрудник в штат, а внешний проект — аудит эксплуатации или стабилизация — это отдельно на gomandev.ru →