Алексей Золотых
Head of Engineering / Руководитель разработки
Discovery и delivery · Надёжность · On-Premise · Технологическая стратегия
О себе
Руководитель разработки с 18+ годами в IT и более шести лет в ролях Team Lead, Engineering Manager и руководителя отдела.
Отвечаю за процессы discovery, delivery, качества, релизов и взаимодействия в кросс-функциональном направлении из 40 специалистов: разработка, QA, автоматизация тестирования, DevOps, дизайн, управление проектами, системный и бизнес-анализ, техническая документация.
В прямом подчинении — 24 человека: 21 разработчик и 3 инженера автоматизации тестирования. В структуре четыре тимлида, которых вырастил из разработчиков внутри направления. Команда распределена между Санкт-Петербургом, Москвой и Казанью.
Работаю с enterprise On-Premise-продуктом и real-time совместным редактированием. Строю технологические стратегии, ускоряю поставку, снижаю операционную нагрузку и развиваю инженерных лидеров.
Ключевые результаты
- Выстроил процессы discovery, delivery, качества и релизов для кросс-функционального направления из 40 специалистов.
- Прямое подчинение — 24 специалиста: 21 разработчик и 3 инженера автоматизации тестирования. Вырастил 4 тимлидов из разработчиков внутри направления.
- Масштабировал разработку с 7 до 21 инженера. Построил двухэтапный процесс собеседований; отвечал за найм и увольнения.
- За 12 месяцев при неизменном размере команды увеличил число завершённых тикетов на 30% и сократил Lead Time задач на 20%.
- Перевёл внутренние релизы с квартального цикла на ежемесячный. Доля production-дефектов оставалась стабильной.
- Автоматизировал тестовые окружения: около 30 развёртываний в день, экономия около 5 часов работы разработчиков ежедневно.
- Удалил Pregen: компонент потреблял до 30% RAM и 20–30 CPU-ядер на инсталляцию, был связан с 15% багов, 2–3 инцидентами в год и более чем 100 часами поддержки за квартал.
- Инициировал K3s-инсталлятор: в beta установка у клиента сократилась с недель до 15 минут.
- Внедрил Sentry в закрытом контуре и обязательную проверку релизов. Она находит 1–2 дефекта до production.
- Подготовил AI-направление Documents Online к beta: предложил On-Premise-совместимый подход к интеграции моделей, выстроил цикл исследований и прототипов, запустил beta-функцию под feature flag.
Опыт работы
МойОфис
Senior Engineering Manager · Санкт-Петербург · Август 2022 — настоящее время
Отвечаю за процессы discovery, delivery, качества, релизов и взаимодействия в кросс-функциональном направлении из 40 специалистов: разработка, QA, автоматизация тестирования, два DevOps-инженера, дизайн, PM, системный и бизнес-анализ, техническая документация.
В прямом подчинении 24 человека: 21 разработчик и 3 инженера автоматизации тестирования. Разработка организована в четыре команды; четыре тимлида выросли из разработчиков внутри направления и находятся в моём прямом подчинении. Команда распределена между Санкт-Петербургом, Москвой и Казанью.
Продукт поставляется On-Premise, используется в enterprise- и государственном сегментах и поддерживает совместное редактирование документов в реальном времени.
Стратегия, команда и бизнес
- Разработал и защитил перед CPO, CEO и CTO пятилетнюю технологическую стратегию направления.
- Зафиксировал в стратегии требования к качеству продукта: доступность, защита данных, безопасность, скорость работы, удобство установки и стоимость эксплуатации.
- Разложил первый год стратегии на квартальные вехи и измеримые результаты.
- Вместе с продуктом приоритизировал технические задачи по влиянию на клиентский опыт, риски, сроки поставки, стоимость внедрения и эксплуатации.
- Планировал бюджет dev-инфраструктуры: около 20 стендов, лицензии, оборудование и обучение. Обосновывал найм и закупки через влияние на скорость поставки, риски и стоимость эксплуатации.
- Масштабировал разработку с 7 до 21 инженера. Сначала проводил собеседования сам, затем построил двухэтапный процесс найма.
- Отвечал за найм и увольнения. Проводил performance review, участвовал в определении грейдов и компенсаций по процессу компании.
- Вырастил четырёх тимлидов из разработчиков внутри направления.
Discovery и работа с продуктом
- Выстроил процесс discovery для инициатив с высокой неопределённостью: исследования и прототипы ведутся отдельной веткой работ, затем проходят оценку, точку принятия решения и переводятся в delivery.
- Предложил подход к интеграции AI-моделей в Documents Online, совместимый с On-Premise-поставкой. Исходный вариант не покрывал требования поставки; предложенный подход стал фактическим стандартом направления.
- Организовал работу product manager, системного и бизнес-аналитика, дизайнеров, QA и команд разработки: проводил синхронизации, распределял ownership и фиксировал решения.
- Запустил последовательность AI-прототипов: демонстрационный сценарий, beta-функцию чата под feature flag и прототип с Model Context Protocol.
- Провёл внутреннее обучение по AI и адаптировал QA-процесс: QA начал участвовать в исследованиях, чтобы выявлять риски и проверять сценарии использования до разработки.
- Довёл AI-направление Documents Online от исследований до beta-функции. Решение прошло проверку технической готовности на встречах с руководством компании.
Delivery, качество и метрики
- Перестроил процессы четырёх команд: вместо формального Scrum и квартальных релизов внедрил потоковую работу и ежемесячные внутренние релизы.
- Ввёл Definition of Done, acceptance criteria, WIP-лимиты, визуализацию потока, подготовку задач до планирования и предварительную оценку технических решений.
- За 12 месяцев при неизменном размере команды увеличил число завершённых тикетов на 30% и сократил Lead Time задач на 20%.
- Lead Time измерял от принятия командой обязательства до готовности задачи к релизу. Релизные активности учитывались отдельно. Метрики собирал в Metabase по данным Jira и GitLab.
- Сократил планирование двухнедельного спринта с полного дня до 10 минут; демо — до 30 минут.
- Построил GitLab CI-пайплайн: unit-тесты, неубывающее покрытие, SonarQube до merge, quality gates, контроль размера бандлов и линтеры.
- Увеличил покрытие unit-тестами с 20% до 40%.
- Автоматизировал тестовые окружения frontend: после push CI/CD поднимает среду за 5 минут и добавляет ссылку в Jira. При 30 развёртываниях в день команда экономит около 5 часов работы разработчиков ежедневно.
- Сохранил стабильную долю production-дефектов при переходе к ежемесячным внутренним релизам.
- Создал дашборды по throughput, Lead Time, покрытию, качеству релизов и SLI. Настроил похожие дашборды для смежных команд.
Надёжность, On-Premise и стоимость эксплуатации
- Выявил разрыв между заявленной доступностью 99,95% и фактическим простоем On-Premise при квартальных обновлениях: 8–16 часов. Включил устранение проблемы в технологическую стратегию и дорожную карту перехода к Kubernetes-подходу.
- Проверил процесс установки у клиента: вместо заявленных 40 минут развёртывание заняло 8 часов. Сформулировал проблему и целевой показатель, согласовал инициативу и курировал выполнение смежной командой. В beta K3s-инсталлятор сократил установку с недель до 15 минут.
- Собрал данные о Pregen: компонент занимал до 30% RAM и 20–30 CPU-ядер на инсталляцию, был связан с 15% багов, 2–3 инцидентами в год и доработками примерно трети функций.
- По данным Jira команда тратила более 100 часов за квартал на поддержку Pregen, баги, обратную связь и устранение проблем.
- Защитил и поэтапно реализовал удаление Pregen. После удаления снизилась нагрузка на инфраструктуру и поддержку, исчезли связанные инциденты, Web Vitals перешли из красной зоны в зелёную.
- Внедрил Sentry на dogfooding-инстансе в закрытом контуре. После очистки дублей и ложных срабатываний выделили 10–15 реальных дефектов.
- Ввёл обязательную проверку каждого релиза через Sentry. Она находит 1–2 дефекта до production; подход затем применили другие отделы компании.
- Внедрил SLI для совместного редактирования: CPU и память узлов, количество входящих и применённых сообщений, падения Docker-контейнеров, throughput, задержка применения операций и OT-откаты.
- Выстроил процесс управления инцидентами: хронология событий, анализ первопричин методом «5 почему», задачи на устранение причин в backlog и контроль их выполнения.
- В условиях On-Premise-поставки развивал observability на dogfooding-контуре, работал с поддержкой и назначал дежурных для разбора проблем на клиентских инсталляциях.
- Спроектировал защиту от потери данных при падении OT-контейнера: журналирование операций в SQLite. Решение доведено до прототипа.
- Руководил оптимизацией совместного редактирования: ввёл нагрузочную test suite и модель нагрузки вместо проверки только числа пользователей; изменения проверялись по SLI, вручную на отзывчивость и раскатывались на dogfooding-инстансе.
EPAM Systems
Team Leader / Solution Architect · Москва · Август 2020 — Август 2022
- Руководил разработкой на Agritech-проекте Syngenta: около 20 инженеров, AWS Lambda, DynamoDB, S3, SQS и SNS.
- Был ресурсным менеджером для восьми инженеров: развитие, performance review, промоушены и карьерные планы.
- Провёл более 50 собеседований, участвовал в promotion committee.
- Проводил архитектурные ревью, участвовал в создании инженерных стандартов и presale. Оценивал решения и их стоимость для заказчика.
- Вёл внутренний курс по Node.js, получил персональный recognition badge от CEO EPAM.
Infobip
Team Lead · Санкт-Петербург · Февраль 2019 — Август 2020
- Руководил командой пользовательского портала: три backend- и три frontend-разработчика.
- Спроектировал и внедрил единую RBAC-модель для 20+ продуктовых команд.
- Внедрил code review, CI/CD, дежурства и автоматизацию релизов.
- Стек: Java, Kotlin, Kafka, Docker, Node.js, React, микросервисы, REST, SQL.
Wrike
Senior Frontend Developer / Architect · Санкт-Петербург · Декабрь 2015 — Февраль 2019
- Проектировал продуктовые решения на стыке frontend и backend.
- Рефакторил legacy-код, развивал build-системы, CI/CD и инженерную инфраструктуру.
- Участвовал в разработке архитектуры продуктовых направлений.
Ранний опыт
Senior Frontend Developer / Team Lead / Fullstack Developer · 2007 — 2015
Frontend-разработка, руководство frontend-командами, fullstack-разработка на Python и Django.
Публичная деятельность
- HolyJS 2025: «OpenTelemetry в мире JavaScript: как приручить observability в веб-приложениях».
- HolyJS 2023: «Борьба с ветряными мельницами, или Как жить с техническим долгом».
- HolyJS 2020: «Решения, которые мы принимаем. Личный взгляд на архитектуру».
- Saint TeamLead Conf 2019: «Китайские стратагемы Сунь-цзы и как они помогают мне в работе».
- PiterJS 2019: «Автоматизируй это. Гиперавтоматизированный пайплайн».
- Также выступал на CodeFest, FrontendConf, Стачке и DUMP. Все доклады.