Алексей Золотых

Head of Engineering / Руководитель разработки

Discovery и delivery · Надёжность · On-Premise · Технологическая стратегия

О себе

Руководитель разработки с 18+ годами в IT и более шести лет в ролях Team Lead, Engineering Manager и руководителя отдела.

Отвечаю за процессы discovery, delivery, качества, релизов и взаимодействия в кросс-функциональном направлении из 40 специалистов: разработка, QA, автоматизация тестирования, DevOps, дизайн, управление проектами, системный и бизнес-анализ, техническая документация.

В прямом подчинении — 24 человека: 21 разработчик и 3 инженера автоматизации тестирования. В структуре четыре тимлида, которых вырастил из разработчиков внутри направления. Команда распределена между Санкт-Петербургом, Москвой и Казанью.

Работаю с enterprise On-Premise-продуктом и real-time совместным редактированием. Строю технологические стратегии, ускоряю поставку, снижаю операционную нагрузку и развиваю инженерных лидеров.

Ключевые результаты

  • Выстроил процессы discovery, delivery, качества и релизов для кросс-функционального направления из 40 специалистов.
  • Прямое подчинение — 24 специалиста: 21 разработчик и 3 инженера автоматизации тестирования. Вырастил 4 тимлидов из разработчиков внутри направления.
  • Масштабировал разработку с 7 до 21 инженера. Построил двухэтапный процесс собеседований; отвечал за найм и увольнения.
  • За 12 месяцев при неизменном размере команды увеличил число завершённых тикетов на 30% и сократил Lead Time задач на 20%.
  • Перевёл внутренние релизы с квартального цикла на ежемесячный. Доля production-дефектов оставалась стабильной.
  • Автоматизировал тестовые окружения: около 30 развёртываний в день, экономия около 5 часов работы разработчиков ежедневно.
  • Удалил Pregen: компонент потреблял до 30% RAM и 20–30 CPU-ядер на инсталляцию, был связан с 15% багов, 2–3 инцидентами в год и более чем 100 часами поддержки за квартал.
  • Инициировал K3s-инсталлятор: в beta установка у клиента сократилась с недель до 15 минут.
  • Внедрил Sentry в закрытом контуре и обязательную проверку релизов. Она находит 1–2 дефекта до production.
  • Подготовил AI-направление Documents Online к beta: предложил On-Premise-совместимый подход к интеграции моделей, выстроил цикл исследований и прототипов, запустил beta-функцию под feature flag.

Опыт работы

МойОфис

Senior Engineering Manager · Санкт-Петербург · Август 2022 — настоящее время

Отвечаю за процессы discovery, delivery, качества, релизов и взаимодействия в кросс-функциональном направлении из 40 специалистов: разработка, QA, автоматизация тестирования, два DevOps-инженера, дизайн, PM, системный и бизнес-анализ, техническая документация.

В прямом подчинении 24 человека: 21 разработчик и 3 инженера автоматизации тестирования. Разработка организована в четыре команды; четыре тимлида выросли из разработчиков внутри направления и находятся в моём прямом подчинении. Команда распределена между Санкт-Петербургом, Москвой и Казанью.

Продукт поставляется On-Premise, используется в enterprise- и государственном сегментах и поддерживает совместное редактирование документов в реальном времени.

Стратегия, команда и бизнес
  • Разработал и защитил перед CPO, CEO и CTO пятилетнюю технологическую стратегию направления.
  • Зафиксировал в стратегии требования к качеству продукта: доступность, защита данных, безопасность, скорость работы, удобство установки и стоимость эксплуатации.
  • Разложил первый год стратегии на квартальные вехи и измеримые результаты.
  • Вместе с продуктом приоритизировал технические задачи по влиянию на клиентский опыт, риски, сроки поставки, стоимость внедрения и эксплуатации.
  • Планировал бюджет dev-инфраструктуры: около 20 стендов, лицензии, оборудование и обучение. Обосновывал найм и закупки через влияние на скорость поставки, риски и стоимость эксплуатации.
  • Масштабировал разработку с 7 до 21 инженера. Сначала проводил собеседования сам, затем построил двухэтапный процесс найма.
  • Отвечал за найм и увольнения. Проводил performance review, участвовал в определении грейдов и компенсаций по процессу компании.
  • Вырастил четырёх тимлидов из разработчиков внутри направления.
Discovery и работа с продуктом
  • Выстроил процесс discovery для инициатив с высокой неопределённостью: исследования и прототипы ведутся отдельной веткой работ, затем проходят оценку, точку принятия решения и переводятся в delivery.
  • Предложил подход к интеграции AI-моделей в Documents Online, совместимый с On-Premise-поставкой. Исходный вариант не покрывал требования поставки; предложенный подход стал фактическим стандартом направления.
  • Организовал работу product manager, системного и бизнес-аналитика, дизайнеров, QA и команд разработки: проводил синхронизации, распределял ownership и фиксировал решения.
  • Запустил последовательность AI-прототипов: демонстрационный сценарий, beta-функцию чата под feature flag и прототип с Model Context Protocol.
  • Провёл внутреннее обучение по AI и адаптировал QA-процесс: QA начал участвовать в исследованиях, чтобы выявлять риски и проверять сценарии использования до разработки.
  • Довёл AI-направление Documents Online от исследований до beta-функции. Решение прошло проверку технической готовности на встречах с руководством компании.
Delivery, качество и метрики
  • Перестроил процессы четырёх команд: вместо формального Scrum и квартальных релизов внедрил потоковую работу и ежемесячные внутренние релизы.
  • Ввёл Definition of Done, acceptance criteria, WIP-лимиты, визуализацию потока, подготовку задач до планирования и предварительную оценку технических решений.
  • За 12 месяцев при неизменном размере команды увеличил число завершённых тикетов на 30% и сократил Lead Time задач на 20%.
  • Lead Time измерял от принятия командой обязательства до готовности задачи к релизу. Релизные активности учитывались отдельно. Метрики собирал в Metabase по данным Jira и GitLab.
  • Сократил планирование двухнедельного спринта с полного дня до 10 минут; демо — до 30 минут.
  • Построил GitLab CI-пайплайн: unit-тесты, неубывающее покрытие, SonarQube до merge, quality gates, контроль размера бандлов и линтеры.
  • Увеличил покрытие unit-тестами с 20% до 40%.
  • Автоматизировал тестовые окружения frontend: после push CI/CD поднимает среду за 5 минут и добавляет ссылку в Jira. При 30 развёртываниях в день команда экономит около 5 часов работы разработчиков ежедневно.
  • Сохранил стабильную долю production-дефектов при переходе к ежемесячным внутренним релизам.
  • Создал дашборды по throughput, Lead Time, покрытию, качеству релизов и SLI. Настроил похожие дашборды для смежных команд.
Надёжность, On-Premise и стоимость эксплуатации
  • Выявил разрыв между заявленной доступностью 99,95% и фактическим простоем On-Premise при квартальных обновлениях: 8–16 часов. Включил устранение проблемы в технологическую стратегию и дорожную карту перехода к Kubernetes-подходу.
  • Проверил процесс установки у клиента: вместо заявленных 40 минут развёртывание заняло 8 часов. Сформулировал проблему и целевой показатель, согласовал инициативу и курировал выполнение смежной командой. В beta K3s-инсталлятор сократил установку с недель до 15 минут.
  • Собрал данные о Pregen: компонент занимал до 30% RAM и 20–30 CPU-ядер на инсталляцию, был связан с 15% багов, 2–3 инцидентами в год и доработками примерно трети функций.
  • По данным Jira команда тратила более 100 часов за квартал на поддержку Pregen, баги, обратную связь и устранение проблем.
  • Защитил и поэтапно реализовал удаление Pregen. После удаления снизилась нагрузка на инфраструктуру и поддержку, исчезли связанные инциденты, Web Vitals перешли из красной зоны в зелёную.
  • Внедрил Sentry на dogfooding-инстансе в закрытом контуре. После очистки дублей и ложных срабатываний выделили 10–15 реальных дефектов.
  • Ввёл обязательную проверку каждого релиза через Sentry. Она находит 1–2 дефекта до production; подход затем применили другие отделы компании.
  • Внедрил SLI для совместного редактирования: CPU и память узлов, количество входящих и применённых сообщений, падения Docker-контейнеров, throughput, задержка применения операций и OT-откаты.
  • Выстроил процесс управления инцидентами: хронология событий, анализ первопричин методом «5 почему», задачи на устранение причин в backlog и контроль их выполнения.
  • В условиях On-Premise-поставки развивал observability на dogfooding-контуре, работал с поддержкой и назначал дежурных для разбора проблем на клиентских инсталляциях.
  • Спроектировал защиту от потери данных при падении OT-контейнера: журналирование операций в SQLite. Решение доведено до прототипа.
  • Руководил оптимизацией совместного редактирования: ввёл нагрузочную test suite и модель нагрузки вместо проверки только числа пользователей; изменения проверялись по SLI, вручную на отзывчивость и раскатывались на dogfooding-инстансе.

EPAM Systems

Team Leader / Solution Architect · Москва · Август 2020 — Август 2022

  • Руководил разработкой на Agritech-проекте Syngenta: около 20 инженеров, AWS Lambda, DynamoDB, S3, SQS и SNS.
  • Был ресурсным менеджером для восьми инженеров: развитие, performance review, промоушены и карьерные планы.
  • Провёл более 50 собеседований, участвовал в promotion committee.
  • Проводил архитектурные ревью, участвовал в создании инженерных стандартов и presale. Оценивал решения и их стоимость для заказчика.
  • Вёл внутренний курс по Node.js, получил персональный recognition badge от CEO EPAM.

Infobip

Team Lead · Санкт-Петербург · Февраль 2019 — Август 2020

  • Руководил командой пользовательского портала: три backend- и три frontend-разработчика.
  • Спроектировал и внедрил единую RBAC-модель для 20+ продуктовых команд.
  • Внедрил code review, CI/CD, дежурства и автоматизацию релизов.
  • Стек: Java, Kotlin, Kafka, Docker, Node.js, React, микросервисы, REST, SQL.

Wrike

Senior Frontend Developer / Architect · Санкт-Петербург · Декабрь 2015 — Февраль 2019

  • Проектировал продуктовые решения на стыке frontend и backend.
  • Рефакторил legacy-код, развивал build-системы, CI/CD и инженерную инфраструктуру.
  • Участвовал в разработке архитектуры продуктовых направлений.

Ранний опыт

Senior Frontend Developer / Team Lead / Fullstack Developer · 2007 — 2015

Frontend-разработка, руководство frontend-командами, fullstack-разработка на Python и Django.

Публичная деятельность