Отборочный контест
Online coding contestАвтоматически проверяемые задачи до собеседования
На чём валятся- Решение «в лоб», которое проходит примеры и падает на максимальных ограничениях.
- Потеря часа на самой трудной задаче вместо двух средних.
Лента и рекомендации, видео, модерация, голосовые сервисы
Соцсеть и медиахолдинг: главный продукт — лента, а значит ранжирование на огромном потоке пользовательского контента. Отсюда акценты отбора: рекомендации и метрики вовлечённости, работа с мультимодальным контентом и умение доводить модель до сервиса, который отвечает миллионам людей одновременно.
Порядок и состав секций меняются от команды к команде — это типовая схема, собранная по открытым источникам. Этапы, на которых проверяют знания, ведут в разбор формата: что оценивают и чем закрывать пробелы.
Рекрутер уточняет направление: лента и рекомендации, видео, модерация, реклама, голосовые продукты.
На стажировках и в образовательных программах отбор начинается с контеста: задачи проверяются автоматически, обратная связь — только вердикт системы.
Отдельная секция по алгоритмам и коду. Задачи рабочего уровня: структуры данных, сложность, аккуратная реализация.
ML-секция: постановка, признаки, валидация, метрики. Вопросы идут от проектов в резюме, поэтому свой опыт нужно знать до деталей.
Направленческая секция. Для ленты и рекламы — ранжирование и метрики вовлечённости, для медиа — зрение и мультимодальность.
Дизайн системы на middle+: как устроен сервис рекомендаций под нагрузкой и что происходит, когда часть источников отвалилась.
Разговор с руководителем: задачи команды, уровень, процессы.
5 форматов проверки из отбора VK — и тест атласа под каждый. Слабые места видно сразу после захода, а темы для разбора собираются автоматически.
Автоматически проверяемые задачи до собеседования
На чём валятсяЖивое кодирование: решение вслух и код в редакторе
На чём валятсяКлассика табличных задач и честная проверка качества
На чём валятсяКандидаты, ранжирование, метрики @K и расхождение с онлайном
На чём валятсяОт постановки до эксплуатации на одной доске
На чём валятся20 тем по всем направлениям VK — если команда ещё не выбрана. Программа разложит их по неделям от математики к продакшену; под конкретное направление список короче, и его можно собрать ниже.
Эти 20 тем можно разложить по неделям: программа выстроит их от математики к продакшену, поставит тест в конце каждой недели и вернёт тему на повторение, если вы в ней ошиблись. Выйдет примерно 4 недели под VK · Все направления.
Проверяем, вошли ли вы…
Выберите направление: обязательные темы со ссылками в атлас, типовые вопросы с ответами и тест для самопроверки.
Ранжирование ленты, подбор видео и рекламы. Специфика — короткий цикл обратной связи, сильная петля «показали → кликнули → снова показали» и требование разнообразия рядом с вовлечённостью.
Эти 10 тем можно разложить по неделям: программа выстроит их от математики к продакшену, поставит тест в конце каждой недели и вернёт тему на повторение, если вы в ней ошиблись. Выйдет примерно 2 недели под VK · Лента и рекомендации.
Проверяем, вошли ли вы…
Она схлопнется к самому кликабельному формату: выдача станет однообразной, а долгосрочное удержание просядет. Лечится многокритериальной оптимизацией — вовлечённость плюс разнообразие, штраф за повторы, длинные метрики вроде возвратов через неделю — и обязательной долей разведочного показа.
Разбор в атласе: A/B testing — A/B-тестирование →Несколькими дешёвыми источниками сразу: ANN-поиск по эмбеддингам, популярное в сегменте, свежее от подписок, коллаборативные соседи. Их объединение идёт в ранжирующую модель. Потолок качества всей ленты задаёт recall@k этого этапа — его и меряют отдельно.
Разбор в атласе: Serving Architecture — Архитектура инференса →Холодный старт закрывается контентными признаками (текст, изображение, тема) и явной долей разведочного трафика — бандитами с контролируемым риском. Без этого система обучается только на том, что сама уже показала, и новые авторы не появляются никогда.
Разбор в атласе: Multi-armed Bandits — Многорукие бандиты →Сначала смещение показа: офлайн считается на логах старой модели. Затем расхождение признаков между обучением и сервисом. Затем сама метрика: NDCG по кликам не обязан двигать удержание. Проверяют в порядке возрастания стоимости проверки.
Разбор в атласе: A/B testing — A/B-тестирование →