Поговорил с Jiangxia Cao из Kuaishou OneRec Team на SIGIR’26
Признаю, я давний фанат Kuaishou. Это люди, которые внедряют много всего в прод и с невероятной скоростью. При этом еще и успевают писать про это статьи.
На конференции SIGIR’26 мне удалось пообщаться с Jiangxia Cao, одним из ключевых разработчиков в OneRec Team из Kuaishou. У него более 1800 цитирований, он является соавтором таких работ, как OneReason, Kwai Summary Attention, QARM, OpenOneRec и еще многих других. Отдельно хочу отметить его отзывчивость и позитивность.
У меня к нему было много вопросов, но задал я лишь маленькую часть. Несколькими решил с вами поделиться.
* Сейчас происходит активное интегрирование LLM в рекомендательные системы. Какие вы с командой видите наиболее перспективные направления?
Они верят в три способа, как можно внедрять LLM в платформу с рекомендациями коротких видео:
1. Как generative retrieval на semantic ids, то есть как дополнительный источник кандидатов. Понятный способ, активно внедряют к себе многие крупные ребята. Здесь как раз примерами служат такие работы, как OneReason от Kuaishou или PLUM от DeepMind.
2. Как “агента”, который может замешивать разные кандидатогенераторы (кандгены). Будто вызов каждого источника кандидатов — это свой tool call. Необычный способ, раньше про такой не слышал. Jiangxia сказал, что у них может быть до 200 кандгенов. И нужно как-то адаптивно под запрос пользователя выбирать подмножество из них. После этого выходы именно этих выбранных кандгенов и будут ранжироваться последующими моделями в стеке. То есть LLM в некотором смысле выполняет роль Mixigen.
3. Как инструмент, через который можно управлять бесконечной лентой рекомендаций через текст. Мы открыли ВК Клипы, и он на их примере показал, как это выглядит. Если человек, например, 5 раз подряд быстро пролистал клипы, то появляется текстовое окно. В него ты можешь вписать, какой контент ты хочешь видеть в ленте. И лента подстраивается под тебя. Если ты ставишь дизлайк на клип, то вылезает еще одно окно, в которое ты вписываешь, что тебе не понравилось. Такая фича в Kuaishou появляется уже через месяц! Большой шаг в сторону controllable и unbiased рекомендаций.
* В вашем текущем OneRec Technical Report после генерации кандидатов генеративной моделью есть еще доотбор Reward-моделью. А вы не думали о том, чтобы от этой стадии доотбора избавиться?
Здесь он сказал, что через месяц как раз выходит статья про это. Но отдельно подчеркнул, что в коротких видео их основная рекомендательная система состоит из четырех стадий, в которой OneRec заменяет только первые две.
* Как вам удается писать так много статей? У вас на это есть специальные KPI, и вас хвалят за статьи на ревью?
Сказал, что они работают с понедельника по пятницу в обычном режиме. Их KPI — это растить продуктовые метрики. А по выходным уже пишут статьи в свое удовольствие. Получается, 9-9-6 — это обман, у ребят пятидневка.
Дальше мы много говорили про OneReason. Это большой техрепорт от ребят на 110 страниц. Сделаю про него отдельный разбор на канале, уж очень масштабная работа. И уже там расскажу подробности.
И еще несколько интересных фактов:
* Послушали вместе мою волну в Яндекс Музыке. У меня пошел русский рэп. Он попросил включить погромче, и ему прям зашло.
* Он знает про работу ребят из Яндекса — Gryphon: A Unified Architecture for Semantic-ID Generation and Item-Level Scoring in Industrial Recommendations. Сказал, что они ее там все вместе читали.
Признаю, я давний фанат Kuaishou. Это люди, которые внедряют много всего в прод и с невероятной скоростью. При этом еще и успевают писать про это статьи.
На конференции SIGIR’26 мне удалось пообщаться с Jiangxia Cao, одним из ключевых разработчиков в OneRec Team из Kuaishou. У него более 1800 цитирований, он является соавтором таких работ, как OneReason, Kwai Summary Attention, QARM, OpenOneRec и еще многих других. Отдельно хочу отметить его отзывчивость и позитивность.
У меня к нему было много вопросов, но задал я лишь маленькую часть. Несколькими решил с вами поделиться.
* Сейчас происходит активное интегрирование LLM в рекомендательные системы. Какие вы с командой видите наиболее перспективные направления?
Они верят в три способа, как можно внедрять LLM в платформу с рекомендациями коротких видео:
1. Как generative retrieval на semantic ids, то есть как дополнительный источник кандидатов. Понятный способ, активно внедряют к себе многие крупные ребята. Здесь как раз примерами служат такие работы, как OneReason от Kuaishou или PLUM от DeepMind.
2. Как “агента”, который может замешивать разные кандидатогенераторы (кандгены). Будто вызов каждого источника кандидатов — это свой tool call. Необычный способ, раньше про такой не слышал. Jiangxia сказал, что у них может быть до 200 кандгенов. И нужно как-то адаптивно под запрос пользователя выбирать подмножество из них. После этого выходы именно этих выбранных кандгенов и будут ранжироваться последующими моделями в стеке. То есть LLM в некотором смысле выполняет роль Mixigen.
3. Как инструмент, через который можно управлять бесконечной лентой рекомендаций через текст. Мы открыли ВК Клипы, и он на их примере показал, как это выглядит. Если человек, например, 5 раз подряд быстро пролистал клипы, то появляется текстовое окно. В него ты можешь вписать, какой контент ты хочешь видеть в ленте. И лента подстраивается под тебя. Если ты ставишь дизлайк на клип, то вылезает еще одно окно, в которое ты вписываешь, что тебе не понравилось. Такая фича в Kuaishou появляется уже через месяц! Большой шаг в сторону controllable и unbiased рекомендаций.
* В вашем текущем OneRec Technical Report после генерации кандидатов генеративной моделью есть еще доотбор Reward-моделью. А вы не думали о том, чтобы от этой стадии доотбора избавиться?
Здесь он сказал, что через месяц как раз выходит статья про это. Но отдельно подчеркнул, что в коротких видео их основная рекомендательная система состоит из четырех стадий, в которой OneRec заменяет только первые две.
* Как вам удается писать так много статей? У вас на это есть специальные KPI, и вас хвалят за статьи на ревью?
Сказал, что они работают с понедельника по пятницу в обычном режиме. Их KPI — это растить продуктовые метрики. А по выходным уже пишут статьи в свое удовольствие. Получается, 9-9-6 — это обман, у ребят пятидневка.
Дальше мы много говорили про OneReason. Это большой техрепорт от ребят на 110 страниц. Сделаю про него отдельный разбор на канале, уж очень масштабная работа. И уже там расскажу подробности.
И еще несколько интересных фактов:
* Послушали вместе мою волну в Яндекс Музыке. У меня пошел русский рэп. Он попросил включить погромче, и ему прям зашло.
* Он знает про работу ребят из Яндекса — Gryphon: A Unified Architecture for Semantic-ID Generation and Item-Level Scoring in Industrial Recommendations. Сказал, что они ее там все вместе читали.