AI STAR TECH
Внешняя ML-команда для e-commerce
Outsource · Outstaff
Обсудить задачу

Закроем позавчерашний дедлайн уже сегодня

Внешняя ML-команда из олимпиадников для Ваших задач. Сопровождаем от первой встречи до ваших KPI.

Ваш текущий проблемсет
Три задачи, которые обычно приводят к нам
A
Бизнес требует результат уже вчера
не решено
B
В бэклоге больше задач, чем команда успевает закрыть
не решено
C
Внутренний HR не успевает нанимать
не решено
У нас есть 2 решения
Выбираете вы — исходя из того, сколько ответственности хотите оставить у себя
Outsource

Берём реализацию продукта, технологии или модели полностью на себя. 100% ответственности за результат и автономии на нас.

Outstaff

Вы полностью управляете нашими специалистами, как штатными сотрудниками. Наша команда всегда рядом: вовремя сделаем бесшовную замену людей и привлечём дополнительную экспертизу, чтобы довести проект.

80продуктов разработали и вывели в продакшен
100инженеров работает над задачами клиентов прямо сейчас

От нас бесплатная проработка архитектуры и команда на 2 недели.

Получить бесплатную команду
Кейсы

Задачи, которые мы уже закрыли

LLM, Computer Vision, Speech и MLOps. Каждая карточка — задача, решение и результат целиком.

Листайте вбок
Контент и персонализация
Тексты, отзывы, локализация, рекомендации
4
01 решено

Content Generation for Product Cards

Задача

Автоматизировали подготовку описаний и SEO-текстов для каталога поставщика.

Решение

Собрали генерацию по attribute-grounded промптам с few-shot примерами из эталонных карточек, NLI-верификацией фактов против атрибутов и rule-based проверкой запрещённых формулировок. Заголовки прогоняются через мультиармед-бандит на живом трафике, шаблоны версионируются в prompt registry.

Результат

Подготовка карточки ↓ с 25 до 3 минут · органический трафик на карточки ↑27% · конверсия ↑6%

02 решено

Review Summarization for Product Cards

Задача

Заменили ленту отзывов на структурированную сводку плюсов и минусов в карточке товара.

Решение

Реализовали ABSA-разметку аспектов и тональности, кластеризацию формулировок по эмбеддингам, map-reduce суммаризацию с extractive-отбором репрезентативных цитат и инкрементальный пересчёт сводки при накоплении новых отзывов. Качество контролируется LLM-as-a-Judge с калибровкой на экспертной разметке.

Результат

Конверсия в карточках со сводкой ↑9% · возвраты ↓6% · доля пользователей, дочитывающих отзывы, ↑ в 2,3 раза

03 решено

Multilingual Listing Localization

Задача

Локализовали каталог для выхода площадки на новые рынки.

Решение

Собрали MT-пайплайн с glossary-constrained декодированием и защитой плейсхолдеров, конвертацией единиц и размерных сеток, агентом-редактором для терминологической консистентности и QE-моделью (quality estimation) для отбора сегментов на ручную вычитку.

Результат

Локализовано 2,8 млн карточек за 3 месяца · доля правок носителями ↓ с 40% до 7% · GMV новых рынков ↑ в 3,1 раза за полгода

04 решено

Personalized Recommendations

Задача

Заменили правила на обучаемые рекомендации в карточке товара и корзине.

Решение

Собрали two-stage архитектуру: кандидатогенерация на two-tower модели и item2vec по сессиям с ANN-поиском, ранжирование бустингом на поведенческих и контентных фичах через feature store с онлайн-обновлением. Холодный старт закрыт контентными эмбеддингами, разнообразие — MMR, эксплорация — Thompson sampling.

Результат

CTR блока рекомендаций ↑34% · средний чек ↑8% · доля выручки из рекомендаций 19%

Агенты и ассистенты на LLM
Диалог, инструменты, документы, регламенты
10
05 решено

Conversational Shopping Assistant

Задача

Запустили диалогового ассистента-консультанта в каталоге площадки вместо фильтров и поиска по ключевым словам.

Решение

Собрали ReAct-агента на LangGraph с slot filling по обязательным атрибутам категории, NL2Query-транслятором в фасетный запрос к Elasticsearch, hybrid retrieval (BM25 + dense) для подбора кандидатов и cross-encoder реранкером. Ответ формируется со structured output и обязательным grounding на карточки; стриминг через SSE, KV-кэш и семантическое кэширование запросов для контроля latency.

Результат

Конверсия в заказ в диалоговом сценарии ↑29% против обычного поиска · доля сессий с нулевым результатом ↓ с 11% до 2% · средний чек ↑7%

06 решено

Buyer Support Agent with Order Tools

Задача

Автоматизировали поддержку покупателей с доступом к реальным данным заказов.

Решение

Реализовали function calling к 11 внутренним API с JSON Schema-валидацией аргументов, идемпотентными ключами на мутирующих операциях и policy-слоем лимитов на сумму компенсации. Планировщик поддерживает multi-hop reasoning, при низком confidence срабатывает HITL-эскалация; поверх — guardrails на prompt injection и PII-редакция в логах.

Результат

Полностью автоматизировано 71% обращений · success rate вызова инструментов 0,93 · стоимость обращения ↓54%

07 решено

Seller Support Copilot

Задача

Автоматизировали поддержку продавцов на площадке с 40 тыс. обращений в месяц.

Решение

Построили RAG поверх базы знаний и регламентов: семантический чанкинг с сохранением структуры разделов, гибридный retrieval с MMR-диверсификацией, реранкер и цитирование источников. Добавили tool calling к API селлерского кабинета, confidence-based routing на оператора и офлайн-оценку через RAGAS-подобные метрики (faithfulness, answer relevancy).

Результат

Полностью автоматизировано 63% обращений · CSAT 4,4 из 5 · первая реакция ↓ с 4 часов до 30 секунд

08 решено

Merchandising Copilot (Text-to-SQL)

Задача

Дали категорийным менеджерам возможность запрашивать аналитику на естественном языке вместо тикетов в BI.

Решение

Собрали Text-to-SQL агента поверх семантического слоя: few-shot retrieval схемы и метрик из векторного индекса, генерация SQL с валидацией через AST-парсер и EXPLAIN-прогон, self-correction по ошибке движка, sandbox с read-only ролью и лимитом на скан. Результат проходит sanity-чеки на аномалии и рендерится в график.

Результат

Execution accuracy 0,89 на бенчмарке из 500 запросов · нагрузка на BI-команду ↓62% · время до ответа ↓ с 2 дней до 40 секунд

09 решено

Listing Compliance Agent

Задача

Автоматизировали проверку карточек на соответствие правилам площадки и требованиям законодательства.

Решение

Построили мультимодальный пайплайн: OCR по изображениям, VLM-детекция запрещённых элементов, RAG по регламентам с точным цитированием пунктов и агент-верификатор с Reflection для отсева ложных срабатываний. Правила вынесены в декларативный DSL, пороги калиброваны по стоимости ошибки I/II рода.

Результат

Автопроверка покрывает 88% потока карточек · пропуск нарушений ↓69% · доля замечаний, принятых селлерами без спора, 84%

10 решено

Supplier Document Processing Agent

Задача

Автоматизировали разбор прайс-листов, спецификаций и счетов от поставщиков.

Решение

Собрали IDP-пайплайн: layout-aware парсинг PDF/XLSX с восстановлением таблиц, OCR для сканов, LLM-экстракция позиций со structured output и per-field confidence. Номенклатура мэтчится через blocking по эмбеддингам плюс классификатор пар, агент-верификатор перепроверяет спорные строки против исходного фрагмента.

Результат

Точность извлечения позиций 0,96 · обработка прайса ↓ с 3 часов до 8 минут · доля документов без участия оператора 79%

11 решено

B2B RFQ & Quotation Agent

Задача

Автоматизировали обработку запросов на закупку от корпоративных клиентов.

Решение

Реализовали парсинг заявок из свободного текста и Excel с нормализацией единиц измерения, retrieval аналогов по эмбеддингам с фильтрами по наличию и срокам, расчёт цены по контрактной матрице через tool calling к прайсинг-сервису и генерацию КП по шаблону с валидацией итоговых сумм.

Результат

Подготовка КП ↓ с 6 часов до 20 минут · покрытие позиций каталогом ↑ с 61% до 88% · конверсия в заказ ↑23%

12 решено

Dispute Resolution Agent

Задача

Ускорили разбор споров между покупателями и продавцами на площадке.

Решение

Собрали мультиагентный граф: экстрактор событий из переписки, VLM-анализ фото-доказательств, сшивка таймлайна с логами трекинга, RAG по правилам площадки и агент-арбитр, выдающий решение со ссылками на пункты. Калибровка порога автоприменения — по согласию с исторической разметкой арбитров.

Результат

Совпадение с решением арбитра 87% · срок разбора ↓ с 7 дней до 1 дня · повторные апелляции ↓38%

13 решено

Seller Onboarding Agent

Задача

Сократили срок выхода нового продавца на площадку.

Решение

Реализовали stateful-агента с персистентным чек-пойнтингом прогресса: KYC-проверка документов через OCR и сверку с реестрами, bulk-импорт прайса с автомэтчингом к категориям, RAG-подсказки по требованиям и проактивные напоминания по незакрытым шагам.

Результат

Срок до первой продажи ↓ с 18 до 6 дней · доля дошедших до публикации ↑ с 54% до 81% · нагрузка на менеджеров онбординга ↓47%

14 решено

LLM Evaluation & Guardrails

Задача

Поставили LLM-сервисы площадки на регулярную оценку качества и защиту от нежелательного поведения.

Решение

Построили golden-датасеты и синтетические сценарии на каждый сервис, автометрики плюс LLM-as-a-Judge с калибровкой по Cohen's kappa к экспертам, регрессионные прогоны в CI на каждый промпт-коммит. В рантайме — детекторы prompt injection и jailbreak, PII-редакция, ограничение output-схемы и трейсинг всех вызовов с онлайн-семплированием на ревью.

Результат

Автоматизировали 85% проверок · время оценки релиза ↓80% · критичные инциденты в проде ↓35%

Модели и данные каталога
Поиск, матчинг, цены, спрос, антифрод
12
15 решено

Attribute Extraction & Catalog Enrichment

Задача

Автоматизировали заполнение атрибутов товаров для платформы с 12 тыс. активных селлеров.

Решение

Реализовали мультимодальную экстракцию: VLM по изображениям плюс LLM со structured output и constrained decoding по JSON Schema категории. Значения нормализуются через fuzzy-мэтчинг к справочнику допустимых, low-confidence поля уходят в active learning-цикл, на накопленной разметке дистиллировали лёгкий encoder для массового потока.

Результат

Заполненность атрибутов 47% → 92% · точность извлечения 0,95 · конверсия в поиске по фильтрам ↑12%

16 решено

Semantic Search & Ranking

Задача

Переработали поиск по каталогу с ключевых слов на семантический с обучаемым ранжированием.

Решение

Дообучили bi-encoder контрастивно (InfoNCE) на кликовых логах с in-batch и hard negatives из ANN-выдачи, добавили cross-encoder реранкер и LTR-модель на LambdaMART с бизнес-фичами. Индекс — HNSW с квантованием, дебиасинг позиционного клика, онлайн-валидация через interleaving.

Результат

NDCG@10 0,58 → 0,81 · нулевые выдачи ↓ с 9% до 1,5% · конверсия поиска в заказ ↑16%

17 решено

Product Matching Across Suppliers

Задача

Связали товарные карточки поставщиков с единым каталогом маркетплейса.

Решение

Реализовали классическую схему entity resolution: blocking кандидатов через ANN по текстовым и CLIP-эмбеддингам, попарный классификатор на градиентном бустинге с признаками сходства (Jaccard по токенам, косинус по эмбеддингам, совпадение GTIN/артикулов), транзитивное замыкание кластеров и порог с очередью на ручную верификацию.

Результат

F1 мэтчинга 0,93 · автоматически сопоставлено 4,1 млн SKU · ручной труд контент-менеджеров ↓85%

18 решено

Category Auto-Classification

Задача

Автоматизировали раскладку новых товаров по дереву категорий из 4 500 узлов.

Решение

Обучили иерархический классификатор с late fusion текстового encoder'а и визуального бэкбона, level-wise декодированием по дереву и label smoothing на несбалансированных классах. Длинный хвост закрыли few-shot ретривалом по прототипам, добавили temperature scaling для калибровки и отсечку на модерацию по энтропии предсказания.

Результат

Accuracy 0,94 на топ-уровне, 0,86 на листьях · автоматически размечено 92% новых карточек · время публикации товара ↓ с 2 дней до 15 минут

19 решено

Duplicate & Variant Consolidation

Задача

Схлопнули дубли карточек и собрали товарные варианты в одну сущность.

Решение

Построили near-duplicate detection на MinHash/LSH по тексту и перцептивных хэшах плюс CLIP-эмбеддингах по фото, агломеративную кластеризацию с порогом по связности графа сходства и выделение осей вариативности из нормализованных атрибутов. Мастер-карточка выбирается скоринговой моделью по полноте и качеству контента.

Результат

Каталог сократился на 21% без потери ассортимента · конверсия в карточке ↑9% · нагрузка на модерацию ↓40%

20 решено

Dynamic Pricing for Sellers

Задача

Сделали сервис рекомендаций по цене для продавцов площадки.

Решение

Оценили эластичность спроса причинно — double machine learning на исторических промо плюс гео-эксперименты для валидации, — построили прогноз спроса от цены и оптимизатор под ограничения (маржа, ценовые линейки, MAP). Мониторинг цен конкурентов внутри площадки идёт стримом, политика раскатывается через switchback-тесты.

Результат

GMV подключённых селлеров ↑11% · маржа ↑3,4 п.п. · сервисом пользуются 6 200 продавцов

21 решено

Demand Forecasting & Replenishment

Задача

Построили прогноз спроса и рекомендации по пополнению склада для оптового дистрибьютора.

Решение

Обучили глобальную модель на градиентном бустинге с лаговыми и календарными фичами плюс LightGBM-квантильные головы для оценки неопределённости, добавили hierarchical reconciliation по SKU/склад/регион и учёт промо-каннибализации. Прогноз распределения подаётся в MILP-оптимизатор заказов с ограничениями по бюджету, MOQ и срокам поставки.

Результат

WAPE 16% против 29% у baseline · out-of-stock ↓38% · неликвидные остатки ↓22%

22 решено

Seller Fraud & Counterfeit Detection

Задача

Выявили недобросовестных продавцов и контрафакт на площадке.

Решение

Свели поведенческие фичи в feature store, построили граф «аккаунт — устройство — реквизиты — адрес» и обучили GNN на подграфах поверх community detection, добавили image similarity-поиск по эталонам брендов для детекции подделок. Спорные кейсы уходят LLM-агенту, собирающему объяснимое досье для модератора.

Результат

Precision выявления 0,88 · заблокировано 3 400 карточек контрафакта · жалобы правообладателей ↓57%

23 решено

Review Moderation & Fake Detection

Задача

Автоматизировали модерацию отзывов и выявление накруток.

Решение

Дообучили encoder-классификатор на многоклассовой разметке нарушений с калибровкой порогов под целевой precision, добавили детекцию накруток по биграфу «покупатель — селлер» (плотность, синхронность публикаций, burst-детекция) и стилометрические признаки шаблонных текстов.

Результат

Автомодерация покрывает 91% потока · доля пропущенных нарушений ↓64% · удалено 210 тыс. накрученных отзывов

24 решено

Returns Reason Analytics

Задача

Разобрали причины возвратов по свободным комментариям покупателей для платформы селлеров.

Решение

Обучили multi-label классификатор причин на слабой разметке с последующей экспертной калибровкой, связали причины с атрибутами карточки и посчитали uplift возвратов по признакам. Рекомендации селлерам приоритизируются по ожидаемому эффекту на маржу.

Результат

Macro-F1 0,88 · возвраты у селлеров, применивших рекомендации, ↓19% · отчёт формируется автоматически вместо 2 недель ручной работы

25 решено

Delivery Time Prediction

Задача

Уточнили обещаемый срок доставки на витрине для логистического оператора e-com.

Решение

Обучили квантильную регрессию на признаках маршрута, склада, перевозчика и сезонности с калибровкой под целевой service level, добавили conformal prediction для гарантий покрытия и мониторинг дрейфа по регионам через PSI с автоматическим переобучением.

Результат

MAE 0,6 дня против 1,9 у прежней эвристики · доля доставок в срок 82% → 94% · обращения «где мой заказ» ↓31%

26 решено

Assortment Gap Analysis

Задача

Нашли пробелы в ассортименте площадки относительно спроса и конкурентов.

Решение

Сопоставили поисковые запросы с нулевой или низкорелевантной выдачей с внешним ассортиментом через entity resolution, кластеризовали неудовлетворённый спрос по эмбеддингам запросов с HDBSCAN и оценили потенциал каждого кластера моделью ожидаемого GMV.

Результат

Выявлено 780 категорий-пробелов · закрытые пробелы дали +4,1% к GMV за полгода · нулевые выдачи ↓ на треть

Наш подход

Почему у нас получается быстро

Люди

Tier-1 команда

В команде специалисты из топовых компаний: Яндекс, Meta и Google. С образованием: Физтех, МГУ, ВШЭ.

Отбор

Уникальный найм

Берём людей через собственные соревнования по машинному обучению и программированию. С нами только быстрые и умные.

Сопровождение

Вовлечены до продакшена

Внутренняя команда сопровождает проект со старта и до продакшена, подключает экспертизу на всех стадиях и оперативно меняет специалистов при необходимости.

СМИ о нас
TAdTAdviser Summit 2026 TAdArtificial Intelligence Day 2026
Как мы работаем

Уже на первой встрече

01

Разбираем ваш кейс

Сразу встречаемся с нашей технической и продуктовой командой, разбираем вашу задачу и предлагаем, чем будем полезны.
02

Финалим архитектуру

Согласовываем финальную архитектуру с вашей командой и определяем, специалисты какого профиля и в каком количестве нужны для решения.
03

Формируем пул людей

Представляем конкретных специалистов, которых предлагаем на проект — и ваша команда сама выбирает, с кем работать.
Первый шаг

Давайте разберём вашу задачу

Оставьте контакт — вернёмся в течение рабочего дня и назначим встречу с технической командой. Проработка архитектуры и команда на 2 недели — бесплатно.

Без брифов и долгих согласований
На встрече — инженеры, а не только менеджеры
Состав команды показываем поимённо
Получить бесплатную команду
Отправляя заявку, вы соглашаетесь на обработку контактных данных для связи по вашему запросу.