Кейс #4076
Подробный кейс
ПАО Сбербанк и участники Альянса в сфере ИИ
Бенчмарк переработан вокруг четырёх категорий навыков: Human-Centric, Culture-Specific, Agentic и Reasoning. Состав сжат с 23 дата...
Результат
Результаты
• 12 датасетов и около 8700 тестовых примеров вместо 23 датасетов и около 37 000
• 5 формулировок промпта на...
Искусственный интеллект
Кейс #4077
Подробный кейс
ПАО Сбербанк (Sber AI)
Модель работает «рендерером» в таксономии World Labs: предсказывает визуальные наблюдения из текущего состояния мира. Три доменные...
Результат
Результаты
• PAI-Bench-G — 4-е место при 2 млрд параметров, в домене автономного вождения на 5 п.п. выше сопоставимой NV...
Искусственный интеллект
Кейс #4078
Подробный кейс
ПАО Сбербанк (Sber AI Lab)
Метод переносит принципы детекции объектов на временные последовательности: если в 2D детекции модель отвечает «что и где», то зде...
Результат
Результаты
• Превосходит авторегрессионные бейзлайны на долгосрочном прогнозировании
• сохраняет разнообразие предсказан...
Искусственный интеллект
Кейс #4079
Подробный кейс
ООО «Яндекс» (умные колонки с Алисой)
Компактная нейросеть весом от 0,5 до 1,5 МБ в зависимости от железа устройства распознаёт короткие команды («дальше», «тише») без...
Результат
Результаты
• Ложные срабатывания снижены примерно на 60%
• потребление CPU снижено примерно на 35%
• потребление RAM сни...
Искусственный интеллект
Кейс #4080
Подробный кейс
VK и Инженерно-математическая школа НИУ ВШЭ
SESAME (Speech Enhancement with Sparse Adaptive Mixture of Experts) строится на MP-SENet, где стандартные полносвязные блоки замен...
Результат
Результаты
• На VoiceBank+DEMAND: PESQ 3,64 против 3,61 у MP-SENet large
• активных параметров 2,87 млн против 3,59 млн...
Искусственный интеллект
Кейс #4081
Подробный кейс
АО «ТБанк» (Т-Банк), мобильное приложение на Android
Библиотека анализирует 30 кадров в секунду ML-моделями и ловит момент, когда лицо смотрит прямо в камеру, — для биометрического по...
Результат
Результаты
• Анализ 30 кадров в секунду
• поддержка устройств от 2015 года до флагманов с LEVEL_3
• кольцевой буфер из т...
Искусственный интеллект
Кейс #4082
Подробный кейс
VK (платформа Дзен)
Пайплайн собирает логи событий пользователей с привязкой к тестовым группам, фильтрует по словарю экспериментов, чтобы не считать...
Результат
Результаты
• Числовых результатов не раскрыто
• качественные эффекты — автоматизация анализа вместо ручных запросов, еди...
Искусственный интеллект
Кейс #4083
Подробный кейс
ООО «Авито Тех» (в том числе Авито Авто)
Платформа состоит из трёх сервисов. Skills-hub управляет качеством скилов, их проверкой на безопасность, обнаружением и ранжирован...
Результат
Результаты
• Пилот 2025 года на 100 инженерах не дал статистически значимых изменений объективных метрик эффективности р...
Искусственный интеллект
Кейс #4084
Подробный кейс
VK Tech (VK Cloud)
Стек: Ollama плюс OpenClaw на GPU-сервере в облаке. Железо — NVIDIA A30 с 24 ГБ HBM2 и пропускной способностью 933 ГБ/с, Ubuntu 24...
Результат
Результаты
• Две модели уместились в 22,4 ГБ из 24 ГБ при контексте 65 536 токенов
• надёжная работа цепочки до примерно...
Искусственный интеллект
Кейс #4085
Подробный кейс
Петрович-Тех (ИТ-подразделение сети «Петрович»)
Собрана единая обвязка с 13 виджетами дашборда и примерно 30 инструментами, агрегирующая данные из таск-трекера, вики, почты, кале...
Результат
Результаты
• Двухшаговая задача (сводка по дашборду) — успех во всех 9 прогонах, время 36 с у Sonnet, 34 с у Qwen3-235B,...
Искусственный интеллект
Кейс #4086
Подробный кейс
VK Cloud (платформа инференса VK Tech)
Разбор четырёх механизмов деградации продакшен-инференса и внедрённых против них решений. Paged Attention выделяет KV-кэш блоками,...
Результат
Результаты
• Традиционное непрерывное резервирование теряет 60–80% ёмкости KV-кэша, PagedAttention снижает потери до мен...
Искусственный интеллект
Кейс #4087
Подробный кейс
ООО «Авито Тех», команда Trust & Safety Analytics
Сравнительное исследование четырёх подходов к оценке индивидуального эффекта воздействия: S-learner (одна модель на всех данных с...
Результат
Результаты
• Групповой этап — при дисбалансе (10% воздействия) победил Causal Forest с PEHE 0,318
• при слабом эффекте (...
Искусственный интеллект