Кейс #4087
Подробный кейс
ООО «Авито Тех», команда Trust & Safety Analytics
Сравнительное исследование четырёх подходов к оценке индивидуального эффекта воздействия: S-learner (одна модель на всех данных с...
Результат
Результаты
• Групповой этап — при дисбалансе (10% воздействия) победил Causal Forest с PEHE 0,318
• при слабом эффекте (...
Искусственный интеллект
Кейс #4086
Подробный кейс
VK Cloud (платформа инференса VK Tech)
Разбор четырёх механизмов деградации продакшен-инференса и внедрённых против них решений. Paged Attention выделяет KV-кэш блоками,...
Результат
Результаты
• Традиционное непрерывное резервирование теряет 60–80% ёмкости KV-кэша, PagedAttention снижает потери до мен...
Искусственный интеллект
Кейс #4084
Подробный кейс
VK Tech (VK Cloud)
Стек: Ollama плюс OpenClaw на GPU-сервере в облаке. Железо — NVIDIA A30 с 24 ГБ HBM2 и пропускной способностью 933 ГБ/с, Ubuntu 24...
Результат
Результаты
• Две модели уместились в 22,4 ГБ из 24 ГБ при контексте 65 536 токенов
• надёжная работа цепочки до примерно...
Искусственный интеллект
Кейс #4083
Подробный кейс
ООО «Авито Тех» (в том числе Авито Авто)
Платформа состоит из трёх сервисов. Skills-hub управляет качеством скилов, их проверкой на безопасность, обнаружением и ранжирован...
Результат
Результаты
• Пилот 2025 года на 100 инженерах не дал статистически значимых изменений объективных метрик эффективности р...
Искусственный интеллект
Кейс #4079
Подробный кейс
ООО «Яндекс» (умные колонки с Алисой)
Компактная нейросеть весом от 0,5 до 1,5 МБ в зависимости от железа устройства распознаёт короткие команды («дальше», «тише») без...
Результат
Результаты
• Ложные срабатывания снижены примерно на 60%
• потребление CPU снижено примерно на 35%
• потребление RAM сни...
Искусственный интеллект
Кейс #4075
Подробный кейс
ПАО Сбербанк, команда GigaChat Pretrain
Вместо обучения с нуля авторегрессионную модель GigaChat3-10B-A1.8B-base перевели в диффузионный режим. Генерация идёт блоками фик...
Результат
Результаты
• Генерация на 70% быстрее GigaChat3 в однопользовательском режиме и на 39% быстрее варианта GigaChat3 с MTP-...
Искусственный интеллект
Кейс #4073
Подробный кейс
ГК «КОРУС Консалтинг» (группа DAR)
Браузерная панель «Kerbatov UI Qlik Downloader» выгружает метаданные Qlik Sense через Engine API. Весь код, около 1000 строк, сген...
Результат
Результаты
• Около 1000 строк кода сгенерировано целиком ИИ
• полная выгрузка метаданных из 100 приложений примерно за 2...
Искусственный интеллект
Кейс #4072
Подробный кейс
Слёрм (Slurm)
Четыре компонента. Сбор данных идёт из Prometheus, Kubernetes API, Alertmanager и инфраструктурного мониторинга. Alertmanager шлёт...
Результат
Результаты
• MTTA сокращён с 20–30 минут до 1–2 минут, часто до секунд
• стоимость около 0,20 доллара за несколько недел...
Искусственный интеллект
Кейс #4071
Подробный кейс
X5 Tech (продуктовые команды X5 Group)
MCP-сервер даёт агентам знание о реальной дизайн-системе проекта и поддерживает три платформы — React, Jetpack Compose и SwiftUI....
Результат
Результаты
• Расход 15–18 тыс. токенов вместо 40–50 тыс. без оптимизации
• один экран — с 8 часов до 2–3 часов (сокращен...
Искусственный интеллект
Кейс #4069
Подробный кейс
SberDevices, пользователи умных телевизоров и медиацентров Sber на платформе Salute TV
Сервис персонализированной контекстной помощи прямо в интерфейсе устройства в момент ошибки. Три компонента: RAG-сервис DocSense д...
Результат
Результаты
• Несколько тысяч запусков ГигаСправки в сутки на этапе MLP
• CSAT 70%
• сотни оценок пользователей в день
•...
Искусственный интеллект
Кейс #4066
Подробный кейс
MTS Web Services (MWS, входит в МТС) и DevRails AI
Построены специализированные ролевые агенты с собственными правами доступа и зоной ответственности. Агент разбора инцидентов коман...
Результат
Результаты
• 45% рассмотренных задач агент решает полностью
• около 40% — даёт частичное решение
• около 15% требуют доп...
Искусственный интеллект
Кейс #4065
Подробный кейс
VK Tech (платформа VK AI Space) и её корпоративные пользователи
Реализовано пять типов памяти: рабочая (сообщения текущей сессии), эпизодическая (файлы событий проекта в S3 в скоупе проекта), се...
Результат
Результаты
• Экономия примерно 1,5–6 тыс. токенов на запрос за счёт инъекции памяти вместо загрузки по требованию
• оста...
Искусственный интеллект