Кейс #4048
Подробный кейс
ПАО Сбербанк, команда GigaChain
Профиль-обвязка работает на двух уровнях. Первый — десять модульных промпт-блоков под конкретные классы отказов и переписанные опи...
Результат
Результаты
• GigaChat 3.5 — рост точности с 77,2% до 87,0% (+9,8 п.п.)
• GigaChat 3 Ultra — с 79,8% до 87,0% (+7,2 п.п.)...
Искусственный интеллект
Кейс #4050
Подробный кейс
ООО «Авито Тех» (Авито)
Система выросла из LLM-портала в продакшен-фабрику агентов и состоит из пяти слоёв. Пользовательский слой — веб на React/TypeScrip...
Результат
Результаты
• Числовых результатов внедрения не раскрыто
• якорный сценарий — закупка ПО, где ручной поиск занимал 30 мин...
Искусственный интеллект
Кейс #4051
Подробный кейс
АО «ТБанк» (Т-Банк), ML-команда T-Tech
Агент не генерирует финальный ответ, а возвращает ранжированный список чанков, отдавая генерацию любой модели. Работа идёт раундам...
Результат
Результаты
• Средний Recall 55,96% при N=1 и 61,33% при N=3 против 53,96% у GLM 5.1 и 48,19% у DeepSeek-V4-Flash
• тести...
Искусственный интеллект
Кейс #4055
Подробный кейс
ООО «Яндекс»
Робот работает в четыре стадии. Сначала объективный сбор: пути и схемы таблиц, записи из внутреннего глоссария на Вики, существующ...
Результат
Результаты
• 15 000 таблиц описано за полгода против 500 за предыдущий год
• сэкономлено около 5 лет рабочего времени ан...
Искусственный интеллект
Кейс #4056
Подробный кейс
ООО «Яндекс» (Поиск по картинкам)
Начали с генеративной VLM: визуальный энкодер, LLaVA-адаптер, переводящий картинку в токены, и трансформер-декодер с каузальной ма...
Результат
Результаты
• Би-энкодер и кросс-энкодер вместе — +4% релевантных картинок в топе
• вместе с Embedder — +5%
• обработка д...
Искусственный интеллект
Кейс #4058
Подробный кейс
ООО «Авито Тех» (сервис Авито Подработка)
Двухслойная система. Первый слой — price-response модель на CatBoost с монотонными ограничениями по ценовым признакам, предсказыва...
Результат
Результаты
• SubGMV ontop −12,04% (значимо при α=0,0001)
• сумма ontop-ов −9,32% (значимо при α=0,05)
• закрытые слоты +...
Искусственный интеллект
Кейс #4062
Подробный кейс
RWB (Wildberries), ML-платформа компании
Ядром выбрана KeepHQ: бэкенд на FastAPI, фронтенд на Next.js, обмен по WebSocket, хранение в PostgreSQL, развёртывание в Kubernete...
Результат
Результаты
• Дедупликация 99% примерно из 400 000 событий
• утилизация GPU выросла на 62% на одном кластере и примерно н...
Искусственный интеллект
Кейс #4063
Подробный кейс
Smart Engines (продукт для оцифровки архивов и распознавания документов)
Разработан полносверточный нейросетевой детектор примерно на 110 000 квантованных параметров. Детекция перевёрнутости работает ите...
Результат
Результаты
• На датасете DocBank из 30 000 изображений — 99,24% на правильно ориентированных и 99,14% на перевёрнутых пр...
Искусственный интеллект
Кейс #4064
Подробный кейс
YADRO (планшет KVADRA_T)
Выбрана сверхлёгкая сеть MSLTNet примерно на 8000 параметров. Она раскладывает изображение по пирамиде Лапласа, разделяя низкочаст...
Результат
Результаты
• Итог 0,45 с на снимок 12 Мп
• промежуточные результаты — 2,3 с на TFLite GPU (12 Мп) и 0,8 с в режиме 3 Мп,...
Искусственный интеллект
Кейс #4065
Подробный кейс
VK Tech (платформа VK AI Space) и её корпоративные пользователи
Реализовано пять типов памяти: рабочая (сообщения текущей сессии), эпизодическая (файлы событий проекта в S3 в скоупе проекта), се...
Результат
Результаты
• Экономия примерно 1,5–6 тыс. токенов на запрос за счёт инъекции памяти вместо загрузки по требованию
• оста...
Искусственный интеллект
Кейс #4066
Подробный кейс
MTS Web Services (MWS, входит в МТС) и DevRails AI
Построены специализированные ролевые агенты с собственными правами доступа и зоной ответственности. Агент разбора инцидентов коман...
Результат
Результаты
• 45% рассмотренных задач агент решает полностью
• около 40% — даёт частичное решение
• около 15% требуют доп...
Искусственный интеллект
Кейс #4069
Подробный кейс
SberDevices, пользователи умных телевизоров и медиацентров Sber на платформе Salute TV
Сервис персонализированной контекстной помощи прямо в интерфейсе устройства в момент ошибки. Три компонента: RAG-сервис DocSense д...
Результат
Результаты
• Несколько тысяч запусков ГигаСправки в сутки на этапе MLP
• CSAT 70%
• сотни оценок пользователей в день
•...
Искусственный интеллект
Кейс #4071
Подробный кейс
X5 Tech (продуктовые команды X5 Group)
MCP-сервер даёт агентам знание о реальной дизайн-системе проекта и поддерживает три платформы — React, Jetpack Compose и SwiftUI....
Результат
Результаты
• Расход 15–18 тыс. токенов вместо 40–50 тыс. без оптимизации
• один экран — с 8 часов до 2–3 часов (сокращен...
Искусственный интеллект
Кейс #4072
Подробный кейс
Слёрм (Slurm)
Четыре компонента. Сбор данных идёт из Prometheus, Kubernetes API, Alertmanager и инфраструктурного мониторинга. Alertmanager шлёт...
Результат
Результаты
• MTTA сокращён с 20–30 минут до 1–2 минут, часто до секунд
• стоимость около 0,20 доллара за несколько недел...
Искусственный интеллект
Кейс #4073
Подробный кейс
ГК «КОРУС Консалтинг» (группа DAR)
Браузерная панель «Kerbatov UI Qlik Downloader» выгружает метаданные Qlik Sense через Engine API. Весь код, около 1000 строк, сген...
Результат
Результаты
• Около 1000 строк кода сгенерировано целиком ИИ
• полная выгрузка метаданных из 100 приложений примерно за 2...
Искусственный интеллект
Кейс #4075
Подробный кейс
ПАО Сбербанк, команда GigaChat Pretrain
Вместо обучения с нуля авторегрессионную модель GigaChat3-10B-A1.8B-base перевели в диффузионный режим. Генерация идёт блоками фик...
Результат
Результаты
• Генерация на 70% быстрее GigaChat3 в однопользовательском режиме и на 39% быстрее варианта GigaChat3 с MTP-...
Искусственный интеллект
Кейс #4079
Подробный кейс
ООО «Яндекс» (умные колонки с Алисой)
Компактная нейросеть весом от 0,5 до 1,5 МБ в зависимости от железа устройства распознаёт короткие команды («дальше», «тише») без...
Результат
Результаты
• Ложные срабатывания снижены примерно на 60%
• потребление CPU снижено примерно на 35%
• потребление RAM сни...
Искусственный интеллект
Кейс #4083
Подробный кейс
ООО «Авито Тех» (в том числе Авито Авто)
Платформа состоит из трёх сервисов. Skills-hub управляет качеством скилов, их проверкой на безопасность, обнаружением и ранжирован...
Результат
Результаты
• Пилот 2025 года на 100 инженерах не дал статистически значимых изменений объективных метрик эффективности р...
Искусственный интеллект
Кейс #4084
Подробный кейс
VK Tech (VK Cloud)
Стек: Ollama плюс OpenClaw на GPU-сервере в облаке. Железо — NVIDIA A30 с 24 ГБ HBM2 и пропускной способностью 933 ГБ/с, Ubuntu 24...
Результат
Результаты
• Две модели уместились в 22,4 ГБ из 24 ГБ при контексте 65 536 токенов
• надёжная работа цепочки до примерно...
Искусственный интеллект
Кейс #4086
Подробный кейс
VK Cloud (платформа инференса VK Tech)
Разбор четырёх механизмов деградации продакшен-инференса и внедрённых против них решений. Paged Attention выделяет KV-кэш блоками,...
Результат
Результаты
• Традиционное непрерывное резервирование теряет 60–80% ёмкости KV-кэша, PagedAttention снижает потери до мен...
Искусственный интеллект