Искусственный интеллект
Подборка кейсов

Искусственный интеллект

Проекты внедрения технологий искусственного интеллекта в российских компаниях и госсекторе.
Направление
Сбросить все Найдено: 201 кейсов
Кейс #4048
Подробный кейс

Сбер: профиль GigaChat для агентного фреймворка Deep Agents

ПАО Сбербанк, команда GigaChain
Профиль-обвязка работает на двух уровнях. Первый — десять модульных промпт-блоков под конкретные классы отказов и переписанные опи...
Результат Результаты • GigaChat 3.5 — рост точности с 77,2% до 87,0% (+9,8 п.п.) • GigaChat 3 Ultra — с 79,8% до 87,0% (+7,2 п.п.)...
Искусственный интеллект
Кейс #4050
Подробный кейс

Авито: корпоративная фабрика ИИ-агентов «Виталик»

ООО «Авито Тех» (Авито)
Система выросла из LLM-портала в продакшен-фабрику агентов и состоит из пяти слоёв. Пользовательский слой — веб на React/TypeScrip...
Результат Результаты • Числовых результатов внедрения не раскрыто • якорный сценарий — закупка ПО, где ручной поиск занимал 30 мин...
Искусственный интеллект
Кейс #4051
Подробный кейс

Т-Банк: агент многошагового поиска T-Search

АО «ТБанк» (Т-Банк), ML-команда T-Tech
Агент не генерирует финальный ответ, а возвращает ранжированный список чанков, отдавая генерацию любой модели. Работа идёт раундам...
Результат Результаты • Средний Recall 55,96% при N=1 и 61,33% при N=3 против 53,96% у GLM 5.1 и 48,19% у DeepSeek-V4-Flash • тести...
Искусственный интеллект
Кейс #4055
Подробный кейс

Яндекс: робот-документатор витрин данных на LLM

ООО «Яндекс»
Робот работает в четыре стадии. Сначала объективный сбор: пути и схемы таблиц, записи из внутреннего глоссария на Вики, существующ...
Результат Результаты • 15 000 таблиц описано за полгода против 500 за предыдущий год • сэкономлено около 5 лет рабочего времени ан...
Искусственный интеллект
Кейс #4056
Подробный кейс

Яндекс Картинки: мультимодальная оценка релевантности и дистилляция VLM

ООО «Яндекс» (Поиск по картинкам)
Начали с генеративной VLM: визуальный энкодер, LLaVA-адаптер, переводящий картинку в токены, и трансформер-декодер с каузальной ма...
Результат Результаты • Би-энкодер и кросс-энкодер вместе — +4% релевантных картинок в топе • вместе с Embedder — +5% • обработка д...
Искусственный интеллект
Кейс #4058
Подробный кейс

Авито Подработка: замена ручных правил ML-моделью распределения субсидий

ООО «Авито Тех» (сервис Авито Подработка)
Двухслойная система. Первый слой — price-response модель на CatBoost с монотонными ограничениями по ценовым признакам, предсказыва...
Результат Результаты • SubGMV ontop −12,04% (значимо при α=0,0001) • сумма ontop-ов −9,32% (значимо при α=0,05) • закрытые слоты +...
Искусственный интеллект
Кейс #4062
Подробный кейс

RWB (Wildberries): AIOps-платформа управления алертами и утилизацией GPU

RWB (Wildberries), ML-платформа компании
Ядром выбрана KeepHQ: бэкенд на FastAPI, фронтенд на Next.js, обмен по WebSocket, хранение в PostgreSQL, развёртывание в Kubernete...
Результат Результаты • Дедупликация 99% примерно из 400 000 событий • утилизация GPU выросла на 62% на одном кластере и примерно н...
Искусственный интеллект
Кейс #4063
Подробный кейс

Smart Engines: нейросетевой детектор ориентации документов для OCR

Smart Engines (продукт для оцифровки архивов и распознавания документов)
Разработан полносверточный нейросетевой детектор примерно на 110 000 квантованных параметров. Детекция перевёрнутости работает ите...
Результат Результаты • На датасете DocBank из 30 000 изображений — 99,24% на правильно ориентированных и 99,14% на перевёрнутых пр...
Искусственный интеллект
Кейс #4064
Подробный кейс

YADRO: нейросетевая цветокоррекция камеры планшета KVADRA_T

YADRO (планшет KVADRA_T)
Выбрана сверхлёгкая сеть MSLTNet примерно на 8000 параметров. Она раскладывает изображение по пирамиде Лапласа, разделяя низкочаст...
Результат Результаты • Итог 0,45 с на снимок 12 Мп • промежуточные результаты — 2,3 с на TFLite GPU (12 Мп) и 0,8 с в режиме 3 Мп,...
Искусственный интеллект
Кейс #4065
Подробный кейс

VK Tech: многоуровневая память корпоративных ИИ-агентов в VK AI Space

VK Tech (платформа VK AI Space) и её корпоративные пользователи
Реализовано пять типов памяти: рабочая (сообщения текущей сессии), эпизодическая (файлы событий проекта в S3 в скоупе проекта), се...
Результат Результаты • Экономия примерно 1,5–6 тыс. токенов на запрос за счёт инъекции памяти вместо загрузки по требованию • оста...
Искусственный интеллект
Кейс #4066
Подробный кейс

MWS (МТС): ИИ-агенты разбора инцидентов и код-ревью как виртуальные сотрудники

MTS Web Services (MWS, входит в МТС) и DevRails AI
Построены специализированные ролевые агенты с собственными правами доступа и зоной ответственности. Агент разбора инцидентов коман...
Результат Результаты • 45% рассмотренных задач агент решает полностью • около 40% — даёт частичное решение • около 15% требуют доп...
Искусственный интеллект
Кейс #4069
Подробный кейс

SberDevices: контекстная ИИ-справка ГигаСправка в телевизорах Sber

SberDevices, пользователи умных телевизоров и медиацентров Sber на платформе Salute TV
Сервис персонализированной контекстной помощи прямо в интерфейсе устройства в момент ошибки. Три компонента: RAG-сервис DocSense д...
Результат Результаты • Несколько тысяч запусков ГигаСправки в сутки на этапе MLP • CSAT 70% • сотни оценок пользователей в день •...
Искусственный интеллект
Кейс #4071
Подробный кейс

X5 Tech: MCP-сервер дизайн-системы для ИИ-агентов вёрстки

X5 Tech (продуктовые команды X5 Group)
MCP-сервер даёт агентам знание о реальной дизайн-системе проекта и поддерживает три платформы — React, Jetpack Compose и SwiftUI....
Результат Результаты • Расход 15–18 тыс. токенов вместо 40–50 тыс. без оптимизации • один экран — с 8 часов до 2–3 часов (сокращен...
Искусственный интеллект
Кейс #4072
Подробный кейс

Слёрм: ИИ-агент IncidentGPT для автоматического разбора алертов

Слёрм (Slurm)
Четыре компонента. Сбор данных идёт из Prometheus, Kubernetes API, Alertmanager и инфраструктурного мониторинга. Alertmanager шлёт...
Результат Результаты • MTTA сокращён с 20–30 минут до 1–2 минут, часто до секунд • стоимость около 0,20 доллара за несколько недел...
Искусственный интеллект
Кейс #4073
Подробный кейс

КОРУС Консалтинг: браузерный выгружатель метаданных Qlik Sense, написанный ИИ

ГК «КОРУС Консалтинг» (группа DAR)
Браузерная панель «Kerbatov UI Qlik Downloader» выгружает метаданные Qlik Sense через Engine API. Весь код, около 1000 строк, сген...
Результат Результаты • Около 1000 строк кода сгенерировано целиком ИИ • полная выгрузка метаданных из 100 приложений примерно за 2...
Искусственный интеллект
Кейс #4075
Подробный кейс

Сбер: диффузионная языковая модель GFusion на базе GigaChat

ПАО Сбербанк, команда GigaChat Pretrain
Вместо обучения с нуля авторегрессионную модель GigaChat3-10B-A1.8B-base перевели в диффузионный режим. Генерация идёт блоками фик...
Результат Результаты • Генерация на 70% быстрее GigaChat3 в однопользовательском режиме и на 39% быстрее варианта GigaChat3 с MTP-...
Искусственный интеллект
Кейс #4079
Подробный кейс

Яндекс: быстрые голосовые команды в умных колонках Алисы

ООО «Яндекс» (умные колонки с Алисой)
Компактная нейросеть весом от 0,5 до 1,5 МБ в зависимости от железа устройства распознаёт короткие команды («дальше», «тише») без...
Результат Результаты • Ложные срабатывания снижены примерно на 60% • потребление CPU снижено примерно на 35% • потребление RAM сни...
Искусственный интеллект
Кейс #4083
Подробный кейс

Авито: платформа агентной разработки skills-hub, mcp-hub и AVIDA

ООО «Авито Тех» (в том числе Авито Авто)
Платформа состоит из трёх сервисов. Skills-hub управляет качеством скилов, их проверкой на безопасность, обнаружением и ранжирован...
Результат Результаты • Пилот 2025 года на 100 инженерах не дал статистически значимых изменений объективных метрик эффективности р...
Искусственный интеллект
Кейс #4084
Подробный кейс

VK Tech: локальный ИИ-агент в закрытом контуре на Ollama и OpenClaw

VK Tech (VK Cloud)
Стек: Ollama плюс OpenClaw на GPU-сервере в облаке. Железо — NVIDIA A30 с 24 ГБ HBM2 и пропускной способностью 933 ГБ/с, Ubuntu 24...
Результат Результаты • Две модели уместились в 22,4 ГБ из 24 ГБ при контексте 65 536 токенов • надёжная работа цепочки до примерно...
Искусственный интеллект
Кейс #4086
Подробный кейс

VK Cloud: борьба с деградацией продакшен-инференса LLM

VK Cloud (платформа инференса VK Tech)
Разбор четырёх механизмов деградации продакшен-инференса и внедрённых против них решений. Paged Attention выделяет KV-кэш блоками,...
Результат Результаты • Традиционное непрерывное резервирование теряет 60–80% ёмкости KV-кэша, PagedAttention снижает потери до мен...
Искусственный интеллект