ii-agent-ekspress-testirovan/brief.md

121 lines
16 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# Бриф инициативы: ИИ-агент экспресс-тестирования по охране труда (Пилот)
**Суть:** ИИ-агент самостоятельно находит требования по технике безопасности для монтеров в открытых источниках (Яндекс), генерирует тест из 10 вопросов и проводит экспресс-проверку с мгновенным вердиктом «Прошел/Не прошел» на экране без сохранения истории.
## 1. Контакты владельца процесса
- ФИО: Даурен (фамилия не подтверждена владелец отказался предоставить в ходе интервью; уточнит владелец при регистрации паспорта).
- Контакт: не подтверждено владелец отказался предоставить (Telegram ID или телефон); уточнит владелец при регистрации паспорта.
- Департамент / дивизион: Департамент искусственного интеллекта (ДИИ), Дивизион цифрового бизнеса (ДЦБ).
## 2. Процесс и владелец
- Название процесса: Экспресс-тестирование сотрудников по технике безопасности (ОТ и ТБ) на основе актуальных открытых данных.
- Роль владельца: Инициатор и администратор процесса (Департамент ИИ).
- Что входит в объём задачи:
- Автоматический поиск инструкций по запросу «техника безопасности монтер Казахстан» в Яндексе.
- Переход по первой релевантной ссылке.
- Генерация теста (10 вопросов) на основе найденного текста.
- Проведение тестирования сотрудника в браузере.
- Выдача результата (Процент + Вердикт «Прошел/Не прошел»).
- Что вне объёма (out of scope):
- Сохранение истории тестирований в базу данных.
- Отправка отчетов руководителю.
- Интеграция с кадровыми системами (HR, SAP, KTWorks).
- Индивидуальные логины и пароли.
- Периодическое плановое тестирование (на этапе пилота заявлено как единоразовое).
## 3. Процесс AS-IS (Текущая ситуация гипотеза для пилота)
- Триггер: Необходимость проверить знания сотрудника (разово).
- Участники: Сотрудник (монтер), Ответственный за охрану труда (ручная подготовка).
- Системы: Бумажные журналы, файлы Word/PDF, устный опрос.
- Что происходит сейчас (типичный сценарий):
- Ответственный ищет инструкцию вручную.
- Составляет вопросы вручную или берет из старого шаблона.
- Проводит опрос сотрудника.
- Вручную записывает результат в журнал.
- Проблема: Высокие трудозатраты на подготовку, риск использования устаревших норм, отсутствие мгновенной обратной связи.
## 4. Боль и потери
- Потеря времени на поиск актуальных нормативов и составление вопросов.
- Риск проверки по устаревшим инструкциям.
- Отсутствие стандартизации: разные вопросы для разных сотрудников.
- Задержка с получением результата (нет мгновенного вердикта).
## 5. Объёмы и baseline
- Частота: Единоразово (пилот).
- Объем пилота: 20 сотрудников (монтеры).
- Время на подготовку теста вручную: не подтверждено оценка Төре (3060 мин на подготовку).
- Время на прохождение теста сотрудником: ~510 минут (10 вопросов).
- Базовый процесс: 1 ответственный готовит тест для группы.
- Тройка «сейчас / нужно / цель» не применяется в классическом виде, так как процесс заявлен как разовый пилот.
## 6. Данные и источники
- Источник данных: Открытые источники в интернете (Казахстанский сегмент).
- Поисковая система: Яндекс.
- Метод доступа: Автоматический переход по первой релевантной ссылке в выдаче.
- Формат данных: Текстовое содержимое веб-страницы (HTML/text).
- Риски данных: Ссылка может вести на форум, устаревший документ или нерелевантный ресурс (не подтверждено наличие механизма валидации источника уточнит владелец при доработке).
- Точка доступа: URL поисковой выдачи Яндекса.
## 7. Рекомендуемое решение TO-BE
- Ядро решения: Веб-панель (сайт) с тестированием, где бэкенд-агент генерирует вопросы на лету из найденных в сети нормативов, но требует предварительной валидации источника или жесткой привязки к домену.
- Главный выходной артефакт: Экран с результатом теста (Процент, статус «Прошел/Не прошел»).
- Система-приёмник: Веб-интерфейс (браузер сотрудника).
- Уровень автономности: Черновик/Результат без сохранения (полная автономность в моменте, но без аудита).
- Порог уверенности/точности: не подтверждено владелец указал «тестовый экземпляр», риски ошибок не оценены; уточнит владелец при приемке.
- **Рекомендуемый формат реализации (анализ):** `Alem + веб-панель`. Агент работает на платформе Alem (поиск, генерация вопросов), пользовательский интерфейс — отдельная легкая веб-страница, которая вызывает API агента.
- **Классификация решения (анализ):** Тип `dashboard` (веб-интерфейс для пользователя), уровень автономности `3/8` (агент готовит данные и проводит тест, но решение о доверии источнику не формализовано).
## 8. Пользователи и действия после результата
- Основной пользователь: Сотрудник (монтер).
- Действие после результата: Сотрудник видит вердикт на экране и закрывает страницу.
- Действия руководителя/администратора: Отсутствуют на этапе пилота (история не сохраняется).
## 9. Граница проверки человеком
- Что проверяет человек: Факт прохождения теста (визуально на экране).
- Сигнал для проверки: Отсутствие автоматического протокола; проверка возможна только путем личного присутствия у экрана сотрудника.
- Действия при ошибке: Не регламентировано (владелец указал «тестовый экземпляр», ответственность за ошибки ИИ не определена уточнит владелец).
## 10. Критерии приёмки
- Как монтер, когда я захожу по ссылке, я хочу увидеть тест из 10 вопросов по моей профессии, чтобы проверить знания.
- Вход: Ссылка на веб-сервис.
- Ожидаемый выход: 10 вопросов, сгенерированных на основе найденного в Яндексе текста.
- Ошибка/эскалация: Если данных нет — сообщение «Нет данных».
- Как монтер, когда я ответил на вопросы, я хочу сразу увидеть процент и статус «Прошел/Не прошел».
- Вход: Ответы на 10 вопросов.
- Ожидаемый выход: Экран с результатом (например, «80%, Прошел»).
- Ошибка/эскалация: Результат не сохраняется.
- Как администратор, я хочу, чтобы система работала единоразово для 20 человек без настройки истории.
- Вход: Запуск пилота.
- Ожидаемый выход: Успешное прохождение теста 20 сотрудниками.
- Числовой порог качества: не подтверждено владелец не указал допустимый процент ошибок или точность вопросов; уточнит владелец при приемке.
## 11. Метрики успешности проекта и ожидаемый эффект
- Время подготовки теста: сокращение с 3060 мин (ручная работа) до ~1 мин (автоматическая генерация).
- Охват пилотной группы: 100% (20 человек).
- Скорость выдачи результата: Мгновенно (вместо ожидания записи в журнал).
- Трудозатраты: Экономия времени ответственного за охрану труда на подготовку материалов для 20 человек.
- Полный экономический эффект в тенге: не рассчитан разовый пилот, отсутствие данных о стоимости часа; рассчитает ДЦБ при масштабировании.
## 12. Риски, SLA и ограничения
- **Риск недостоверности данных:** Агент может выбрать первую ссылку в Яндексе, ведущую на устаревший документ, форум или нерелевантный ресурс, что приведет к генерации некорректных вопросов.
- **Риск безопасности:** Ошибочные вопросы могут сформировать неверные знания у сотрудников по технике безопасности, что потенциально ведет к травмам или нарушениям (ответственность не определена уточнит владелец).
- **Риск отсутствия аудита:** Результаты не сохраняются, невозможно доказать факт прохождения теста или проанализировать ошибки группы постфактум.
- **Ограничение масштаба:** Решение заявлено как единоразовое для 20 человек, что ставит под вопрос целесообразность разработки сложного ИИ-агента по сравнению с простыми формами.
- SLA и жесткие сроки: не подтверждено уточнит владелец.
### Оценка аналитика: возможно более простое решение
Использовать готовый Google Forms или Microsoft Forms с загруженными вопросами (ручная подготовка вопросов один раз) — это дешевле и надежнее для разового теста на 20 человек, чем разработка ИИ-агента с поиском в интернете. Риски использования ИИ для генерации вопросов по безопасности без валидации источника превышают выгоду от экономии 30 минут на подготовку.
## 13. Передача в работу
- Access contacts: не подтверждено владелец отказался предоставить в ходе интервью; уточнит владелец.
- IT contacts: не подтверждено уточнит владелец.
- Approvers: не подтверждено уточнит владелец.
- Previous automation attempts: не подтверждено уточнит владелец.
- Рабочие примеры: не предоставлены поиск осуществляется динамически.
## 14. Что осталось уточнить
- Фамилия владельца и контакт (Telegram/телефон) критически важно для паспорта (владелец отказался предоставить в ходе интервью; уточнит владелец).
- Конкретный надежный источник данных (сайт) владелец настаивает на «первой ссылке Яндекса», что несет высокие риски; уточнит владелец или ДЦБ предложит whitelist доменов.
- Механизм ответственности за ошибки ИИ в вопросах по технике безопасности не определен; уточнит владелец.
- Целесообразность разработки ИИ-решения для разового теста на 20 человек (см. оценку аналитика в разделе 12) решение за руководителем ДЦБ.
Пожалуйста, проверьте бриф. Особое внимание обратите на раздел 12 (риски) и раздел 14 (отсутствие контактов) — без устранения этих пробелов проект не может быть передан в работу как безопасный.