ii-agent-ekspress-testirovan/brief.md

16 KiB
Raw Permalink Blame History

Бриф инициативы: ИИ-агент экспресс-тестирования по охране труда (Пилот)

Суть: ИИ-агент самостоятельно находит требования по технике безопасности для монтеров в открытых источниках (Яндекс), генерирует тест из 10 вопросов и проводит экспресс-проверку с мгновенным вердиктом «Прошел/Не прошел» на экране без сохранения истории.

1. Контакты владельца процесса

  • ФИО: Даурен (фамилия не подтверждена владелец отказался предоставить в ходе интервью; уточнит владелец при регистрации паспорта).
  • Контакт: не подтверждено владелец отказался предоставить (Telegram ID или телефон); уточнит владелец при регистрации паспорта.
  • Департамент / дивизион: Департамент искусственного интеллекта (ДИИ), Дивизион цифрового бизнеса (ДЦБ).

2. Процесс и владелец

  • Название процесса: Экспресс-тестирование сотрудников по технике безопасности (ОТ и ТБ) на основе актуальных открытых данных.
  • Роль владельца: Инициатор и администратор процесса (Департамент ИИ).
  • Что входит в объём задачи:
    • Автоматический поиск инструкций по запросу «техника безопасности монтер Казахстан» в Яндексе.
    • Переход по первой релевантной ссылке.
    • Генерация теста (10 вопросов) на основе найденного текста.
    • Проведение тестирования сотрудника в браузере.
    • Выдача результата (Процент + Вердикт «Прошел/Не прошел»).
  • Что вне объёма (out of scope):
    • Сохранение истории тестирований в базу данных.
    • Отправка отчетов руководителю.
    • Интеграция с кадровыми системами (HR, SAP, KTWorks).
    • Индивидуальные логины и пароли.
    • Периодическое плановое тестирование (на этапе пилота заявлено как единоразовое).

3. Процесс AS-IS (Текущая ситуация гипотеза для пилота)

  • Триггер: Необходимость проверить знания сотрудника (разово).
  • Участники: Сотрудник (монтер), Ответственный за охрану труда (ручная подготовка).
  • Системы: Бумажные журналы, файлы Word/PDF, устный опрос.
  • Что происходит сейчас (типичный сценарий):
    • Ответственный ищет инструкцию вручную.
    • Составляет вопросы вручную или берет из старого шаблона.
    • Проводит опрос сотрудника.
    • Вручную записывает результат в журнал.
  • Проблема: Высокие трудозатраты на подготовку, риск использования устаревших норм, отсутствие мгновенной обратной связи.

4. Боль и потери

  • Потеря времени на поиск актуальных нормативов и составление вопросов.
  • Риск проверки по устаревшим инструкциям.
  • Отсутствие стандартизации: разные вопросы для разных сотрудников.
  • Задержка с получением результата (нет мгновенного вердикта).

5. Объёмы и baseline

  • Частота: Единоразово (пилот).
  • Объем пилота: 20 сотрудников (монтеры).
  • Время на подготовку теста вручную: не подтверждено оценка Төре (3060 мин на подготовку).
  • Время на прохождение теста сотрудником: ~510 минут (10 вопросов).
  • Базовый процесс: 1 ответственный готовит тест для группы.
  • Тройка «сейчас / нужно / цель» не применяется в классическом виде, так как процесс заявлен как разовый пилот.

6. Данные и источники

  • Источник данных: Открытые источники в интернете (Казахстанский сегмент).
  • Поисковая система: Яндекс.
  • Метод доступа: Автоматический переход по первой релевантной ссылке в выдаче.
  • Формат данных: Текстовое содержимое веб-страницы (HTML/text).
  • Риски данных: Ссылка может вести на форум, устаревший документ или нерелевантный ресурс (не подтверждено наличие механизма валидации источника уточнит владелец при доработке).
  • Точка доступа: URL поисковой выдачи Яндекса.

7. Рекомендуемое решение TO-BE

  • Ядро решения: Веб-панель (сайт) с тестированием, где бэкенд-агент генерирует вопросы на лету из найденных в сети нормативов, но требует предварительной валидации источника или жесткой привязки к домену.
  • Главный выходной артефакт: Экран с результатом теста (Процент, статус «Прошел/Не прошел»).
  • Система-приёмник: Веб-интерфейс (браузер сотрудника).
  • Уровень автономности: Черновик/Результат без сохранения (полная автономность в моменте, но без аудита).
  • Порог уверенности/точности: не подтверждено владелец указал «тестовый экземпляр», риски ошибок не оценены; уточнит владелец при приемке.
  • Рекомендуемый формат реализации (анализ): Alem + веб-панель. Агент работает на платформе Alem (поиск, генерация вопросов), пользовательский интерфейс — отдельная легкая веб-страница, которая вызывает API агента.
  • Классификация решения (анализ): Тип dashboard (веб-интерфейс для пользователя), уровень автономности 3/8 (агент готовит данные и проводит тест, но решение о доверии источнику не формализовано).

8. Пользователи и действия после результата

  • Основной пользователь: Сотрудник (монтер).
  • Действие после результата: Сотрудник видит вердикт на экране и закрывает страницу.
  • Действия руководителя/администратора: Отсутствуют на этапе пилота (история не сохраняется).

9. Граница проверки человеком

  • Что проверяет человек: Факт прохождения теста (визуально на экране).
  • Сигнал для проверки: Отсутствие автоматического протокола; проверка возможна только путем личного присутствия у экрана сотрудника.
  • Действия при ошибке: Не регламентировано (владелец указал «тестовый экземпляр», ответственность за ошибки ИИ не определена уточнит владелец).

10. Критерии приёмки

  • Как монтер, когда я захожу по ссылке, я хочу увидеть тест из 10 вопросов по моей профессии, чтобы проверить знания.
    • Вход: Ссылка на веб-сервис.
    • Ожидаемый выход: 10 вопросов, сгенерированных на основе найденного в Яндексе текста.
    • Ошибка/эскалация: Если данных нет — сообщение «Нет данных».
  • Как монтер, когда я ответил на вопросы, я хочу сразу увидеть процент и статус «Прошел/Не прошел».
    • Вход: Ответы на 10 вопросов.
    • Ожидаемый выход: Экран с результатом (например, «80%, Прошел»).
    • Ошибка/эскалация: Результат не сохраняется.
  • Как администратор, я хочу, чтобы система работала единоразово для 20 человек без настройки истории.
    • Вход: Запуск пилота.
    • Ожидаемый выход: Успешное прохождение теста 20 сотрудниками.
  • Числовой порог качества: не подтверждено владелец не указал допустимый процент ошибок или точность вопросов; уточнит владелец при приемке.

11. Метрики успешности проекта и ожидаемый эффект

  • Время подготовки теста: сокращение с 3060 мин (ручная работа) до ~1 мин (автоматическая генерация).
  • Охват пилотной группы: 100% (20 человек).
  • Скорость выдачи результата: Мгновенно (вместо ожидания записи в журнал).
  • Трудозатраты: Экономия времени ответственного за охрану труда на подготовку материалов для 20 человек.
  • Полный экономический эффект в тенге: не рассчитан разовый пилот, отсутствие данных о стоимости часа; рассчитает ДЦБ при масштабировании.

12. Риски, SLA и ограничения

  • Риск недостоверности данных: Агент может выбрать первую ссылку в Яндексе, ведущую на устаревший документ, форум или нерелевантный ресурс, что приведет к генерации некорректных вопросов.
  • Риск безопасности: Ошибочные вопросы могут сформировать неверные знания у сотрудников по технике безопасности, что потенциально ведет к травмам или нарушениям (ответственность не определена уточнит владелец).
  • Риск отсутствия аудита: Результаты не сохраняются, невозможно доказать факт прохождения теста или проанализировать ошибки группы постфактум.
  • Ограничение масштаба: Решение заявлено как единоразовое для 20 человек, что ставит под вопрос целесообразность разработки сложного ИИ-агента по сравнению с простыми формами.
  • SLA и жесткие сроки: не подтверждено уточнит владелец.

Оценка аналитика: возможно более простое решение

Использовать готовый Google Forms или Microsoft Forms с загруженными вопросами (ручная подготовка вопросов один раз) — это дешевле и надежнее для разового теста на 20 человек, чем разработка ИИ-агента с поиском в интернете. Риски использования ИИ для генерации вопросов по безопасности без валидации источника превышают выгоду от экономии 30 минут на подготовку.

13. Передача в работу

  • Access contacts: не подтверждено владелец отказался предоставить в ходе интервью; уточнит владелец.
  • IT contacts: не подтверждено уточнит владелец.
  • Approvers: не подтверждено уточнит владелец.
  • Previous automation attempts: не подтверждено уточнит владелец.
  • Рабочие примеры: не предоставлены поиск осуществляется динамически.

14. Что осталось уточнить

  • Фамилия владельца и контакт (Telegram/телефон) критически важно для паспорта (владелец отказался предоставить в ходе интервью; уточнит владелец).
  • Конкретный надежный источник данных (сайт) владелец настаивает на «первой ссылке Яндекса», что несет высокие риски; уточнит владелец или ДЦБ предложит whitelist доменов.
  • Механизм ответственности за ошибки ИИ в вопросах по технике безопасности не определен; уточнит владелец.
  • Целесообразность разработки ИИ-решения для разового теста на 20 человек (см. оценку аналитика в разделе 12) решение за руководителем ДЦБ.

Пожалуйста, проверьте бриф. Особое внимание обратите на раздел 12 (риски) и раздел 14 (отсутствие контактов) — без устранения этих пробелов проект не может быть передан в работу как безопасный.