RAG_helper

Author	SHA1	Message	Date
AR 15 M4	a79b6f9d05	feat(sprint7.7): версионирование графа шагов в БД + UI переключения Хранить старый 6-шаговый сценарий new_booking параллельно с новым 4-шаговым, чтобы оператор мог откатиться или сравнить варианты. Активный граф ровно один, переключение через UI «Настройки → Шаги». Модель и миграция: - Таблица intent_step_graphs (id, intent_id, version, name, is_active, created_at). - intent_steps.graph_id FK + UNIQUE сменён с (intent_id, code) на (graph_id, code). - Alembic-миграция j6d8c4b56g23 (batch_alter_table для SQLite). Сервис и сидинг (services/intent_step_graph_service.py): - ensure_seed_graphs идемпотентен: создаёт активный граф для каждой ветки, привязывает существующие шаги (graph_id IS NULL), для new_booking восстанавливает архивный v1 из _archived_v1/.md и _PRE_SPRINT_7_6_ALLOWED_NEXT. - Активный граф new_booking сжат до 4 шагов: deprecated present/offer_time удаляются из активного, остаются только в архивном v1. - list_graphs / get_active_graph / set_active_graph. API: - GET /intents/{code}/step-graphs — список с steps_count и is_active. - POST /intents/{code}/step-graphs/{graph_id}/activate. - list_steps_for_intent / get_step_by_code / get_first_step фильтруют по активному графу через _active_graph_filter (join с intent_step_graphs). - ensure_seed_guards и migrate_new_booking_allowed_next_v2 защищены: не трогают шаги архивных графов. UI (static/settings.html): - Во вкладке «Шаги» вверху блок «Версии графа шагов»: карточки с именем, кол-вом шагов, бейджем «активная» или кнопкой «Активировать». При переключении заголовок меняется «Шаги (4)» ↔ «Шаги (6)». - Раздел «Тест-вопрос от пациента» сделан сворачиваемым (details/summary в стиле prompt-block). Промпты архивного графа восстановлены из коммита 60f8a7b^ в prompts/intents/new_booking/steps/_archived_v1/.md. SPRINTS.md: Спринт 7.7 → ✅ Закрыт. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-05-02 14:29:07 +05:00
AR 15 M4	60f8a7b398	feat(sprint7.6): оптимизация воронки new_booking до 4 шагов (вариант 2) Воронка сжата с 6 шагов до 4: intro → qualify → book → close. Спецификация: docs/OPTIMIZATION_CONVERSION_v1.md. Цель: сравнимая с конкурентом (NEXTBOT/Александра) конверсия — ≤3 реплик бота до запроса телефона, содержательный ответ на жалобу в первом осмысленном сообщении. Промпты шагов: - intro.md — переписан. Приветствие + открытый вопрос «что беспокоит?». Имя НЕ спрашиваем (слот name со шага снят), оно собирается на book вместе с телефоном. Если пациент сразу написал жалобу — не зацикливаемся, переходим в qualify. - qualify.md — переписан. Обязательный 5-пунктовый шаблон ответа на жалобу: эмпатия (одна фраза) → 2-3 ЛОР-гипотезы из RAG-выдержек («может быть связано с») → специалист → услуга/цена («при необходимости назначит») → бинарный CTA «записать?». Если в выдержках нет гипотез/цен — пункт пропускается, не сочиняем. Если жалоба не описана (пациент сразу «хочу записаться к ЛОРу») — пропускаем гипотезу/услугу, оставляем эмпатию-формальность + специалист + CTA. Три особые ситуации сохранены: ребёнок (require_legal_rep), конкретный врач (waitlist_flag), первичная жалоба на слух (needs_surgologist_first). - book.md — переписан. Одной репликой: подтверждение плана с использованием {specialist}/{reason} + запрос телефона + имени (если ещё не было в истории). При is_child=true — обращение к родителю, legal_rep_phone используется, если уже собран. - present.md — DEPRECATED. Файл оставлен в репо на случай отката (вариант 1 спецификации). Внутри — заглушка «попал по ошибке — выходи на book». - close.md и offer_time.md не тронуты (offer_time станет актуален с реальным календарём). allowed_next в SEED_INTENT_STEPS: - intro: [intro, qualify] (без изменений) - qualify: [qualify, book] (раньше: [qualify, present]) - present: [book] (изоляция; раньше: [present, qualify, offer_time]) - offer_time: [offer_time, book] (deprecated, без изменений) - book: [book, qualify, close] (раньше: [book, qualify, offer_time, close]) - close: [close] (без изменений) migrate_new_booking_allowed_next_v2(session) — одноразовая миграция в services/intent_step_service.py. При старте для каждого шага new_booking сравнивает текущий allowed_next_json с дореформенным значением (_PRE_SPRINT_7_6_ALLOWED_NEXT). Если совпадает — обновляет на новое из SEED. Если оператор правил вручную — пропускает, warning в лог. Идемпотентна (на повторных запусках ничего не делает). Подключена в main.py lifespan после ensure_seed_guards. Защитное условие require_legal_rep на qualify сохранено. Теперь блокирует переход qualify → book (раньше qualify → present). Логика та же: при is_child=true и пустых legal_rep_name/legal_rep_phone валидатор отклоняет переход. eval/MANUAL_CASES.md — markdown-чеклист для ручных прогонов: - §A: 5 конверсионных кейсов (храп+уши, боль в горле, тугоухость, насморк >месяца, звон в ушах) с чеклистом 5 пунктов на первый ответ и проверкой ≤3 реплик до телефона. - §B: регрессия 8 ручных сценариев из блока H Спринта 6b со ссылками на docs/examples/*_v2.md. SPRINTS.md: Спринт 7.6 → ✅ Закрыт по коду. Применение промптов в БД и ручная регрессия — за оператором (через UI «Настройки → Шаги» для каждого из 4 шагов new_booking). Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-28 21:04:09 +05:00
AR 15 M4	74befa484d	feat(sprint7.5): обновление промптов 4 веток + eval-каркас и тест-кейсы в UI Настроек Промпты веток (по docs/BRANCH_MAP_AND_PROMPTS_v1.md): - reschedule.md — полная замена. Одношаговый сценарий из 6 пунктов: action (cancel/reschedule), patient_name, patient_phone, original_time, preferred_new_time. Слоты хранит вызывающая система, STATE_JSON не используется. - price_question.md — добавлены 3 пункта: эндоскопия 1000₽ при первичном ЛОР-приёме, лечебные процедуры доплачиваются, ОМС только сурдолог (последний пункт работает только при подтверждении в базе). - medical_question.md — расширена карта жалоб → специалист (ЛОР / сурдолог / аллерголог / иммунолог / пульмонолог); добавлен пункт про беременность, онкологию, психиатрию — мягко сказать «специализированная клиника», не предлагать запись. - general_info.md — добавлены разделы «Отзывы и социальное доказательство», «Преимущества клиники», «Сокращения». Условия выхода расширены до 5 интентов. escalate_human и new_booking не трогаем (escalate — карта говорит «не менять»; new_booking — отдельный Спринт 7.6 по docs/OPTIMIZATION_CONVERSION_v1.md). Применение в БД — вручную через UI «Настройки» (вариант A): оператор копирует текст из .md, сохраняет как новую версию + активирует. Файлы — только seed. Eval-каркас (заготовка под Спринт 8): - eval/router_cases_booking.jsonl (875 кейсов new_booking) и eval/router_cases_other.jsonl (698 кейсов: general_info 295, price 165, escalate 139, medical 59, reschedule 40). CSV-исходники рядом. - eval/README.md — формат, глоссарий, что это и зачем. - routers/eval.py: GET /eval/router-cases?intent_code=...&limit=... Lazy-кэш, сортировка по count desc, фильтр по expected_intent. UI Настроек — выбор готового кейса в тест-блоке: - Полоса «Готовый кейс:» с datalist (поиск по началу строки) + кнопка «🎲 Случайный» + счётчик кейсов для активной ветки. - При выборе — текст подставляется в textarea вопроса. - Загружается при выборе ветки. Если кейсов 0 (для _router, _debug) — скрыто. - Полная подсистема прогона (run.py, отчёты, baseline) — Спринт 8. SPRINTS.md: - Спринт 7 (мульти-RAG, часть A) → ✅ Закрыт (коммит `52b46bc`). - Заведён Спринт 7.5 «Обновление промптов 4 веток» (этот спринт). - Заведён Спринт 7.6 «Оптимизация воронки new_booking до 4 шагов» по OPTIMIZATION_CONVERSION_v1.md. - В идеи на потом: сквозные правила всех веток (BRANCH_MAP §2), отложенная документация Спринта 7 (docs.html карточка термина, GRAPH_ARCHITECTURE_v5, README про мульти-RAG). Также: docs/COMPETITOR_ALEXANDRA_top100.md — рабочие материалы пользователя по конкурентному боту (NEXTBOT/Александра), используется как baseline для оптимизации воронки в Спринте 7.6. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-28 20:49:02 +05:00
AR 15 M4	82bba34937	feat(sprint6b): блок G — умный роутер видит thread_state - load_snapshot перенесён до вызова router.classify - RouterClient.classify принимает snapshot; добавляет блок [ТЕКУЩИЙ СЦЕНАРИЙ] в промпт роутера: ветка + шаг + слоты + инструкция предпочитать текущую ветку - Возвращает router_assembled_prompt для отладки - Промпт _router.md: объяснение блока [ТЕКУЩИЙ СЦЕНАРИЙ] и правило «предпочитай» - ChatResponse: поле router_assembled_prompt - Sandbox: раскрывающийся «промпт роутера» в блоке «Решение роутера» Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-26 20:54:17 +05:00
AR 15 M4	231e1f2d01	feat(sprint6b): блок E — причина передачи оператору + саммари - Роутер возвращает escalate_human\|reason (acute_pain/surgery/angry/explicit_request/routing_loop) - RouterClient парсит reason; дефолт explicit_request при неразобранном - _format_state_context получает escalation_reason → подставляется в промпт escalate_human - Промпт escalate_human переписан: разное поведение по reason - _build_operator_summary: reason + 8 реплик истории + слоты, логируется при передаче - Message.escalation_reason (String 50, nullable) + миграция h4b52e9dc0f83 - ChatResponse и MessageInfo получили escalation_reason и operator_summary - Sandbox: красный блок «передача оператору · причина» в состоянии треда - Sandbox: блок саммари для оператора (предпросмотр) в панели отладки Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-26 20:45:09 +05:00
AR 15 M4	4977199cd4	feat(sprint6b-F): guards в new_booking — require_legal_rep - check_guards() в state_machine.py: проверяет guards_json шага при переходе; trigger_slot/trigger_value/required_slots; нормализует "true"/"false"-строки - qualify step: guard require_legal_rep — блокирует переход в present, если is_child=true и не заполнены legal_rep_name / legal_rep_phone - Промпт qualify обновлён: инструкции по is_child, legal_rep, requested_doctor, waitlist_flag, needs_surgologist_first - ensure_seed_guards() патчит guards_json существующих шагов при старте - Sandbox: блок валидации показывает guard_name + missing_slots + description - Settings: обновлён лейбл поля guards с примером формата Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-26 18:27:10 +05:00
AR 15 M4	85c3ec0222	feat(sprint6b-D): soft-insertion counter + message meta_json - thread_state.soft_insertion_count: растёт при боковом ответе (soft_insertion=true в STATE_JSON без смены шага/слотов), сбрасывается при продвижении или handoff - При soft_insertion_count >= 3 в системный промпт ветки добавляется SOFT_INSERTION_NUDGE — явная инструкция вернуть пациента к вопросу текущего шага - state_machine.parse_branch_response читает флаг soft_insertion из STATE_JSON - Новая колонка message.meta_json: {router_intent_code, served_intent_code, step_code, events} — хранит снимок маршрутизации каждой реплики ассистента - «Песочница»: бейджи событий (sticky / soft_insertion / hard_handoff / resumed / routing_loop / validation_blocked) над каждым ответом ассистента Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-25 20:24:22 +05:00
AR 15 M4	9eef2dab3a	feat(sprint6a): блок A — structured output, intent_steps, sticky-удержание Заменили строковый тег [STATE: ...] из Спринта 5 на структурированный выход ветки в виде JSON-блока в хвосте ответа: {state_after, slots_updated}, парсимый балансировкой скобок. Шаги state machine вынесены из монолитного промпта в таблицу intent_steps (intent_id FK, code, name, order_index, system_prompt, allowed_next JSON, guards JSON) и редактируются через UI. Валидатор переходов сверяет state_after с allowed_next и блокирует невалидные прыжки. Базовый промпт new_booking разбит на base + 6 файлов шагов (intro/qualify/ present/offer_time/book/close), которые сидятся при старте через ensure_seed_steps. В chat_service промпт собирается как base + step + блок [ТЕКУЩЕЕ СОСТОЯНИЕ]. Попутно реализован мини-блок G (sticky state machine): когда диалог идёт по sm-ветке и роутер на новой реплике предлагает другую — state НЕ сбрасывается, в системный промпт ветки подаётся блок [ПОДСКАЗКА РОУТЕРА], LLM сама решает (STATE_JSON или INTENT_CHANGE). Это сняло ключевую дыру Спринта 5: «Меня зовут Алексей» / «болит ухо» внутри записи больше не сбрасывают сценарий. Промпт ветки new_booking ужесточён: бытовые жалобы — это повод записи (слот reason + сочувствие), не повод уводить в medical_question. Шаг present теперь использует reason в формулировке. Промпт _router расширен живыми примерами для всех 6 веток, особенно для reschedule («не смогу подойти», «перенесите»). Надёжность внешнего LLM: - ретрай в LLMClient с паузой 500 мс + новое исключение LLMUnavailableError; - ретрай в RouterClient (DeepSeek периодически моргает); - /chat при ошибке делает session.rollback() и возвращает 503 с понятным сообщением — больше не остаётся «диалогов-призраков» с одной репликой; - UI убирает свой пузырь и возвращает текст в поле ввода для повторной отправки. UI «Настройки» — добавлена вкладка «Шаги» для веток с state machine: список шагов chip-ами, редактор промпта/имени/allowed_next/guards, сохранение через PATCH /intents/{code}/steps/{step_code} без версионирования. Иконка ⓘ возле поля «Правила» открывает popover с пояснением, что туда писать. UI «Песочница»: - блок «Состояние диалога» показывает имя шага из intent_steps (а не сырое число), для не-sm-веток пишется «без пошагового сценария»; - подсветка illegal-переходов (валидатор отклонил state_after) и parse_error для sm-веток; - блок «Решение роутера» развёрнут в три исхода: «попал в ту же ветку» / «удержались в ветке» / «ветка сама передала управление через INTENT_CHANGE»; - секция «Найденные фрагменты» сворачивается, карточки чанков раскрываются по клику — правый сайдбар стал компактнее. Терминология (по договорённости — простой русский в UI): - «тред» → «диалог» в текстах для оператора (в коде/API thread_id оставлен); - «sticky state machine» → «удержались в ветке»; - «state machine» → «пошаговый сценарий» в видимых местах. SPRINTS.md: блок G в Спринте 6b сокращён — sticky-логика уже сделана здесь, осталась только вторая линия (передача thread_state в системный промпт самого роутера для ещё более точной первичной классификации). Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-25 11:45:42 +05:00
AR 15 M4	cac3d29273	feat(sprint5): state machine + bouncing — thread_state и служебные теги Таблица thread_state (intent, step, slots) ведётся per-thread. В системный промпт ветки дописывается текущее состояние, LLM возвращает служебный тег [STATE: step=N; slots={...}] после основного ответа — парсер в chat_service вырезает его и обновляет состояние. Если ветка решила, что тема ушла в другую, она выдаёт [INTENT_CHANGE: code] — делаем один повторный вызов LLM с новой веткой и сброшенным state (bouncing, MAX_BOUNCES=1). Если роутер сам выбрал другую ветку, чем в thread_state, — state тоже сбрасывается. Промпт new_booking переписан под 6-шаговый сценарий (имя → повод → специалист → время → подтверждение → запись), в «Песочнице» появился блок «Состояние треда» с intent/step/slots и списком переходов. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-24 12:12:36 +05:00
AR 15 M4	b24e985f82	feat(sprint4): фундамент графа — intents + роутер + переключение веток Первый шаг графовой архитектуры из GRAPH_ARCHITECTURE.md. Заменили «один активный промпт на всё» на «свой промпт на каждую ветку + роутер выбирает ветку на каждой реплике». Данные: - Новая таблица intents (code, name, description, is_enabled, order_index). Коды с префиксом `_` — системные (не responder). - В agent_configs добавлен intent_id (nullable, FK SET NULL); убрана глобальная уникальность version, вместо неё UniqueConstraint (intent_id, version) — у каждой ветки свой счётчик версий. - В messages добавлен intent_id (nullable, FK) — фиксируем, какую ветку выбрал роутер для каждой реплики. - Миграция cd0a88ef9080 в batch-режиме (SQLite не умеет ALTER для constraints напрямую). Сид: - Стартовые 7 веток: new_booking, reschedule, price_question, medical_question, general_info, escalate_human + `_router` как системная ветка для промпта классификатора. - Для каждой ветки — свой v1-промпт из prompts/intents/{code}.md. - migrate_legacy_config_to_general_info: старый v1 из Спринта 3 (без intent_id) переносится на general_info с сохранением версии. - ensure_seed_intents досиживает недостающие коды, существующие не трогает — безопасно при добавлении новых веток. Оркестрация и роутер: - services/router_client.RouterClient — отдельный класс от LLMClient (под будущую смену модели на более дешёвую). Метод classify(session, history, text) возвращает {code, version}. Промпт классификатора подтягивается из активного конфига ветки `_router`, fallback — prompts/intents/_router.md. При сомнении/ошибке возвращает general_info. - services/chat_service.send_message теперь идёт через router.classify → берёт активный конфиг выбранной ветки → llm.chat. В сообщения пишется intent_id, в треде фиксируется начальный agent_config_id. В ответе — intent_code, intent_name, config_version, router_version. API: - GET /intents, GET /intents/{code}, PATCH /intents/{code} — список веток со счётчиком версий, получение и переключение is_enabled. - /configs теперь требует intent_code как Query-параметр (GET /configs, GET /configs/active) — выборка версий в рамках ветки. POST /configs принимает intent_id. - get_thread_detail JOIN-ит Intent — каждая реплика возвращает intent_code + intent_name. UI: - settings.html переработан в 3-колоночный макет: слева список веток с подгруппой «Системные» для `_router` (пометка «система» вместо свитча), в центре редактор промпта/правил активной версии выбранной ветки, справа список версий с активировать/удалить/загрузить. Каждая ветка редактируется независимо — своя история версий, своя активная. - sandbox.html: у каждой реплики бейдж с intent_code, в отладке новый блок «Решение роутера» (подсвеченный зелёным) с названием ветки, версией её активного конфига и версией промпта роутера. Старый «активная: v1» индикатор убран — он больше не имеет смысла (активная у каждой ветки своя). E2E проверено: разные реплики уходят в корректные ветки, каждая отвечает по своему узкому промпту, промпт роутера редактируется в UI как v2/v3 и откатывается — классификация сразу использует новую версию. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-23 21:20:23 +05:00

10 Commits