RAG_helper

Author	SHA1	Message	Date
AR 15 M4	82bba34937	feat(sprint6b): блок G — умный роутер видит thread_state - load_snapshot перенесён до вызова router.classify - RouterClient.classify принимает snapshot; добавляет блок [ТЕКУЩИЙ СЦЕНАРИЙ] в промпт роутера: ветка + шаг + слоты + инструкция предпочитать текущую ветку - Возвращает router_assembled_prompt для отладки - Промпт _router.md: объяснение блока [ТЕКУЩИЙ СЦЕНАРИЙ] и правило «предпочитай» - ChatResponse: поле router_assembled_prompt - Sandbox: раскрывающийся «промпт роутера» в блоке «Решение роутера» Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-26 20:54:17 +05:00
AR 15 M4	231e1f2d01	feat(sprint6b): блок E — причина передачи оператору + саммари - Роутер возвращает escalate_human\|reason (acute_pain/surgery/angry/explicit_request/routing_loop) - RouterClient парсит reason; дефолт explicit_request при неразобранном - _format_state_context получает escalation_reason → подставляется в промпт escalate_human - Промпт escalate_human переписан: разное поведение по reason - _build_operator_summary: reason + 8 реплик истории + слоты, логируется при передаче - Message.escalation_reason (String 50, nullable) + миграция h4b52e9dc0f83 - ChatResponse и MessageInfo получили escalation_reason и operator_summary - Sandbox: красный блок «передача оператору · причина» в состоянии треда - Sandbox: блок саммари для оператора (предпросмотр) в панели отладки Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-26 20:45:09 +05:00
AR 15 M4	d7ded5c9f1	feat(sprint6b): блоки D+F — pending_guard, guard-индикаторы в UI, race-condition fix - _eval_pending_guard() — вычисляет активный guard при незаполненных слотах - pending_guard добавлен в ThreadStateInfo (ответы /chat и /threads/:id) - ValidationEventInfo получил guard_name / missing_slots / guard_description - Sandbox: amber-блок «guard активен», подсветка в validation-событиях - openThread() защищён от race condition: if (activeThreadId !== id) return (исключает отрисовку устаревшего треда после переключения на новый) Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-26 19:36:15 +05:00
AR 15 M4	4977199cd4	feat(sprint6b-F): guards в new_booking — require_legal_rep - check_guards() в state_machine.py: проверяет guards_json шага при переходе; trigger_slot/trigger_value/required_slots; нормализует "true"/"false"-строки - qualify step: guard require_legal_rep — блокирует переход в present, если is_child=true и не заполнены legal_rep_name / legal_rep_phone - Промпт qualify обновлён: инструкции по is_child, legal_rep, requested_doctor, waitlist_flag, needs_surgologist_first - ensure_seed_guards() патчит guards_json существующих шагов при старте - Sandbox: блок валидации показывает guard_name + missing_slots + description - Settings: обновлён лейбл поля guards с примером формата Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-26 18:27:10 +05:00
AR 15 M4	45832e2b37	feat(ui+docs): читаемые бейджи реплик + раздел документации Бейджи в Песочнице: - Каждый бейдж теперь с русским префиксом-меткой (ветка/шаг/роутер предложил/решение/тип ответа) - Тег «многошаговая» на бейдже ветки при is_state_machine или наличии step_code - Шаг: сначала русское название, потом код в скобках (Повод и специалист (qualify)) - get_thread_detail обогащает старые meta: подтягивает step_name и is_state_machine из БД Документация: - «Удержание в ветке» — пошаговый разбор sticky-механизма, явно что не второй роутер - Новая карточка «Боковой вопрос (soft_insertion)» — откуда берётся, счётчик, nudge - Блок под схемой «Что происходит на каждой реплике»: почему бейджи на ответах ассистента Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-25 21:08:27 +05:00
AR 15 M4	85c3ec0222	feat(sprint6b-D): soft-insertion counter + message meta_json - thread_state.soft_insertion_count: растёт при боковом ответе (soft_insertion=true в STATE_JSON без смены шага/слотов), сбрасывается при продвижении или handoff - При soft_insertion_count >= 3 в системный промпт ветки добавляется SOFT_INSERTION_NUDGE — явная инструкция вернуть пациента к вопросу текущего шага - state_machine.parse_branch_response читает флаг soft_insertion из STATE_JSON - Новая колонка message.meta_json: {router_intent_code, served_intent_code, step_code, events} — хранит снимок маршрутизации каждой реплики ассистента - «Песочница»: бейджи событий (sticky / soft_insertion / hard_handoff / resumed / routing_loop / validation_blocked) над каждым ответом ассистента Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>	2026-04-25 20:24:22 +05:00
AR 15 M4	3c71372ec8	docs+ui: страница «Документация», единый стиль заголовков, перевод на оператора Добавлена /docs.html — обзор мультиагентной системы для оператора. Все термины в формате «русский (english)», жирным: ветка (intent), маршрутизатор (router), пошаговый сценарий (state machine), шаг (step), допустимые переходы (allowed_next), слоты (slots), условия выхода (exit conditions), переключение ветки (hard handoff), удержание в ветке (sticky state machine), структурированный ответ (structured output), отложенный сценарий (suspended/resume), защита от петли (routing loop guard), состояние диалога (thread state). Плюс пошаговая схема обработки реплики и резюме защитных механизмов. Ссылка «Документация» добавлена в шапку всех страниц. Унификация заголовков под стиль «Версии» в правом сайдбаре Настроек: убран uppercase, переход на 13px / var(--fg) / font-weight 600 / зажатый letter-spacing. Применилось к .col-head во всех колонках, .field label в редакторе, .section-header в списке веток, заголовкам столбцов на странице Отладки и заголовкам секций RAG-результата. Бейджи (АКТИВНАЯ, система) оставлены прежними — это статусные метки, не заголовки. Переименование ветки escalate_human для согласованности с русским UI: «Эскалация на оператора» → «Перевод на оператора», описание тоже. Точечная миграция при старте (intent_service.migrate_intent_copy) обновляет существующие записи в БД, только если поле в точности совпадает со старым значением — операторские правки не затираются. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-25 16:41:58 +05:00
AR 15 M4	932b488bcb	feat(sprint6a): блоки A2, B, C — exit_conditions, handoff_count, suspended/resume Блок A2: вынос условий выхода из основного промпта в отдельное поле agent_configs.exit_conditions_text. compose_full_system_prompt склеивает system_prompt + rules_text + exit_conditions_text перед отправкой в модель. Одноразовая миграция данных при старте: пытаемся выделить блок «Условия выхода» из хвоста существующих system_prompt-ов и перенести в новое поле (поддерживаются три формы заголовка: «## Условия выхода», «Условия выхода», просто «Условия выхода:»). В UI «Настройки» — третья textarea с подсказкой ⓘ на отдельной кнопке. Блок B: защита от петель маршрутизации (v2 §4.3). В thread_state добавлена колонка handoff_count, инкрементируется на каждом hard-handoff: либо когда роутер переключает не-sm-ветку (state reset), либо когда sm-ветка сама выдаёт [INTENT_CHANGE: …] (bouncing). При превышении HANDOFF_CAP=3 диалог автоматически уводится в escalate_human с шаблонным ответом «Уточню детали с администратором клиники, свяжемся с вами в течение ближайшего часа», LLM не вызывается, handoff_count сбрасывается. В Песочнице видны счётчик «переключений ветки в диалоге» и красная плашка при срабатывании защиты. Также пофикшен баг: для не-sm-веток snapshot.current_intent_code теперь финализируется на served_code, иначе на следующей реплике prev_intent_code терялся и handoff_count не считался. Блок C: suspended_intent / resumable_step_code / resumable_slots_json в thread_state (v2 §4.4). При hard-handoff из sm-ветки через [INTENT_CHANGE] текущий сценарий запоминается (если suspended ещё не занят). Когда роутер на следующих репликах возвращает intent = suspended_intent — RESUME: восстанавливаем current_intent_code, current_step_code, slots; suspended_* очищается, handoff_count=0. Возврат имеет приоритет над sticky-логикой. В Песочнице — синяя плашка «📌 отложен сценарий X (шаг Y)» во время detour'а и зелёная «↩️ возврат к отложенному сценарию» в момент resume. Routing-loop guard и роутер-driven handoff не теряют suspended (только при authoritative сценариях вроде эскалации он сбрасывается). Прогон вручную: detour из new_booking/qualify в price_question и обратно восстанавливает name=Алексей, reason=болит ухо на исходном шаге. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-25 12:46:10 +05:00
AR 15 M4	9eef2dab3a	feat(sprint6a): блок A — structured output, intent_steps, sticky-удержание Заменили строковый тег [STATE: ...] из Спринта 5 на структурированный выход ветки в виде JSON-блока в хвосте ответа: {state_after, slots_updated}, парсимый балансировкой скобок. Шаги state machine вынесены из монолитного промпта в таблицу intent_steps (intent_id FK, code, name, order_index, system_prompt, allowed_next JSON, guards JSON) и редактируются через UI. Валидатор переходов сверяет state_after с allowed_next и блокирует невалидные прыжки. Базовый промпт new_booking разбит на base + 6 файлов шагов (intro/qualify/ present/offer_time/book/close), которые сидятся при старте через ensure_seed_steps. В chat_service промпт собирается как base + step + блок [ТЕКУЩЕЕ СОСТОЯНИЕ]. Попутно реализован мини-блок G (sticky state machine): когда диалог идёт по sm-ветке и роутер на новой реплике предлагает другую — state НЕ сбрасывается, в системный промпт ветки подаётся блок [ПОДСКАЗКА РОУТЕРА], LLM сама решает (STATE_JSON или INTENT_CHANGE). Это сняло ключевую дыру Спринта 5: «Меня зовут Алексей» / «болит ухо» внутри записи больше не сбрасывают сценарий. Промпт ветки new_booking ужесточён: бытовые жалобы — это повод записи (слот reason + сочувствие), не повод уводить в medical_question. Шаг present теперь использует reason в формулировке. Промпт _router расширен живыми примерами для всех 6 веток, особенно для reschedule («не смогу подойти», «перенесите»). Надёжность внешнего LLM: - ретрай в LLMClient с паузой 500 мс + новое исключение LLMUnavailableError; - ретрай в RouterClient (DeepSeek периодически моргает); - /chat при ошибке делает session.rollback() и возвращает 503 с понятным сообщением — больше не остаётся «диалогов-призраков» с одной репликой; - UI убирает свой пузырь и возвращает текст в поле ввода для повторной отправки. UI «Настройки» — добавлена вкладка «Шаги» для веток с state machine: список шагов chip-ами, редактор промпта/имени/allowed_next/guards, сохранение через PATCH /intents/{code}/steps/{step_code} без версионирования. Иконка ⓘ возле поля «Правила» открывает popover с пояснением, что туда писать. UI «Песочница»: - блок «Состояние диалога» показывает имя шага из intent_steps (а не сырое число), для не-sm-веток пишется «без пошагового сценария»; - подсветка illegal-переходов (валидатор отклонил state_after) и parse_error для sm-веток; - блок «Решение роутера» развёрнут в три исхода: «попал в ту же ветку» / «удержались в ветке» / «ветка сама передала управление через INTENT_CHANGE»; - секция «Найденные фрагменты» сворачивается, карточки чанков раскрываются по клику — правый сайдбар стал компактнее. Терминология (по договорённости — простой русский в UI): - «тред» → «диалог» в текстах для оператора (в коде/API thread_id оставлен); - «sticky state machine» → «удержались в ветке»; - «state machine» → «пошаговый сценарий» в видимых местах. SPRINTS.md: блок G в Спринте 6b сокращён — sticky-логика уже сделана здесь, осталась только вторая линия (передача thread_state в системный промпт самого роутера для ещё более точной первичной классификации). Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-25 11:45:42 +05:00
AR 15 M4	cac3d29273	feat(sprint5): state machine + bouncing — thread_state и служебные теги Таблица thread_state (intent, step, slots) ведётся per-thread. В системный промпт ветки дописывается текущее состояние, LLM возвращает служебный тег [STATE: step=N; slots={...}] после основного ответа — парсер в chat_service вырезает его и обновляет состояние. Если ветка решила, что тема ушла в другую, она выдаёт [INTENT_CHANGE: code] — делаем один повторный вызов LLM с новой веткой и сброшенным state (bouncing, MAX_BOUNCES=1). Если роутер сам выбрал другую ветку, чем в thread_state, — state тоже сбрасывается. Промпт new_booking переписан под 6-шаговый сценарий (имя → повод → специалист → время → подтверждение → запись), в «Песочнице» появился блок «Состояние треда» с intent/step/slots и списком переходов. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-24 12:12:36 +05:00
AR 15 M4	b24e985f82	feat(sprint4): фундамент графа — intents + роутер + переключение веток Первый шаг графовой архитектуры из GRAPH_ARCHITECTURE.md. Заменили «один активный промпт на всё» на «свой промпт на каждую ветку + роутер выбирает ветку на каждой реплике». Данные: - Новая таблица intents (code, name, description, is_enabled, order_index). Коды с префиксом `_` — системные (не responder). - В agent_configs добавлен intent_id (nullable, FK SET NULL); убрана глобальная уникальность version, вместо неё UniqueConstraint (intent_id, version) — у каждой ветки свой счётчик версий. - В messages добавлен intent_id (nullable, FK) — фиксируем, какую ветку выбрал роутер для каждой реплики. - Миграция cd0a88ef9080 в batch-режиме (SQLite не умеет ALTER для constraints напрямую). Сид: - Стартовые 7 веток: new_booking, reschedule, price_question, medical_question, general_info, escalate_human + `_router` как системная ветка для промпта классификатора. - Для каждой ветки — свой v1-промпт из prompts/intents/{code}.md. - migrate_legacy_config_to_general_info: старый v1 из Спринта 3 (без intent_id) переносится на general_info с сохранением версии. - ensure_seed_intents досиживает недостающие коды, существующие не трогает — безопасно при добавлении новых веток. Оркестрация и роутер: - services/router_client.RouterClient — отдельный класс от LLMClient (под будущую смену модели на более дешёвую). Метод classify(session, history, text) возвращает {code, version}. Промпт классификатора подтягивается из активного конфига ветки `_router`, fallback — prompts/intents/_router.md. При сомнении/ошибке возвращает general_info. - services/chat_service.send_message теперь идёт через router.classify → берёт активный конфиг выбранной ветки → llm.chat. В сообщения пишется intent_id, в треде фиксируется начальный agent_config_id. В ответе — intent_code, intent_name, config_version, router_version. API: - GET /intents, GET /intents/{code}, PATCH /intents/{code} — список веток со счётчиком версий, получение и переключение is_enabled. - /configs теперь требует intent_code как Query-параметр (GET /configs, GET /configs/active) — выборка версий в рамках ветки. POST /configs принимает intent_id. - get_thread_detail JOIN-ит Intent — каждая реплика возвращает intent_code + intent_name. UI: - settings.html переработан в 3-колоночный макет: слева список веток с подгруппой «Системные» для `_router` (пометка «система» вместо свитча), в центре редактор промпта/правил активной версии выбранной ветки, справа список версий с активировать/удалить/загрузить. Каждая ветка редактируется независимо — своя история версий, своя активная. - sandbox.html: у каждой реплики бейдж с intent_code, в отладке новый блок «Решение роутера» (подсвеченный зелёным) с названием ветки, версией её активного конфига и версией промпта роутера. Старый «активная: v1» индикатор убран — он больше не имеет смысла (активная у каждой ветки своя). E2E проверено: разные реплики уходят в корректные ветки, каждая отвечает по своему узкому промпту, промпт роутера редактируется в UI как v2/v3 и откатывается — классификация сразу использует новую версию. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-23 21:20:23 +05:00
AR 15 M4	7ec2ba3c8f	feat(sprint3): редактор системного промпта и правил с версионированием Операторы получают веб-редактор: правят системный промпт и правила, сохраняют как новую версию, активируют, откатываются. Активная версия используется в «Песочнице» на каждый /chat. Принципы, согласованные заранее: - Сохранённые версии не редактируются — только создание новой. Честный откат: v1 всегда та же, что была при создании. - Правила на этом этапе — свободный markdown (textarea). Переход на структурированные правила (pattern → instruction) — в бэклог. - Файл prompts/system_prompt.md становится сид-источником: при первом старте, если таблица agent_configs пустая, из него создаётся v1 и активируется. Дальше правда идёт из БД, файл не трогаем. - rules_text конкатенируется с system_prompt в один system-message через compose_full_system_prompt: "{prompt}\n\nДополнительные правила:\n{rules}". - Активную версию удалить нельзя — сначала активируют другую. Модель и миграция: - db/models/AgentConfig: id, version (unique/indexed), name (nullable), system_prompt, rules_text, is_active (indexed), created_at. Без updated_at — версии неизменяемы. - Миграция b4450e33664d_add_agent_configs_table. Сервисы и роутеры: - services/config_service: ensure_seed (seed v1 из файла), list/get/get_active/create (version=max+1, при activate атомарно сбрасывает is_active у остальных и ставит новой), activate_config (та же схема), delete_config (возвращает причину отказа: not_found / active), compose_full_system_prompt. - services/chat_service.send_message: берёт active_cfg, собирает system_prompt через compose_full_system_prompt, пишет thread.agent_config_id при создании треда (колонка была nullable ещё со Спринта 2 — пригодилась именно здесь). - routers/configs: GET /configs, GET /configs/active, GET /configs/{id}, POST /configs (activate-флаг), POST /configs/{id}/activate, DELETE /configs/{id} (404 / 400 если активная). - Pydantic: AgentConfigCreateRequest, AgentConfigInfo, ListResponse, DeleteResponse. - main.py: ensure_seed в lifespan после инициализации БД/Chroma/LLM. UI: - static/settings.html — трёхблочная страница: имя версии, textarea промпта, textarea правил, «Сохранить как новую» + галка «Сразу активировать», «Загрузить активную в редактор». Справа — список версий с бейджем «активная», действиями «Активировать» / «Удалить» (disabled у активной) / «Загрузить в редактор». При первом заходе активная версия автоматом подгружается в редактор. - В nav на index.html и sandbox.html добавлена ссылка «Настройки». - В шапке «Песочницы» — зелёный кликабельный бейдж «активная: vN · имя» (ведёт на /settings.html), обновляется раз в 15 с. E2E проверено: создана v2 с правилом «ВСЕГДА начинай со слов СПАСИБО ЗА ВОПРОС», активирована; следующий /chat вернул ответ, начинающийся ровно с этой фразы; assembled_prompt содержит блок «Дополнительные правила». После отката на v1 тест-v2 удалена. SPRINTS.md: Спринт 3 помечен закрытым. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-23 19:59:06 +05:00
AR 15 M4	4e45b8b181	feat(sprint2.5): логи, вынесение системного промпта, markdown-рендер Три подряд доработки по плану Спринта 2.5. 1) Логи. Проблема: uvicorn ставит handlers на root-logger до того, как отработает наш lifespan, поэтому logging.basicConfig там был no-op, и logger.exception ничего не писал. Переносим basicConfig на уровень импорта main.py с force=True — наш StreamHandler перебивает uvicorn-овский root, остальные логгеры (uvicorn.access, uvicorn.error, alembic, chromadb) остаются со своими форматами. В lifespan basicConfig больше не зовётся. 2) Системный промпт вынесен из services/llm_client.py в prompts/system_prompt.md. LLMClient читает файл при импорте модуля через _load_system_prompt(); если файла нет — пустая строка + warning. Это задел под Спринт 3, где промпт будет редактируемым и версионируемым — физически положить его как файл дешевле, чем держать в исходниках. 3) Markdown в ответах ассистента. Подключены marked и DOMPurify с CDN в sandbox.html. Рендер через renderMd(text): marked.parse + DOMPurify.sanitize — защищает от <script> на случай, если LLM вернёт сырой HTML. Реплики пациента остаются plain text (esc). Добавлены стили для p/ul/ol/code/pre/a/h1-h3/blockquote внутри .msg.assistant, чтобы всё выглядело уместно в пузыре. Обёртка msg-body введена, чтобы разделить контент и msg-meta. План в SPRINTS.md уточнён по переиндексации — будет отдельный endpoint. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-23 10:53:01 +05:00
AR 15 M4	22ac40450f	feat(sprint2): страница «Песочница» + навигация между страницами Завершающий кусок Спринта 2 — UI для ведения диалогов. static/sandbox.html: - Трёхколоночная раскладка во всю высоту экрана. - Слева: список сохранённых диалогов (имя, дата последнего обновления, счётчик сообщений, превью первой реплики), кнопка «+ новый»; на каждой карточке — «переименовать» (prompt) и «удалить» (confirm). - Центр: чат в привычной стилистике (пузыри, user справа, assistant слева), Enter — отправить, Shift+Enter — перенос строки. Заголовок сверху показывает имя активного треда. - Справа: отладка ответа — найденные фрагменты со score в процентах + собранный промпт в моноширинном блоке на светлом фоне. - При отправке первой реплики тред создаётся автоматически, API возвращает thread_id и thread_name — дальше реплики уходят в тот же тред. static/index.html: в шапке добавлены ссылки «Отладка» / «Песочница», подсветка активной страницы; тот же стиль nav-ссылок продублирован в sandbox.html. routers/chat: detail сообщения ошибки теперь включает тип исключения (удобнее при диагностике), trace пишется через logger.exception. SPRINTS.md: Спринт 2 помечен как закрытый. Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>	2026-04-23 10:37:57 +05:00

14 Commits