feat(sprint6a): блок A — structured output, intent_steps, sticky-удержание

Заменили строковый тег [STATE: ...] из Спринта 5 на структурированный выход ветки в виде JSON-блока в хвосте ответа: {state_after, slots_updated}, парсимый балансировкой скобок. Шаги state machine вынесены из монолитного промпта в таблицу intent_steps (intent_id FK, code, name, order_index, system_prompt, allowed_next JSON, guards JSON) и редактируются через UI. Валидатор переходов сверяет state_after с allowed_next и блокирует невалидные прыжки. Базовый промпт new_booking разбит на base + 6 файлов шагов (intro/qualify/ present/offer_time/book/close), которые сидятся при старте через ensure_seed_steps. В chat_service промпт собирается как base + step + блок [ТЕКУЩЕЕ СОСТОЯНИЕ]. Попутно реализован мини-блок G (sticky state machine): когда диалог идёт по sm-ветке и роутер на новой реплике предлагает другую — state НЕ сбрасывается, в системный промпт ветки подаётся блок [ПОДСКАЗКА РОУТЕРА], LLM сама решает (STATE_JSON или INTENT_CHANGE). Это сняло ключевую дыру Спринта 5: «Меня зовут Алексей» / «болит ухо» внутри записи больше не сбрасывают сценарий. Промпт ветки new_booking ужесточён: бытовые жалобы — это повод записи (слот reason + сочувствие), не повод уводить в medical_question. Шаг present теперь использует reason в формулировке. Промпт _router расширен живыми примерами для всех 6 веток, особенно для reschedule («не смогу подойти», «перенесите»). Надёжность внешнего LLM: - ретрай в LLMClient с паузой 500 мс + новое исключение LLMUnavailableError; - ретрай в RouterClient (DeepSeek периодически моргает); - /chat при ошибке делает session.rollback() и возвращает 503 с понятным сообщением — больше не остаётся «диалогов-призраков» с одной репликой; - UI убирает свой пузырь и возвращает текст в поле ввода для повторной отправки. UI «Настройки» — добавлена вкладка «Шаги» для веток с state machine: список шагов chip-ами, редактор промпта/имени/allowed_next/guards, сохранение через PATCH /intents/{code}/steps/{step_code} без версионирования. Иконка ⓘ возле поля «Правила» открывает popover с пояснением, что туда писать. UI «Песочница»: - блок «Состояние диалога» показывает имя шага из intent_steps (а не сырое число), для не-sm-веток пишется «без пошагового сценария»; - подсветка illegal-переходов (валидатор отклонил state_after) и parse_error для sm-веток; - блок «Решение роутера» развёрнут в три исхода: «попал в ту же ветку» / «удержались в ветке» / «ветка сама передала управление через INTENT_CHANGE»; - секция «Найденные фрагменты» сворачивается, карточки чанков раскрываются по клику — правый сайдбар стал компактнее. Терминология (по договорённости — простой русский в UI): - «тред» → «диалог» в текстах для оператора (в коде/API thread_id оставлен); - «sticky state machine» → «удержались в ветке»; - «state machine» → «пошаговый сценарий» в видимых местах. SPRINTS.md: блок G в Спринте 6b сокращён — sticky-логика уже сделана здесь, осталась только вторая линия (передача thread_state в системный промпт самого роутера для ещё более точной первичной классификации). Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
2026-04-25 11:45:42 +05:00
parent 248cb37f8a
commit 9eef2dab3a
28 changed files with 1469 additions and 264 deletions
@@ -0,0 +1,149 @@
+"""Парсер structured-output ветки + валидатор переходов state machine (Спринт 6a).
+
+Формат ответа ветки со state machine:
+
+    Текст пациенту, markdown разрешён.
+
+    STATE_JSON: {"state_after": "<step_code>", "slots_updated": {"slot": "value"}}
+
+Либо — при exit condition — вместо `STATE_JSON:` строка `[INTENT_CHANGE: <code>]`.
+Парсер вырезает служебную часть и возвращает видимый текст + решение модели.
+"""
+import json
+import logging
+import re
+
+logger = logging.getLogger(__name__)
+
+_INTENT_CHANGE_RE = re.compile(r"\[INTENT_CHANGE:\s*([a-z_][a-z0-9_]*)\s*\]")
+_STATE_JSON_RE = re.compile(r"STATE_JSON\s*:\s*", re.IGNORECASE)
+
+
+def parse_branch_response(text: str) -> dict:
+    """Разобрать ответ ветки на visible_text + intent_change / state_update.
+
+    Возвращает:
+        visible_text: str — текст пациенту (без служебных тегов),
+        intent_change: str | None — код ветки, если сработал exit condition,
+        state_update: {'state_after': str, 'slots_updated': dict} | None — при штатном ответе,
+        parse_error: str | None — если что-то не разобралось, сюда кладётся причина
+                                  (visible_text при этом = исходный текст без мусора).
+    """
+    # Exit condition имеет приоритет.
+    intent_match = _INTENT_CHANGE_RE.search(text)
+    if intent_match:
+        visible = text[:intent_match.start()].rstrip()
+        return {
+            "visible_text": visible,
+            "intent_change": intent_match.group(1),
+            "state_update": None,
+            "parse_error": None,
+        }
+
+    state_match = _STATE_JSON_RE.search(text)
+    if not state_match:
+        # Модель не вернула служебную часть. Возвращаем весь текст и ошибку парсинга.
+        return {
+            "visible_text": text.rstrip(),
+            "intent_change": None,
+            "state_update": None,
+            "parse_error": "no STATE_JSON block",
+        }
+
+    raw_json, _ = _consume_json_object(text, state_match.end())
+    if raw_json is None:
+        return {
+            "visible_text": text[:state_match.start()].rstrip(),
+            "intent_change": None,
+            "state_update": None,
+            "parse_error": "STATE_JSON present but no balanced JSON object",
+        }
+
+    try:
+        data = json.loads(raw_json)
+    except json.JSONDecodeError as e:
+        return {
+            "visible_text": text[:state_match.start()].rstrip(),
+            "intent_change": None,
+            "state_update": None,
+            "parse_error": f"STATE_JSON invalid JSON: {e}",
+        }
+
+    if not isinstance(data, dict):
+        return {
+            "visible_text": text[:state_match.start()].rstrip(),
+            "intent_change": None,
+            "state_update": None,
+            "parse_error": "STATE_JSON is not an object",
+        }
+
+    state_after = data.get("state_after")
+    slots_updated = data.get("slots_updated", {})
+    if not isinstance(state_after, str) or not state_after:
+        return {
+            "visible_text": text[:state_match.start()].rstrip(),
+            "intent_change": None,
+            "state_update": None,
+            "parse_error": "STATE_JSON missing state_after",
+        }
+    if not isinstance(slots_updated, dict):
+        slots_updated = {}
+
+    return {
+        "visible_text": text[:state_match.start()].rstrip(),
+        "intent_change": None,
+        "state_update": {"state_after": state_after, "slots_updated": slots_updated},
+        "parse_error": None,
+    }
+
+
+def _consume_json_object(text: str, start: int) -> tuple[str | None, int]:
+    """Вытянуть сбалансированный JSON-объект из text[start:]. См. парсер в chat_service."""
+    i = start
+    n = len(text)
+    while i < n and text[i].isspace():
+        i += 1
+    if i >= n or text[i] != "{":
+        return None, start
+    depth = 0
+    in_str = False
+    esc = False
+    j = i
+    while j < n:
+        ch = text[j]
+        if in_str:
+            if esc:
+                esc = False
+            elif ch == "\\":
+                esc = True
+            elif ch == '"':
+                in_str = False
+        else:
+            if ch == '"':
+                in_str = True
+            elif ch == "{":
+                depth += 1
+            elif ch == "}":
+                depth -= 1
+                if depth == 0:
+                    return text[i:j + 1], j + 1
+        j += 1
+    return None, start
+
+
+def validate_transition(
+    *, current_step: str, requested_step: str, allowed_next: list[str],
+) -> tuple[bool, str]:
+    """Разрешён ли переход `current_step → requested_step`.
+
+    Остаться на месте (`requested_step == current_step`) разрешено всегда.
+    Возвращает (ok, reason).
+    """
+    if requested_step == current_step:
+        return True, "stay"
+    if requested_step in allowed_next:
+        return True, "ok"
+    return (
+        False,
+        f"requested {requested_step!r} not in allowed_next {allowed_next!r} of {current_step!r}",
+    )