9eef2dab3a
Заменили строковый тег [STATE: ...] из Спринта 5 на структурированный выход
ветки в виде JSON-блока в хвосте ответа: {state_after, slots_updated}, парсимый
балансировкой скобок. Шаги state machine вынесены из монолитного промпта в
таблицу intent_steps (intent_id FK, code, name, order_index, system_prompt,
allowed_next JSON, guards JSON) и редактируются через UI. Валидатор переходов
сверяет state_after с allowed_next и блокирует невалидные прыжки.
Базовый промпт new_booking разбит на base + 6 файлов шагов (intro/qualify/
present/offer_time/book/close), которые сидятся при старте через
ensure_seed_steps. В chat_service промпт собирается как base + step + блок
[ТЕКУЩЕЕ СОСТОЯНИЕ].
Попутно реализован мини-блок G (sticky state machine): когда диалог идёт по
sm-ветке и роутер на новой реплике предлагает другую — state НЕ сбрасывается,
в системный промпт ветки подаётся блок [ПОДСКАЗКА РОУТЕРА], LLM сама решает
(STATE_JSON или INTENT_CHANGE). Это сняло ключевую дыру Спринта 5: «Меня
зовут Алексей» / «болит ухо» внутри записи больше не сбрасывают сценарий.
Промпт ветки new_booking ужесточён: бытовые жалобы — это повод записи (слот
reason + сочувствие), не повод уводить в medical_question. Шаг present теперь
использует reason в формулировке. Промпт _router расширен живыми примерами
для всех 6 веток, особенно для reschedule («не смогу подойти», «перенесите»).
Надёжность внешнего LLM:
- ретрай в LLMClient с паузой 500 мс + новое исключение LLMUnavailableError;
- ретрай в RouterClient (DeepSeek периодически моргает);
- /chat при ошибке делает session.rollback() и возвращает 503 с понятным
сообщением — больше не остаётся «диалогов-призраков» с одной репликой;
- UI убирает свой пузырь и возвращает текст в поле ввода для повторной отправки.
UI «Настройки» — добавлена вкладка «Шаги» для веток с state machine: список
шагов chip-ами, редактор промпта/имени/allowed_next/guards, сохранение через
PATCH /intents/{code}/steps/{step_code} без версионирования. Иконка ⓘ возле
поля «Правила» открывает popover с пояснением, что туда писать.
UI «Песочница»:
- блок «Состояние диалога» показывает имя шага из intent_steps (а не сырое
число), для не-sm-веток пишется «без пошагового сценария»;
- подсветка illegal-переходов (валидатор отклонил state_after) и parse_error
для sm-веток;
- блок «Решение роутера» развёрнут в три исхода: «попал в ту же ветку» /
«удержались в ветке» / «ветка сама передала управление через INTENT_CHANGE»;
- секция «Найденные фрагменты» сворачивается, карточки чанков раскрываются
по клику — правый сайдбар стал компактнее.
Терминология (по договорённости — простой русский в UI):
- «тред» → «диалог» в текстах для оператора (в коде/API thread_id оставлен);
- «sticky state machine» → «удержались в ветке»;
- «state machine» → «пошаговый сценарий» в видимых местах.
SPRINTS.md: блок G в Спринте 6b сокращён — sticky-логика уже сделана здесь,
осталась только вторая линия (передача thread_state в системный промпт самого
роутера для ещё более точной первичной классификации).
Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
94 lines
3.0 KiB
Python
94 lines
3.0 KiB
Python
"""State machine треда: текущая ветка, шаг внутри ветки, собранные слоты.
|
|
|
|
Используется в chat_service для ведения многошаговых сценариев (Спринт 5).
|
|
Слоты — произвольный JSON-словарь, конкретные ключи определяются веткой.
|
|
"""
|
|
import json
|
|
import logging
|
|
from datetime import datetime, timezone
|
|
|
|
from sqlalchemy.ext.asyncio import AsyncSession
|
|
|
|
from db.models import ThreadState
|
|
|
|
logger = logging.getLogger(__name__)
|
|
|
|
|
|
async def get_state(session: AsyncSession, thread_id: int) -> ThreadState | None:
|
|
return await session.get(ThreadState, thread_id)
|
|
|
|
|
|
def _parse_slots(raw: str) -> dict:
|
|
if not raw:
|
|
return {}
|
|
try:
|
|
value = json.loads(raw)
|
|
except json.JSONDecodeError:
|
|
logger.warning("Bad slots_json for thread_state, resetting to {}")
|
|
return {}
|
|
return value if isinstance(value, dict) else {}
|
|
|
|
|
|
async def load_snapshot(session: AsyncSession, thread_id: int) -> dict:
|
|
"""Удобный снимок состояния для чтения (intent, step_code, step, slots)."""
|
|
state = await get_state(session, thread_id)
|
|
if state is None:
|
|
return {
|
|
"current_intent_code": None,
|
|
"current_step": 0,
|
|
"current_step_code": None,
|
|
"slots": {},
|
|
}
|
|
return {
|
|
"current_intent_code": state.current_intent_code,
|
|
"current_step": state.current_step,
|
|
"current_step_code": state.current_step_code,
|
|
"slots": _parse_slots(state.slots_json),
|
|
}
|
|
|
|
|
|
async def upsert(
|
|
session: AsyncSession,
|
|
thread_id: int,
|
|
*,
|
|
intent_code: str | None,
|
|
step: int,
|
|
slots: dict,
|
|
step_code: str | None = None,
|
|
) -> ThreadState:
|
|
"""Создать или обновить состояние треда. Коммит — на совести вызывающего."""
|
|
state = await get_state(session, thread_id)
|
|
now = datetime.now(timezone.utc)
|
|
slots_raw = json.dumps(slots or {}, ensure_ascii=False)
|
|
if state is None:
|
|
state = ThreadState(
|
|
thread_id=thread_id,
|
|
current_intent_code=intent_code,
|
|
current_step=step,
|
|
current_step_code=step_code,
|
|
slots_json=slots_raw,
|
|
updated_at=now,
|
|
)
|
|
session.add(state)
|
|
else:
|
|
state.current_intent_code = intent_code
|
|
state.current_step = step
|
|
state.current_step_code = step_code
|
|
state.slots_json = slots_raw
|
|
state.updated_at = now
|
|
return state
|
|
|
|
|
|
async def reset(
|
|
session: AsyncSession,
|
|
thread_id: int,
|
|
*,
|
|
new_intent_code: str | None,
|
|
new_step_code: str | None = None,
|
|
) -> ThreadState:
|
|
"""Сбросить шаг и слоты треда, выставить новую ветку (при смене intent)."""
|
|
return await upsert(
|
|
session, thread_id,
|
|
intent_code=new_intent_code, step=0, step_code=new_step_code, slots={},
|
|
)
|