9eef2dab3a
Заменили строковый тег [STATE: ...] из Спринта 5 на структурированный выход
ветки в виде JSON-блока в хвосте ответа: {state_after, slots_updated}, парсимый
балансировкой скобок. Шаги state machine вынесены из монолитного промпта в
таблицу intent_steps (intent_id FK, code, name, order_index, system_prompt,
allowed_next JSON, guards JSON) и редактируются через UI. Валидатор переходов
сверяет state_after с allowed_next и блокирует невалидные прыжки.
Базовый промпт new_booking разбит на base + 6 файлов шагов (intro/qualify/
present/offer_time/book/close), которые сидятся при старте через
ensure_seed_steps. В chat_service промпт собирается как base + step + блок
[ТЕКУЩЕЕ СОСТОЯНИЕ].
Попутно реализован мини-блок G (sticky state machine): когда диалог идёт по
sm-ветке и роутер на новой реплике предлагает другую — state НЕ сбрасывается,
в системный промпт ветки подаётся блок [ПОДСКАЗКА РОУТЕРА], LLM сама решает
(STATE_JSON или INTENT_CHANGE). Это сняло ключевую дыру Спринта 5: «Меня
зовут Алексей» / «болит ухо» внутри записи больше не сбрасывают сценарий.
Промпт ветки new_booking ужесточён: бытовые жалобы — это повод записи (слот
reason + сочувствие), не повод уводить в medical_question. Шаг present теперь
использует reason в формулировке. Промпт _router расширен живыми примерами
для всех 6 веток, особенно для reschedule («не смогу подойти», «перенесите»).
Надёжность внешнего LLM:
- ретрай в LLMClient с паузой 500 мс + новое исключение LLMUnavailableError;
- ретрай в RouterClient (DeepSeek периодически моргает);
- /chat при ошибке делает session.rollback() и возвращает 503 с понятным
сообщением — больше не остаётся «диалогов-призраков» с одной репликой;
- UI убирает свой пузырь и возвращает текст в поле ввода для повторной отправки.
UI «Настройки» — добавлена вкладка «Шаги» для веток с state machine: список
шагов chip-ами, редактор промпта/имени/allowed_next/guards, сохранение через
PATCH /intents/{code}/steps/{step_code} без версионирования. Иконка ⓘ возле
поля «Правила» открывает popover с пояснением, что туда писать.
UI «Песочница»:
- блок «Состояние диалога» показывает имя шага из intent_steps (а не сырое
число), для не-sm-веток пишется «без пошагового сценария»;
- подсветка illegal-переходов (валидатор отклонил state_after) и parse_error
для sm-веток;
- блок «Решение роутера» развёрнут в три исхода: «попал в ту же ветку» /
«удержались в ветке» / «ветка сама передала управление через INTENT_CHANGE»;
- секция «Найденные фрагменты» сворачивается, карточки чанков раскрываются
по клику — правый сайдбар стал компактнее.
Терминология (по договорённости — простой русский в UI):
- «тред» → «диалог» в текстах для оператора (в коде/API thread_id оставлен);
- «sticky state machine» → «удержались в ветке»;
- «state machine» → «пошаговый сценарий» в видимых местах.
SPRINTS.md: блок G в Спринте 6b сокращён — sticky-логика уже сделана здесь,
осталась только вторая линия (передача thread_state в системный промпт самого
роутера для ещё более точной первичной классификации).
Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
77 lines
3.0 KiB
Python
77 lines
3.0 KiB
Python
import logging
|
|
|
|
from fastapi import APIRouter, Depends, HTTPException
|
|
from sqlalchemy.ext.asyncio import AsyncSession
|
|
|
|
from db.session import get_session
|
|
from models.requests import ChatRequest
|
|
from models.responses import (
|
|
BounceInfo,
|
|
ChatResponse,
|
|
SourceInfo,
|
|
ThreadStateInfo,
|
|
ValidationEventInfo,
|
|
)
|
|
from services import chat_service
|
|
from services.llm_client import LLMUnavailableError
|
|
|
|
logger = logging.getLogger(__name__)
|
|
|
|
router = APIRouter(prefix="/chat", tags=["chat"])
|
|
|
|
|
|
@router.post("", response_model=ChatResponse)
|
|
async def chat(req: ChatRequest, session: AsyncSession = Depends(get_session)):
|
|
from main import llm_client, router_client, vectorstore_service
|
|
|
|
if vectorstore_service is None or llm_client is None or router_client is None:
|
|
raise HTTPException(status_code=503, detail="Service not ready")
|
|
|
|
try:
|
|
result = await chat_service.send_message(
|
|
session=session,
|
|
vectorstore=vectorstore_service,
|
|
llm=llm_client,
|
|
router=router_client,
|
|
text=req.text,
|
|
thread_id=req.thread_id,
|
|
top_k=req.top_k,
|
|
temperature=req.temperature,
|
|
max_tokens=req.max_tokens,
|
|
)
|
|
except LookupError as e:
|
|
await session.rollback()
|
|
raise HTTPException(status_code=404, detail=str(e))
|
|
except LLMUnavailableError as e:
|
|
# Внешний LLM недоступен даже после ретрая — откатываем, чтобы не оставлять
|
|
# «тред-призрак» с одной пользовательской репликой и без ответа ассистента.
|
|
await session.rollback()
|
|
logger.warning("LLM unavailable: %s", e)
|
|
raise HTTPException(
|
|
status_code=503,
|
|
detail="Внешняя модель временно недоступна. Попробуйте ещё раз через минуту.",
|
|
)
|
|
except Exception as e:
|
|
await session.rollback()
|
|
logger.exception("Chat failed")
|
|
raise HTTPException(status_code=500, detail=f"Chat error [{type(e).__name__}]: {e}")
|
|
|
|
return ChatResponse(
|
|
thread_id=result["thread_id"],
|
|
thread_name=result["thread_name"],
|
|
message_id=result["message_id"],
|
|
intent_code=result["intent_code"],
|
|
intent_name=result["intent_name"],
|
|
router_intent_code=result.get("router_intent_code", ""),
|
|
config_version=result["config_version"],
|
|
router_version=result.get("router_version"),
|
|
answer=result["answer"],
|
|
sources=[SourceInfo(**s) for s in result["sources"]],
|
|
model_used=result["model_used"],
|
|
assembled_prompt=result["assembled_prompt"],
|
|
thread_state=ThreadStateInfo(**result["thread_state"]),
|
|
bounces=[BounceInfo(**b) for b in result.get("bounces", [])],
|
|
validation_events=[ValidationEventInfo(**v) for v in result.get("validation_events", [])],
|
|
parse_error=result.get("parse_error"),
|
|
)
|