Files
RAG_helper/routers/chat.py
T
AR 15 M4 231e1f2d01 feat(sprint6b): блок E — причина передачи оператору + саммари
- Роутер возвращает escalate_human|reason (acute_pain/surgery/angry/explicit_request/routing_loop)
- RouterClient парсит reason; дефолт explicit_request при неразобранном
- _format_state_context получает escalation_reason → подставляется в промпт escalate_human
- Промпт escalate_human переписан: разное поведение по reason
- _build_operator_summary: reason + 8 реплик истории + слоты, логируется при передаче
- Message.escalation_reason (String 50, nullable) + миграция h4b52e9dc0f83
- ChatResponse и MessageInfo получили escalation_reason и operator_summary
- Sandbox: красный блок «передача оператору · причина» в состоянии треда
- Sandbox: блок саммари для оператора (предпросмотр) в панели отладки

Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com>
2026-04-26 20:45:09 +05:00

82 lines
3.3 KiB
Python

import logging
from fastapi import APIRouter, Depends, HTTPException
from sqlalchemy.ext.asyncio import AsyncSession
from db.session import get_session
from models.requests import ChatRequest
from models.responses import (
BounceInfo,
ChatResponse,
SourceInfo,
ThreadStateInfo,
ValidationEventInfo,
)
from services import chat_service
from services.llm_client import LLMUnavailableError
logger = logging.getLogger(__name__)
router = APIRouter(prefix="/chat", tags=["chat"])
@router.post("", response_model=ChatResponse)
async def chat(req: ChatRequest, session: AsyncSession = Depends(get_session)):
from main import llm_client, router_client, vectorstore_service
if vectorstore_service is None or llm_client is None or router_client is None:
raise HTTPException(status_code=503, detail="Service not ready")
try:
result = await chat_service.send_message(
session=session,
vectorstore=vectorstore_service,
llm=llm_client,
router=router_client,
text=req.text,
thread_id=req.thread_id,
top_k=req.top_k,
temperature=req.temperature,
max_tokens=req.max_tokens,
)
except LookupError as e:
await session.rollback()
raise HTTPException(status_code=404, detail=str(e))
except LLMUnavailableError as e:
# Внешний LLM недоступен даже после ретрая — откатываем, чтобы не оставлять
# «тред-призрак» с одной пользовательской репликой и без ответа ассистента.
await session.rollback()
logger.warning("LLM unavailable: %s", e)
raise HTTPException(
status_code=503,
detail="Внешняя модель временно недоступна. Попробуйте ещё раз через минуту.",
)
except Exception as e:
await session.rollback()
logger.exception("Chat failed")
raise HTTPException(status_code=500, detail=f"Chat error [{type(e).__name__}]: {e}")
return ChatResponse(
thread_id=result["thread_id"],
thread_name=result["thread_name"],
message_id=result["message_id"],
intent_code=result["intent_code"],
intent_name=result["intent_name"],
router_intent_code=result.get("router_intent_code", ""),
config_version=result["config_version"],
router_version=result.get("router_version"),
answer=result["answer"],
sources=[SourceInfo(**s) for s in result["sources"]],
model_used=result["model_used"],
assembled_prompt=result["assembled_prompt"],
thread_state=ThreadStateInfo(**result["thread_state"]),
bounces=[BounceInfo(**b) for b in result.get("bounces", [])],
validation_events=[ValidationEventInfo(**v) for v in result.get("validation_events", [])],
parse_error=result.get("parse_error"),
routing_loop_triggered=result.get("routing_loop_triggered", False),
resumed_from_suspended=result.get("resumed_from_suspended", False),
message_meta=result.get("message_meta"),
escalation_reason=result.get("escalation_reason"),
operator_summary=result.get("operator_summary"),
)