3c2657ab99
Второй кусок Спринта 2: агент теперь помнит контекст. RAG-retrieval
делается по последней реплике пациента, в LLM уходит системный промпт +
последние 20 сообщений треда + новая реплика + найденные фрагменты.
Backend:
- services/chat_service: send_message — создаёт тред при необходимости
(auto-имя из первой реплики + UTC-дата), сохраняет user-реплику до
вызова LLM (чтобы не потерять при сбое), делает retrieval, грузит
историю треда (desc/limit 20 → reversed для хронологии), зовёт
llm.chat, сохраняет ответ ассистента вместе с sources_json и
assembled_prompt, обновляет thread.updated_at. Плюс list_threads с
JOIN-выборкой превью первой реплики и счётчика сообщений,
get_thread_detail через selectinload, rename_thread, delete_thread
(CASCADE на FK делает уборку сообщений автоматически, но
explicit delete оставлен для подсчёта удалённых).
- services/llm_client.chat: принимает history=[{role, content}, ...],
собирает messages = [system, ...history, user-с-RAG]; assembled_prompt
дампит всю цепочку в виде [SYSTEM]/[USER]/[ASSISTANT]-блоков для
отображения в Debug UI.
- routers/chat: POST /chat, обрабатывает LookupError → 404.
- routers/threads: GET /threads, GET /threads/{id}, PATCH /threads/{id}
(переименовать), DELETE /threads/{id}.
- models: ChatRequest, ThreadRenameRequest; ChatResponse, ThreadInfo,
ThreadListResponse, ThreadDetailResponse, MessageInfo,
ThreadDeleteResponse.
Запуск:
- В lifespan main.py: автоматический alembic upgrade head через
asyncio.to_thread (сам alembic делает asyncio.run внутри, его нельзя
звать из уже работающего event loop). LLMClient инициализируется
один раз при старте — вместо создания на каждый запрос.
E2E проверено: новый тред → агент отвечает и просит представиться;
вторая реплика в том же треде — агент помнит контекст; PATCH
переименовывает; DELETE удаляет тред с каскадом на сообщения.
Co-Authored-By: Claude Opus 4.7 (1M context) <noreply@anthropic.com>
74 lines
2.3 KiB
Python
74 lines
2.3 KiB
Python
import logging
|
|
|
|
from fastapi import APIRouter, Depends, HTTPException
|
|
from sqlalchemy.ext.asyncio import AsyncSession
|
|
|
|
from db.session import get_session
|
|
from models.requests import ThreadRenameRequest
|
|
from models.responses import (
|
|
MessageInfo,
|
|
SourceInfo,
|
|
ThreadDeleteResponse,
|
|
ThreadDetailResponse,
|
|
ThreadInfo,
|
|
ThreadListResponse,
|
|
)
|
|
from services import chat_service
|
|
|
|
logger = logging.getLogger(__name__)
|
|
|
|
router = APIRouter(prefix="/threads", tags=["threads"])
|
|
|
|
|
|
@router.get("", response_model=ThreadListResponse)
|
|
async def list_threads(session: AsyncSession = Depends(get_session)):
|
|
threads = await chat_service.list_threads(session)
|
|
return ThreadListResponse(
|
|
threads=[ThreadInfo(**t) for t in threads],
|
|
total=len(threads),
|
|
)
|
|
|
|
|
|
@router.get("/{thread_id}", response_model=ThreadDetailResponse)
|
|
async def get_thread(thread_id: int, session: AsyncSession = Depends(get_session)):
|
|
data = await chat_service.get_thread_detail(session, thread_id)
|
|
if data is None:
|
|
raise HTTPException(status_code=404, detail="Thread not found")
|
|
return ThreadDetailResponse(
|
|
id=data["id"],
|
|
name=data["name"],
|
|
created_at=data["created_at"],
|
|
updated_at=data["updated_at"],
|
|
messages=[
|
|
MessageInfo(
|
|
id=m["id"],
|
|
role=m["role"],
|
|
text=m["text"],
|
|
created_at=m["created_at"],
|
|
sources=[SourceInfo(**s) for s in m["sources"]],
|
|
assembled_prompt=m["assembled_prompt"],
|
|
)
|
|
for m in data["messages"]
|
|
],
|
|
)
|
|
|
|
|
|
@router.patch("/{thread_id}", response_model=ThreadInfo)
|
|
async def rename_thread(
|
|
thread_id: int,
|
|
req: ThreadRenameRequest,
|
|
session: AsyncSession = Depends(get_session),
|
|
):
|
|
data = await chat_service.rename_thread(session, thread_id, req.name)
|
|
if data is None:
|
|
raise HTTPException(status_code=404, detail="Thread not found")
|
|
return ThreadInfo(**data)
|
|
|
|
|
|
@router.delete("/{thread_id}", response_model=ThreadDeleteResponse)
|
|
async def delete_thread(thread_id: int, session: AsyncSession = Depends(get_session)):
|
|
deleted = await chat_service.delete_thread(session, thread_id)
|
|
if deleted is None:
|
|
raise HTTPException(status_code=404, detail="Thread not found")
|
|
return ThreadDeleteResponse(ok=True, deleted_messages=deleted)
|