← К схеме

Query Engine

диалог · RAG по запросу · grounding

Оркестратор пользовательского диалога — не только RAG. Ход ведёт chat-модель, выбранная пользователем; у неё в руках инструмент search_knowledge (когда база непуста), и она решает на каждом сообщении, обращаться ли к базе. Разговор — отвечает из себя; вопрос к знаниям — зовёт поиск и строит ответ на найденном, со стримингом и цитированием. Сам retrieval (поиск и ACL pre-filter) принадлежит Knowledge Store; Query Engine его не делает — вызывает инструментом.

Архитектура

Четыре столпа модуля

01
⟨ ⟩

Диалог

Query Engine — оркестратор беседы, а не только RAG. Держит состояние; surface'ы — тонкие клиенты.

conversations messages retrieval_trace access_counter
02

Модель решает

Ход ведёт chat-модель AI — один инструмент в руках.

search_knowledge
Разговор — отвечает из себя, без цитат
К знаниям — зовёт search_knowledge
03
▸▸▸

RAG-маршрут

Один вызов — пять шагов. Граница владения проходит по ленте.

точный кэш? → мимо ленты
Embed Retrieve Rerank Augment Generate
KS·2 QE·3
04

Grounding

Контракт ответа — три обещания.

Только из найденного — не из памяти модели
Цитата на запись — каждое утверждение
Честное «не нашёл» вместо догадки
один опциональный вызов без петли Agent Engine минует Query Engine ответ: answer + citations, стриминг
API

Workzone Проектирование

Детальные решения по проектированию модуля.


Макеты Surface'ы

Своего фронтенда у модуля нет — диалог и ответ рендерят surface'ы как тонкие клиенты единого API. Экраны чата (ответ с заземлением, состояния ответа) живут в Web App; сам контракт заземления — в workzone, Grounding.