← Admin Panel

AI-модели

admin panel · макеты · ai

Провайдеры, каталог моделей и назначение по функциям. Весь расход AI — токены по людям и счёт по моделям — на экране Расходы AI.

Провайдеры

Подключения к источникам моделей — cloud-сервисы по API-ключу и локальные рантаймы по base URL. Платформенный эмбеддер присутствует всегда.

реестр провайдеров
achilles.local/admin/ai-models /admin/ai-models · Owner / Admin
Провайдеры
ПровайдерТипBase URLКлючСтатус
Platform 6 built-in http://embeddings:80 active ·
OpenAI cloud api.openai.com ••••a3f7 active 2 ·3
Anthropic cloud api.anthropic.com ••••91kd active ·
Ollama (on-prem) local 4 http://gpu-01:11434 active ·
vLLM (research) local http://vllm:8000 error 5 ·
Google cloud generativelanguage.googleapis.com ••••0b2e unchecked ·
  1. 1 Открывает модал добавления. После добавления каталог моделей провайдера (ниже) заполняется автоматически.
  2. 2 Статус последней проверки соединения. «Проверить» поднимает тост с вердиктом.
  3. 3 Меню провайдера: изменить · проверить · удалить. «Удалить» запрещён, пока какая-то его модель назначена функции или входит в чат (назначение по функциям).
  4. 4 API-ключ показывается лишь маской; у локальных провайдеров его обычно нет.
  5. 5 При ошибке провайдера его модели недоступны: затронутые функции ждут восстановления связи или переназначения Admin. Остальная платформа продолжает работать.
  6. 6 Platform (is_system) — встроенный эмбеддер платформы, из коробки и без внешнего провайдера. Удалить нельзя, ключа нет.
Каталог провайдера и активация

Модели выбранного провайдера: discovery наполняет каталог автоматически, остальное Admin добавляет вручную. Из каталога модель включается в платформу прямо в строке.

каталог провайдера · discovery
OpenAI
1
Model IDНазвание 3ТипИсточник
gpt-4o GPT-4o chat 4 discovered Выключить 5
text-embedding-3-large Embedding 3 Large embedding 3072-dim 6 discovered Выключить
gpt-4o-mini gpt-4o-mini chat discovered Включить
ft:custom-internal Internal FT chat manual Включить
  1. 1 Селектор провайдера — таблица под ним перерисовывается под его модели.
  2. 2 Открывает модал ручного ввода — для провайдеров без discovery и для fine-tuned / custom-моделей (источник «manual»).
  3. 3 Отображаемое имя модели в назначении и расходах. Карандаш правит его прямо в строке.
  4. 4 Тип (chat / embedding) решает, на какие функции модель можно назначить. Правится в строке; смена заблокирована, пока модель назначена функции или входит в чат.
  5. 5 «Включить» активирует модель, «Выключить» возвращает её в невключённые. Выключение запрещено, пока модель назначена функции или входит в чат — сначала переназначить.
  6. 6 Модель эмбеддинга несёт свою ширину вектора. Назначить можно только модель, чья ширина совпадает с базой знаний (назначение по функциям), поэтому она показана прямо в строке.
  7. 7 Размерность эмбеддингов — ширина вектора модели, вводится здесь, потому что discovery её не сообщает. Встроенные модели идут с уже заданной; поле появляется только для типа embedding.
Назначение моделей по функциям → Harvester → Knowledge Store → Query Engine

Каждая функция платформы потребляет модель. Системные (embedding) — по одной модели на функцию, назначает Admin. Чат и агенты — модель по умолчанию плюс список, из которого сотрудник или владелец агента выбирает сам.

функции платформы
Системные функции
ФункцияМодель
Embedding AI Cohere embed-v3 ▾
Cohere embed-v3 Cohere · 1024 · текущая bge-m3 Platform · 1024 Qwen3-Embedding-0.6B Platform · 1024 Embedding 3 Small OpenAI · 1536 · нужно 1024 Embedding 3 Large OpenAI · 3072 · нужно 1024 Nomic Embed Ollama · размерность не задана
1
назначено

Пользовательский чат AI Сотрудник сам выбирает модель в чате — из этого списка; по умолчанию открыта основная. 2
Claude Sonnet Anthropic по умолчанию

Агенты AI Владелец выбирает модель агента из этого списка; по умолчанию — основная. Модель должна уметь вызывать инструменты. 3
Claude Sonnet Anthropic по умолчанию
  1. 1 Embedding — одна модель на индексацию и поиск; назначение единое, иначе поиск сломается. Дефолта нет: платформенный вариант доступен из коробки, но приём ждёт явного выбора Admin (встроенный или свой). Назначение заранее прогревает рантайм — первый поиск не ждёт весов. База знаний хранит векторы фиксированной ширины — 1024 в v1 — поэтому выбрать можно только модель такой размерности; остальные остаются в списке, но недоступны, с причиной рядом. Облачная модель не сообщает свою размерность при discovery, поэтому её задают при добавлении модели в каталог. Смена назначенной — особый случай: новые векторы несовместимы со старыми, поэтому выбор открывает подтверждение с запуском сплошного переэмбеддинга. Пока прогон идёт, строка показывает его ход и повторная смена заблокирована (refresh).
  2. 2 Пользовательский чат — выбор у сотрудника: Admin собирает список разрешённых chat-моделей и помечает одну по умолчанию. Та же chat-модель ведёт диалог и сама решает, обращаться ли к базе знаний.
  3. 3 Агенты — отдельный список chat-моделей с одной по умолчанию; владелец выбирает модель агента из него. Снятая отсюда модель останавливает агентов, что её выбрали, до смены на другую. Agent Engine.