Версия 2.4.8#
Вышел новый релиз Sherpa AI Server: Версия 2.4.8.
1. Панель «Артефакты» в чате#
На экране Чат появилась правая панель «Артефакты». В ней отображаются файлы, созданные во время работы Ассистента, в том числе без отдельной ссылки на файл в тексте ответа. Панель обновляется после завершения запроса и дополнительно проверяет файлы, которые появились с задержкой.
На мобильных устройствах панель не занимает место в области переписки: её можно открыть через меню «Открыть артефакты» в шапке чата.
Это помогает сразу находить и скачивать результаты работы Ассистента, не просматривая весь диалог.
2. Обновлённый интерфейс экрана Чат#
На экране Чат переработана центральная область переписки: сообщения собраны в компактную центрированную ленту с ограниченной шириной текстовой колонки, улучшена читаемость Markdown, а обычные ответы Ассистента отображаются без отдельной карточки.
Для выделенного текста в сообщениях появилась плавающая панель с действиями Копировать и вставкой цитаты в поле ввода. Второстепенные действия сгруппированы в меню «+», заголовок текущего диалога показан в компактной панели чата, а удаление сообщения перенесено в дополнительное меню. Для сообщений текущего дня отображается только время без даты. Уменьшена максимальная высота поля ввода на компьютерах и мобильных устройствах с сохранением внутренней прокрутки.
Это упрощает чтение длинных ответов, работу с цитатами и делает поле ввода аккуратнее на компьютерах и мобильных устройствах.
3. Шапка чата и компактный блок ассистента#
На экране Чат название диалога возвращено в левую часть шапки, а компактный блок ассистента расположен справа рядом с кнопкой настроек. В блоке показаны файлы, MCP, пакеты и модель; при наведении доступны подсказки с подробными сведениями.
Подробные данные ассистента перенесены из шапки в компактную подсказку: она открывается по нажатию на имя ассистента или информационную кнопку и закрывается при нажатии вне блока. Исправлено перекрытие подсказки сообщениями, пустое место слева от названия чата и переполнение кнопки настроек на узких экранах.
В существующем чате добавлены смена и отвязка ассистента через модальное окно с плитками как на экране Ассистенты: поиск, иконка и цвет, модель, закреплённые сверху, счётчики файлов, папок, MCP и пакетов. Выбранный режим чата для текущего диалога сохраняется и восстанавливается после перехода между страницами.
Это помогает быстрее понять, с каким ассистентом идёт диалог, и безопасно переключать ассистента без потери контекста чата.
4. Живое обновление чата и внешний ответ ассистента#
На экране Чат исправлено живое обновление для ассистентов с ответом через API: при активном выполнении показывается индикатор ожидания, после завершения сообщения подгружаются без обновления страницы.
Пока внешний запрос находится в статусе ожидания или другом незавершённом состоянии, повторная отправка и смена ассистента блокируются так же, как при внутреннем выполнении. Для ассистента с внешним API-ответом больше не вызываются лишние методы запуска на сервере.
Это делает работу с интеграциями предсказуемее и снижает риск дублирования запросов.
5. Отправка длинного аудио и видео#
На экране Чат исправлена отправка сообщений с длинным аудио и видео: интерфейс дожидается расшифровки до 10 минут и восстанавливает выполнение при обрыве запроса или повторном открытии чата.
Это помогает завершать диалог с длинными медиавложениями без ручного обновления страницы.
6. Экран Пользователи#
На экране Пользователи в таблице добавлены колонки ролей и статуса активности пользователя.
Это упрощает администратору быструю оценку прав и состояния учётной записи без открытия карточки пользователя.
7. Экран Модели#
На экране Модели в диалоге создания и редактирования модели добавлены параметры генерации: пресет, temperature, top_p, top_k, min_p, presence_penalty, repetition_penalty и sampling_max_tokens. Поля сопровождаются подсказками на русском и английском языках.
Также добавлена настройка chat_template_kwargs для передачи дополнительных параметров шаблона чата во внешние OpenAI-совместимые экземпляры модели; значение можно задать в настройках модели или через переменную окружения LLM_CHAT_TEMPLATE_KWARGS.
Это упрощает тонкую настройку генерации и интеграцию с внешними провайдерами без правки серверной конфигурации для каждой модели.
8. Настройки ассистента и встраиваемый виджет#
В настройках ассистента на вкладке «Виджет» добавлен переключатель «Скрыть блоки "Думаю..." в виджете»: при включении панель размышлений скрывается для конечных пользователей виджета, при этом формирование ответа на сервере не меняется.
На экране редактирования ассистента поле системного промпта получило крупную рабочую ручку растяжения, удобную для длинных инструкций и на тёмной теме.
Исправлена настройка модератора: выбранный набор правил теперь корректно сохраняется, а значение «Без модерации» позволяет снять ранее назначенного модератора.
Это помогает администратору управлять тем, что видят пользователи виджета, комфортнее редактировать длинные промпты и без ошибок настраивать модерацию ответов.
9. Боковое меню и навигация#
В боковом меню обновлены иконки разделов «Ассистенты», «История чатов», «Роли», «Аккаунты» и «Модели», чтобы пункты различались в компактном режиме без подписей.
Логотип портала стал ссылкой на создание нового диалога. После входа, если не указан явный returnUrl, открывается новый чат вместо истории чатов. Подсказка выбора по Ctrl/Shift в боковом меню показывается только при наведении или фокусе внутри него.
В русской локализации «Имя помощника» заменено на «Имя ассистента» для единообразия терминов во всём интерфейсе.
Это упрощает навигацию и делает интерфейс понятнее как на компьютерах, так и на мобильных устройствах.
10. Уведомления#
Обновлён дизайн всплывающих уведомлений: компактные адаптивные карточки с современной типографикой, мягкой тенью, статусной полосой и всегда доступным закрытием по крестику. Одновременно показывается не более трёх сообщений; уведомления об ошибках используют нейтральную поверхность с красным акцентом, предупреждения — жёлтую палитру.
Это делает сообщения об ошибках и предупреждениях заметнее и аккуратнее визуально.
11. Привязка файлов к диалогам#
Исправлена работа с файлами в чате: метод POST /api/v1/threads/{thread_guid}/files с file_guids привязывает файл через таблицу thread_files без смены исходной папки. Один файл может участвовать в нескольких диалогах, база знаний ассистента не опустошается.
Файлы из file_guids в пользовательском сообщении автоматически связываются с диалогом, чтобы инструменты агента видели вложение. Очистка или удаление загрузки в папке диалога не удаляет файл с диска, если он ещё привязан к другим диалогам.
Это помогает безопасно делиться документами между чатами и не терять файлы из базы знаний ассистента.
12. Доступ к папкам объектов по ролям#
При авторизации под пользователем список папок объектов ограничивается объединением доступных папок по всем ролям пользователя. Авторизация под аккаунтом по-прежнему видит все папки аккаунта; объекты без папки остаются доступны.
Это повышает безопасность и соответствует назначенным правам ролей.
13. Улучшения агентных сценариев#
Исправлена ошибка, из-за которой агентные сценарии могли зацикливаться или не возвращать ответ при обязательном поле thread_guid в схеме инструментов: сервер по-прежнему подставляет GUID текущего диалога перед выполнением.
Обновлён режим выбора инструментов для моделей с рассуждениями. Если модель сообщает о вызове инструментов, но не возвращает распознанную команду, выполнение завершается с диагностической ошибкой. Добавлено уплотнение контекста агента: крупные результаты инструментов ограничиваются перед отправкой модели, а при переполнении контекста выполняется сжатие истории с кратким описанием прогресса.
Исправлено завершение запросов агента после вызовов MCP: ограничение крупных результатов применяется только в копии для модели, полная история сохраняется, а переполнение контекста показывается отдельно от общей ошибки.
Это повышает стабильность агентных сценариев и снижает риск таймаутов на длинных цепочках инструментов.
14. Интерпретатор кода#
Интерпретатор Python больше не выполняет код из служебных блоков рассуждения в ответе модели; незакрытый блок рассуждения также исключается из исполняемого ответа.
Это предотвращает случайный запуск служебного текста размышлений как Python-кода.
15. Улучшенная документация API#
В OpenAPI обновлены описания автоматической и ручной индексации при загрузке файлов, особого режима транскрибируемых медиа и всех значений статуса файла.
Уточнены описания создания диалогов, экземпляров моделей, загрузки файлов в папки с object_folder_guid, multipart-параметра force для интерпретатора и сценариев API-ключа против GUI-сессии.
Документация API доступна в Swagger: https://aiserver.sherparpa.ru/api/docs/swagger
Это упрощает интеграции и снижает число ошибок проверки данных при работе через Swagger или curl.
16. Надёжность API и безопасность#
Метод GET /api/v1/threads больше не возвращает ошибку 500, если поля info или metadata в базе данных хранятся в устаревшем строковом формате.
Закрыта возможность обновить или перепривязать выполнение к диалогу другого аккаунта через PUT- и PATCH-запросы. Тестовые маршруты API и их OpenAPI-описания доступны только при включённом режиме отладки приложения.
Исправлен запрос поиска файлов от блока Designer «Найти эмбеддинги»: устаревшие параметры преобразуются в формат API v1.
Это повышает стабильность обновления Sherpa AI Server и безопасность установок с несколькими аккаунтами.
17. Установка, обновление и GPU#
При GPU-установке и обновлении всегда активируется compose-профиль gpu, чтобы поднимался сервис локальной языковой модели, в том числе без Whisper и reranker.
Таймаут API Nginx во всех окружениях увеличен до 600 секунд, стандартный таймаут подключения к LLM также увеличен. Обновлён шаблон .env.main под официальный запуск Qwen3.6 в vLLM.
Новых экранов продукта для этих изменений нет: результат виден администратору в стабильности длинных запросов, корректной GPU-установке и обновлённых инструкциях по конфигурации окружения.