Версия 2.4.1#
29.06.2026 г.
Вышел новый релиз Sherpa AI Server: Версия 2.4.1.
1. Новые инструменты режима Агент#
В режиме Агент появились новые встроенные инструменты Sherpa AI Server.
.png)
Теперь Агент может работать с API Sherpa AI Server через выбранный API-токен, сохранять и искать данные в памяти пользователя. Также он может распознавать изображения из файлов Чата через OCR-сервер. При работе с API секрет токена не передается в языковую модель, а доступные методы фильтруются по правам выбранного токена.
Это помогает использовать режим Агент для более сложных задач: получать данные из Sherpa AI Server, обращаться к разрешенным методам API, запоминать полезную информацию и анализировать изображения.
2. Закрепление Ассистентов в меню#
На экране Ассистенты появилась возможность закреплять Ассистентов в боковом меню.
.png)
Закрепить можно до 5 Ассистентов на Аккаунт. Закрепленные Ассистенты отображаются в отдельном блоке бокового меню.
3. Индексация папок в Документах#
На экране Документы в диалоге создания и редактирования папки добавлено поле "Анализатор папок". В нем можно выбрать, как Sherpa AI Server будет обрабатывать файлы в папке: использовать базовый анализатор или не выполнять индексацию.
.png)
Также добавлен метод API для повторной индексации папки:
POST /api/v1/folders/{folder_guid}/reindex
Это помогает администраторам управлять тем, какие документы участвуют в поиске, и вручную запускать повторную индексацию при необходимости.
4. Скачивание файлов интерпретатора кода#
В режиме "Интерпретатор кода" улучшена работа с файлами, созданными во время выполнения Python-кода. В блоке "Файлы интерпретатора" теперь можно скачать файл по клику на его название или элемент файла.
.png)
Это помогает быстрее получить результат выполнения кода, например таблицу, текстовый файл или изображение, без дополнительных действий с сообщением.
5. Индикатор токенов контекста в Чате#
В Чате обновлен индикатор использования контекста.
.png)
Теперь он отображается в виде круга с процентом заполнения. При наведении открывается всплывающее окно со статусом, цветовой легендой и данными о занятых и свободных токенах.
Дополнительно расчет контекста стал точнее. Метод GET /api/v1/threads/{thread_guid}/context_usage теперь возвращает данные по системному промпту, инструментам, текущему контексту, резерву для ответа, общему лимиту, свободным токенам и признаку превышения лимита.
Это помогает пользователю понимать, насколько заполнен контекст, и заранее видеть, когда длинный Чат может приблизиться к лимиту модели.
6. Поддержка новых медиафайлов в Чате#
В Чате расширена транскрибация вложений через Whisper.
Теперь кроме аудиофайлов поддерживаются видеофайлы и другие медиафайлы с речью, например .mp4, .webm, .mov, .mkv и .avi.
Транскрипция сохраняется с таймкодами по сегментам и передается в контекст языковой модели как текст.
Это помогает задавать вопросы по записям встреч, интервью, видеофрагментам и другим материалам с речью.
7. Улучшения ответов Ассистента при работе с аудио- и видеофайлами#
Исправлена передача транскрипции аудио и видео в языковую модель при постепенном формировании ответа.
Теперь такие вложения не исключаются из контекста, а подсчет токенов учитывает системную инструкцию для аудио- и видеофрагментов.
Это делает ответы Ассистента по аудио- и видеофайлам точнее и стабильнее.
8. Резервное переключение между экземплярами модели#
Sherpa AI Server улучшил работу с экземплярами моделей.
Если при обращении к экземпляру модели возникает ошибка доступа 401 или 403, система может автоматически попробовать другой активный экземпляр той же модели.
История попыток сохраняется в запуске.
Это повышает стабильность работы Чата и режима Агент, если один из экземпляров модели временно недоступен или настроен некорректно.
9. Новый вид окна диалога с выбранным Ассистентом#
Теперь после выбора Ассистента Sherpa AI Server показывает начальный экран с именем Ассистента вместо стандартного окна начала диалога.
.png)
Также может отображаться описание, если оно заполнено.
Это помогает пользователю сразу понимать, с каким Ассистентом он начинает работу.
10. Увеличение набора быстрых подсказок#
На экране нового чата изменен набор подсказок для пользователя.
.png)
Теперь доступно до 20 вариантов. При каждом открытии нового диалога случайно показываются 5 из них.
Это помогает быстрее сформулировать первый запрос.
11. Улучшено отображение действий Агента#
На экране Чат обновлен процесс вызова инструментов в режиме Агент.
.png)
Когда Агент обращается к инструменту, например к MCP-серверу, API, памяти пользователя, поиску по документам или интерпретатору кода, Sherpa AI Server показывает это не как обычное сообщение в переписке, а как отдельную раскрывающуюся карточку.
В карточке видно название инструмента. Чтобы посмотреть подробности, нужно нажать на карточку или на стрелку раскрытия. После раскрытия отображаются технические детали вызова: какие данные были переданы инструменту и какой результат он вернул.
Если во время одного запуска Агент вызывает несколько инструментов подряд, эти действия объединяются в один компактный блок. Его тоже можно раскрыть и посмотреть отдельные вызовы и ответы инструментов.
Это помогает пользователю видеть, какие действия выполнял Агент, но не перегружает чат длинными техническими сообщениями.
12. Источники ответа в Чате #
В Чате улучшено отображение фрагментов документов, которые использовались при подготовке ответа Ассистента.
Источники вынесены в компактный блок под ответом. Они отображаются небольшими кнопками с названием файла, а полный текст фрагмента доступен во всплывающей подсказке.
Если источников много, часть из них скрывается под кнопкой "Еще N".
Это помогает видеть, на какие документы опирался Ассистент, не перегружая сообщение длинными списками.
13. Улучшение выбора файлов и папок на экране Чат#
Исправлено зависание индикатора загрузки в диалоге выбора папок из Документов.
Теперь после загрузки данных интерфейс обновляется сразу, без дополнительного клика по экрану. Также общий выбор файла в чате больше не открывается с аудиофильтром по умолчанию.
Это делает прикрепление файлов и папок в чате быстрее и стабильнее.
14. Улучшения на экране Ассистенты#
На экране Ассистенты исправлена проверка обязательной модели в диалоге создания и редактирования.
Также обновлена работа с файлами в диалоге создания и редактирования Ассистента. Теперь к Ассистенту можно привязать только те файлы, которые уже загружены в раздел Документы. Загрузка нового файла прямо из диалога Ассистента через старый маршрут больше не используется.
Это делает работу с файлами единообразной: сначала администратор загружает и настраивает документы в разделе Документы, а затем выбирает нужные файлы при настройке Ассистента. Так файлы проходят общий процесс хранения, проверки и индексации.
15. Улучшение отображения API-токенов#
На экране API в подразделе Ключ исправлен диалог редактирования API-токена.
Окно больше не растягивается на весь экран, а поля и кнопки корректно адаптируются к размеру диалога.
Это делает управление API-токенами удобнее для администраторов.
16. Улучшения на экране Модели#
На экране Модели исправлен тест подключения экземпляра модели.
Это помогает корректнее проверять подключение к провайдеру модели и уменьшает риск ошибок при настройке.
17. Исправления в папках объектов и загрузке файлов#
На экране Папки объектов исправлено редактирование корневой папки объектов.
Раньше при сохранении такого объекта значение родительской папки могло передаваться некорректно. Теперь Sherpa AI Server правильно определяет, что у корневой папки объектов родителя нет, и сохраняет это значение в корректном формате.
Также исправлена передача object_folder_id при загрузке файлов через API и интерфейс. Теперь это значение обрабатывается одинаково во всех местах, где файл связывается с папкой объектов.
Это помогает избежать ошибок при редактировании папок объектов и загрузке файлов, особенно если файлы загружаются в конкретную папку объектов или через интеграции.
18. Исправление удаления чата#
На экране Чат исправлено действие удаления чата.
Теперь при удалении чата из интерфейса Sherpa AI Server отправляет запрос в корректном формате, который соответствует требованиям API.
Это устраняет ошибку удаления и делает действие стабильнее для пользователя.
19. Улучшения интерфейса и цветов#
Исправлены отдельные проблемы с цветами интерфейса.
Текст на основных кнопках закреплен белым цветом, элементы Swagger UI и иконки подразделов API приведены к брендовому цвету Sherpa AI Server.
Это делает интерфейс визуально более единым и читаемым.
20. Настройки Whisper и окружения#
В конфигурации Sherpa AI Server упорядочены переменные Whisper.
Параметры вынесены в единый блок: URL сервиса Whisper, API-ключ, модель по умолчанию и настройки GPU для соответствующих окружений
Это упрощает настройку распознавания речи и делает поведение разных окружений более предсказуемым.
21. Обновленная работа сервиса распознавания речи#
Обновлена работа Whisper-сервиса, который используется для распознавания аудио и видео в Sherpa AI Server.
Теперь сервис принимает запросы на распознавание через стандартный метод:
POST /v1/audio/transcriptions
Он может возвращать результат в разных форматах: обычный текст, JSON, расширенный JSON, SRT и VTT для субтитров.Также при необходимости администратор может включить авторизацию по ключу через WHISPER_API_KEY.
Это упрощает настройку распознавания речи и делает подключение Whisper-сервиса более привычным для администраторов и интеграторов.
22. Ограничение времени выполнения запросов#
Для HTTP-запросов добавлено ограничение времени выполнения через переменную PHP_MAX_EXECUTION_TIME.
По умолчанию используется 1800 секунд. Для фонового обработчика используется отдельная переменная RUN_WORKER_MAX_EXECUTION_TIME.
Это помогает избежать бесконечно зависших HTTP-запросов и при этом отдельно управлять длительными фоновыми задачами.
23. Прочие улучшения#
Исправлены отдельные ошибки в модерации, проверках GitHub, брендировании, работе счетчиков контекста, отображении пустого экрана нового Чата и синхронизации статусов MCP серверов.
Также удалена неиспользуемая колонка orchestrator.threads.context_usage: разбивка контекста теперь рассчитывается при запросе через API.
Это снижает количество технических ошибок и делает работу интерфейса стабильнее.