Versión 2.4.6#

Nuevo lanzamiento de Sherpa AI Server: Versión 2.4.6.

1. Adaptación de la interfaz para teléfonos móviles y tabletas#

La interfaz de Sherpa AI Server se ha adaptado para pantallas de teléfonos móviles y tabletas. El menú lateral ahora se abre como un panel deslizante, los diálogos, las notificaciones y la pantalla Chat se ajustan al espacio disponible, y las filas de las tablas se pueden ver como tarjetas compactas con las propiedades principales y los datos adicionales desplegables.

En las pantallas con tablas se añadió un conmutador entre vista de tarjetas y vista de tabla, además de un menú compacto de acciones. Las pantallas Modelos y Moderación también cuentan ahora con una disposición móvil dedicada. Se mejoraron los tamaños de los controles, las áreas táctiles, el espaciado de los mensajes, los campos de entrada, el comportamiento del menú y las tarjetas de asistentes.

Esto hace que las funciones principales de Sherpa AI Server resulten más cómodas en dispositivos móviles sin cambiar la vista habitual en escritorio.

2. Chats compartidos y privados#

En la pantalla Chat ahora hay chats compartidos y privados. El creador del chat puede cambiar su disponibilidad y publicar un enlace del tipo /shared/thread/{guid}. Al abrirse mediante el enlace público, el chat queda en modo de solo lectura, incluso sin autenticación, y no se indexa por los motores de búsqueda.

Para los usuarios autenticados se mantiene la lista habitual de chats y los elementos fijados. Después de sincronizar los permisos, los chats compartidos y los asistentes se cargan correctamente en el menú lateral, y al iniciar sesión con una cuenta se muestran todos los chats relacionados con ella, incluidos los privados.

Esto ayuda a separar de forma segura el trabajo personal y los materiales para consulta colaborativa.

3. Gestión de acceso más clara#

En la pantalla Roles se actualizó el diálogo de creación y edición de roles. En la pestaña Acceso, junto a la tabla “Accesos / Permisos” se muestra una tabla adaptativa de dependencias y una lista independiente de “Carpetas de menú”. Estas muestran qué permisos de lectura son necesarios para las secciones del menú y a qué secciones no tiene acceso el rol.

Los elementos no disponibles del menú lateral se muestran en gris.

Después de modificar o eliminar un rol, los permisos y el menú se actualizan sin recargar la página, y la navegación a una página no disponible redirige correctamente al usuario. Para las pantallas Documentos y Modelos también se tiene en cuenta el acceso a las Carpetas de objetos.

Esto simplifica la configuración de roles y ayuda al administrador a ver con antelación la dependencia de las secciones del menú respecto de los permisos asignados.

4. Búsqueda y reranking de documentos más estables#

Se mejoró el funcionamiento del reranking de BGE: la cantidad de candidatos y el tamaño del lote de consultas se limitan mediante la configuración, los documentos largos se evalúan en varios fragmentos superpuestos, los fragmentos vacíos no se envían para su procesamiento y, después de descartar los archivos no disponibles, el sistema completa la cantidad necesaria de resultados.

Si BGE no está disponible, en la pantalla Chat se muestra una advertencia y se aplica el orden de búsqueda estándar. La activación del reranking para un asistente ahora también se aplica a los chats creados anteriormente.

Las respuestas de POST /api/v1/files/search y POST /api/v1/files/searchbm25 se complementan con los campos rerank_applied, rerank_skip_reason, vector_distance, bm25_score, rerank_score y rerank_score_normalized. El campo score se conserva por compatibilidad hacia atrás.

Esto hace que la búsqueda de documentos sea más robusta, especialmente al trabajar con archivos largos, y ayuda a administradores e integraciones a entender cómo se formó el orden de los resultados.

5. Mejoras de la API para integraciones externas#

Se corrigió el modo de respuesta externa del Asistente. La ejecución permanece en estado WAITING sin llamar al modelo de lenguaje interno y el cliente externo de la API finaliza con el estado CHAT_COMPLETED.

En la descripción OpenAPI de la respuesta de búsqueda de archivos se añadió el campo text_chunk, que es el que realmente se devuelve. La separación entre chats compartidos y privados se realiza por usuario, y los parámetros de filtrado y de cambio de disponibilidad se ajustaron al contrato actual de la API.

Esto simplifica la conexión de sistemas externos y reduce el riesgo de errores debidos a discrepancias entre el comportamiento de la API y su documentación.

6. Correcciones de autenticación y moderación#

En la página de inicio de sesión, los errores del servidor ahora se muestran como una notificación estándar en lugar de una respuesta HTML debajo de los campos de entrada. Las páginas protegidas ya no muestran su contenido antes de que la sesión se verifique correctamente, y la falta de permiso para una sección se gestiona correctamente antes de su visualización.

La comprobación de activadores de diccionario para la moderación ahora no distingue mayúsculas y minúsculas en UTF-8, incluido el cirílico, tanto al probar las reglas como durante el procesamiento de mensajes.

Esto hace que los mensajes de error sean más claros, evita la exposición breve de contenido no disponible y mejora la precisión de las reglas de moderación.

7. Nuevas configuraciones para administradores#

Se agregó el parámetro favicon_url en branding.json, con el que se puede reemplazar el icono de la pestaña del navegador. Para el servidor LLM de GPU, la variable LLM_EXTRA_ARGS permite pasar argumentos adicionales de vLLM después de los parámetros principales de arranque.

La configuración de los servicios de Docker Compose ahora se carga desde .env sin duplicar la mayoría de las variables en environment. Estos cambios no añaden nuevas pantallas en la interfaz.

Esto simplifica el branding, la configuración de vLLM y el mantenimiento de la configuración del entorno.