Versão 2.4.6#

Novo lançamento do Sherpa AI Server: Versão 2.4.6.

1. Adaptação da interface para smartphones e tablets#

A interface do Sherpa AI Server foi adaptada para telas de smartphones e tablets. O menu lateral agora se abre como um painel deslizante, os diálogos, as notificações e a tela Chat se ajustam ao espaço disponível, e as linhas da tabela podem ser visualizadas como cartões compactos com as propriedades principais e os dados adicionais expansíveis.

Nas telas com tabelas, foram adicionados um alternador entre cartões e tabela e um menu compacto de ações. As telas Modelos e Moderação também contam agora com um layout móvel dedicado. Foram melhorados os tamanhos dos controles, as áreas de toque, o espaçamento das mensagens, os campos de entrada, o comportamento do menu e os cartões dos assistentes.

Isso torna os principais recursos do Sherpa AI Server mais convenientes em dispositivos móveis sem alterar a exibição habitual no desktop.

2. Chats compartilhados e privados#

Na tela Chat, agora há chats compartilhados e privados. O criador do chat pode alterar sua disponibilidade e publicar um link no formato /shared/thread/{guid}. Ao ser aberto pelo link público, o chat fica somente leitura, inclusive sem autenticação, e não é indexado pelos mecanismos de busca.

Para usuários autenticados, a lista normal de chats e os itens fixados continuam disponíveis. Após a sincronização das permissões, os chats compartilhados e os assistentes são carregados corretamente no menu lateral, e, ao entrar com uma conta, todos os chats relacionados a ela são exibidos, inclusive os privados.

Isso ajuda a separar com segurança o trabalho pessoal e os materiais para visualização colaborativa.

3. Gestão de acesso mais transparente#

O diálogo de criação e edição de funções foi atualizado na tela Funções. Na aba Acesso, ao lado da tabela “Acessos / Permissões”, é exibida uma tabela adaptativa de dependências e uma lista separada de “Pastas do menu”. Elas mostram quais permissões de leitura são necessárias para as seções do menu e a quais seções a função não tem acesso.

Os itens indisponíveis do menu lateral são exibidos em cinza.

Depois que uma função é alterada ou removida, as permissões e o menu são atualizados sem recarregar a página, e a navegação para uma página indisponível redireciona o usuário corretamente. Para as telas Documentos e Modelos, o acesso às Pastas de objetos também é levado em conta.

Isso simplifica a configuração de funções e ajuda o administrador a ver com antecedência a dependência das seções do menu em relação às permissões atribuídas.

4. Busca e reranking de documentos mais estáveis#

O funcionamento do reranking BGE foi aprimorado: a quantidade de candidatos e o tamanho do lote de consultas são limitados pelas configurações, documentos longos são avaliados em vários fragmentos sobrepostos, fragmentos vazios não são enviados para processamento e, após a remoção dos arquivos indisponíveis, o sistema completa a quantidade necessária de resultados.

Se o BGE não estiver disponível, um aviso é exibido na tela Chat e a ordem padrão de busca é aplicada. A ativação do reranking para um assistente agora também vale para chats criados anteriormente.

As respostas dos métodos POST /api/v1/files/search e POST /api/v1/files/searchbm25 agora incluem os campos rerank_applied, rerank_skip_reason, vector_distance, bm25_score, rerank_score e rerank_score_normalized. O campo score foi preservado por compatibilidade retroativa.

Isso torna a busca por documentos mais robusta, especialmente ao trabalhar com arquivos longos, e ajuda administradores e integrações a entender como a ordem dos resultados foi formada.

5. Melhorias na API para integrações externas#

O modo de resposta externa do Assistente foi corrigido. A execução permanece no status WAITING, sem chamar o modelo de linguagem interno, e é concluída pelo cliente externo da API com o status CHAT_COMPLETED.

Na descrição OpenAPI da resposta de busca de arquivos foi adicionado o campo text_chunk, que é o valor realmente retornado. A separação entre chats compartilhados e privados é feita por usuário, e os parâmetros de filtragem e de alteração de disponibilidade foram ajustados ao contrato atual da API.

Isso simplifica a integração de sistemas externos e reduz o risco de erros causados por divergências entre o comportamento da API e sua documentação.

6. Correções de autenticação e moderação#

Na página de login, os erros do servidor agora são exibidos como uma notificação padrão em vez de uma resposta HTML abaixo dos campos de entrada. As páginas protegidas não exibem mais seu conteúdo antes da verificação bem-sucedida da sessão, e a ausência de permissão para uma seção é tratada corretamente antes de sua exibição.

A verificação de gatilhos de dicionário para moderação agora não diferencia maiúsculas e minúsculas em UTF-8, inclusive cirílico, tanto no teste das regras quanto durante o processamento das mensagens.

Isso torna as mensagens de erro mais claras, evita a exposição breve de conteúdo indisponível e melhora a precisão das regras de moderação.

7. Novas configurações para administradores#

O parâmetro favicon_url foi adicionado ao branding.json, permitindo substituir o ícone da aba do navegador. Para o servidor LLM em GPU, a variável LLM_EXTRA_ARGS permite passar argumentos adicionais do vLLM após os parâmetros principais de inicialização.

A configuração dos serviços do Docker Compose agora é carregada do .env sem duplicar a maior parte das variáveis em environment. Essas mudanças não adicionam novas telas à interface.

Isso simplifica o branding, a configuração do vLLM e a manutenção da configuração do ambiente.