For the complete documentation index, see llms.txt. This page is also available as Markdown.

Changelog

[3.4.0]

  • Adiciona-se FacephiActivationLoad para gerenciar e ativar a licença.

[3.3.0]

  • São adicionadas funções para melhorar o carregamento da licença a partir dos metadados de cryptlex.

  • O processo de registro da licença durante a inicialização do Docker é aprimorado.

[3.2.1]

  • Pequenas melhorias na licença.

[3.2.0]

  • Novo endpoint GET /api/v1/config para obter a configuração atual do serviço.

  • Novo endpoint POST /api/v1/config para atualizar a configuração do serviço sem reiniciá-lo.

[3.0.1]

  • Corrige-se um problema de licença para garantir a conformidade normativa e o funcionamento correto do Voice Service.

[3.0.0]

  • É introduzido o novo algoritmo de verificação, que oferece desempenho melhor em relação às versões anteriores. O algoritmo anterior continua disponível por motivos de compatibilidade.

  • A precisão do algoritmo de detecção de vida contra clonagem de voz (voice clone liveness) é aprimorada.

  • A precisão do algoritmo de detecção de vida contra ataques de repetição (presentation/replay attack) é aprimorada.

  • Corrige-se o erro TOO_NOISY que era reportado pelo SNR Computer em arquivos com silêncios prolongados.

  • O backend do OpenVINO é atualizado da versão 2023.0 para a 2024.4.

[2.9.0]

  • A versão da imagem Docker é atualizada para Ubuntu 24.04.

  • O número de threads na configuração do serviço é 1 por padrão.

  • Adiciona-se um novo algoritmo de verificação com maior precisão.

  • A precisão dos algoritmos de verificação e detecção de vida em cenários com ruído é aprimorada. A pontuação de verificação pode diferir ligeiramente em relação à versão anterior, mas os templates de voz continuam compatíveis.

  • O limite recomendado para a verificação de qualidade do comprimento relativo da fala, nos casos de uso de verificação e detecção de vida, agora é 0 (é permitido qualquer comprimento relativo da fala).

  • O algoritmo de estimativa de SNR é atualizado. Os valores estimados podem diferir dos da versão anterior do produto, mas a precisão geral do algoritmo permanece igual.

[2.8.0]

  • Nova propriedade check_quality nos endpoints de enrollment e autenticação para habilitar ou desabilitar a verificação de qualidade.

  • Nova propriedade check_liveness no endpoint de autenticação para habilitar ou desabilitar a verificação de vida (liveness).

[2.7.2]

  • Melhorias na verificação de saúde (health check) do serviço.

  • Melhorias na gestão de licenças.

[2.7.1]

  • Melhorias de concorrência na decodificação base64.

  • Algumas pequenas melhorias no código.

[2.7.0]

  • Algumas refatorações e melhorias de desempenho.

  • Melhorias de concorrência.

  • Melhorias na verificação de saúde (health check) do serviço.

  • Novas verificações sobre a disponibilidade da licença.

[2.6.0]

  • Novos parâmetros de Quality Check:

    • minimum_speech_relative_length: comprimento mínimo exigido da fala em relação à duração total do áudio.

    • maximum_multiple_speakers_detector_score: número máximo de falantes simultâneos.

  • Novos campos de resposta com os valores detectados pelo Quality Check:

    • snr_db_detected: relação sinal-ruído (Signal-to-Noise Ratio) detectada.

    • speech_length_ms_detected: comprimento da fala detectado.

    • speech_relative_length_detected: comprimento relativo da fala detectado.

    • multiple_speakers_score_detected: pontuação de múltiplos falantes detectada.

[2.5.0]

  • Suporte para novos formatos de áudio: AAC, PCM ulaw e mulaw, WMA, MP4, FLAC, ALAC e AIFF.

  • Suporte para áudios com uma frequência de amostragem inferior a 16 kHz.

  • Eventos de Tracking são integrados para Authentication.

[2.4.0]

  • É atualizado voice-sdk para a v2.4.0.

  • Multithreading no processo de enrollment.

  • As exceções de baixo nível são expostas ao usuário.

[2.3.1]

  • É atualizado voice-sdk para a v2.3.1.

  • As mensagens de exceção e erro são melhoradas.

[2.3.0]

  • É atualizado voice-sdk para a v2.3.0.

  • É atualizado facephi-rest-manager para a v2.4.2.

  • Adiciona-se suporte para o formato de áudio AAC.

  • Novo parâmetro de configuração client_max_body_size para limitar o tamanho máximo do corpo da requisição.

[2.2.3]

  • É atualizado voice-sdk para a v2.2.3.

  • Adiciona-se o campo operation_result ao resultado de Authentication e Enrollment.

  • Adiciona-se o campo liveness_score ao resultado de Authentication e Enrollment.

  • Adiciona-se o campo matching_score ao resultado de Enrollment.

  • Adiciona-se o campo template_type ao resultado de Enrollment.

  • O campo é renomeado probability do resultado de Authentication para matching_score.

  • O campo é corrigido template no resultado de Enrollment. O campo template ficará vazio se a resposta não for válida.

  • O campo é corrigido template quando vários áudios eram enviados para Enrollment, mas o número mínimo de áudios necessário para gerar um padrão text-independent não era alcançado.

[2.2.2]

  • É atualizado voice-sdk para a v2.2.2.

  • É atualizado facephi-rest-manager para a v2.4.0.

[2.2.0]

  • Adiciona-se suporte para voice-sdk v2.2.0.

  • Os endpoints aceitam áudios criptografados e não criptografados.

  • A verificação de qualidade pode ser modulada na requisição, com os novos parâmetros minimum_snr_db e minimum_speech_duration_ms.

[2.1.0]

  • facephi-rest-manager é atualizado para a versão 2.1.3.

[2.0.0]

  • Adiciona-se suporte para voice-sdk v2.0.0, com áudios e templates criptografados.

  • Refatoração da implementação da API Rest.

  • Novo formato de mensagem para os erros de Bad Request e Internal Server Error.

[1.3.1]

  • O código de status HTTP é incluído na resposta JSON de erro.

  • Todos os endpoints passam a ficar em minúsculas.

  • A gestão e as mensagens de exceções são aprimoradas.

  • Adicionam-se exceções para os erros de voice-sdk.

  • Novo endpoint api/v1/version.

  • Novo endpoint api/v1/health.

[1.3.0]

  • Novo sistema de licenças.

Atualizado