Sobre o projeto
Qingran é uma ferramenta de chat por voz, projetada principalmente em torno dos cenários de interação da Rosie. Ela oferece dois modos de entrada de voz: pressionar para falar e viva-voz, e suporta a leitura de respostas pela Eve. O projeto inclui funcionalidade de memória de longo prazo, com os dados de memória armazenados no banco de dados Neon do próprio usuário, sem depender do repositório do GitHub. Os usuários podem editar o system prompt nas configurações para ajustar o comportamento do assistente.
O projeto oferece execução local, iniciando com npm install e npm run dev, escutando por padrão em 0.0.0.0:8080. Na implantação online, APP_PASSWORD é usado como senha global do site, e a autenticação de sessão é feita por meio de cookie HMAC (qr_session); no ambiente de desenvolvimento local, essa camada de autenticação não é habilitada. As configurações incluem exportação e importação de backup, facilitando a migração dos dados de memória ao trocar de domínio.
O mecanismo de audição pode ser configurado nas definições. Quando o modo de anotação está ativado, cada frase de voz é salva como um clip, e a página de anotação fica em /lab. O projeto usa a interface de fala para texto da xAI, especificando explicitamente model=grok-voice-transcribe-2.0, e configura palavras-chave fixas, filler_words e um vad_threshold ajustável. O README observa que o STT da xAI não suporta oficialmente chinês, portanto a lista de idiomas não inclui zh.
O projeto também oferece uma solução de auto-hospedagem com GPU, com instruções em deploy/README.md. O script de avaliação scripts/eval-hearing.mjs pode ser usado para gerar resultados de avaliação em CSV a partir dos dados de audição exportados, de acordo com o conjunto de teste.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.