Sobre o projeto
O Telugu Reader é uma ferramenta de aprendizado para falantes de Telugu que entendem o idioma, mas têm dificuldade em ler a escrita Telugu. Em vez de traduzir palavras inteiras, ele segmenta cada palavra em grupos de caracteres Unicode e fornece transliterações fonéticas no nível do caractere em inglês. Por exemplo, తెలుగు é dividido em తె → the, లు → lu e గు → gu.
O projeto possui dois produtos complementares alimentados por um mecanismo de análise TypeScript compartilhado: uma plataforma web de aprendizado Next.js com exercícios interativos de leitura e uma extensão de navegador Manifest V3 que adiciona pop-ups de transliteração ao passar o mouse em sites Telugu externos, como sites de notícias e Wikipedia. A extensão inclui uma dica flutuante sem deslocamento de layout, detecção de palavras baseada em cursor, suporte a toque móvel e um bookmarklet para Chrome móvel, onde extensões não estão disponíveis.
O trabalho central de engenharia foca em lidar corretamente com a composição Unicode do Telugu, incluindo matras, virama e consoantes conjuntas. O analisador é implementado como uma biblioteca independente que segmenta o texto em grupos de pronúncia e os mapeia para saída fonética em inglês. O repositório também inclui um playground de teste para avaliar interações de hover e precisão da transliteração.
O status atual mostra o mecanismo de análise e a extensão do navegador concluídos, com o leitor web principal e os controles de aprendizado ainda em andamento. Os recursos planejados incluem artigos de exemplo, entrada de texto personalizada, controles de leitura, modo de divisão de palavras, pronúncia em áudio, marcação de vocabulário e ideias futuras, como OCR e aprendizado gamificado.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.