Об этом проекте

Telugu Reader — это обучающий инструмент для носителей языка телугу, которые понимают язык, но испытывают трудности с чтением письменности телугу. Вместо перевода целых слов он сегментирует каждое слово на кластеры символов Unicode и предоставляет фонетическую транслитерацию на уровне символов на английском языке. Например, తెలుగు разбивается на తె → the, లు → lu и గు → gu. Проект включает два сопутствующих продукта, работающих на общем движке парсера TypeScript: обучающую веб-платформу Next.js с интерактивными упражнениями для чтения и расширение для браузера Manifest V3, которое добавляет всплывающие окна с транслитерацией при наведении на внешних сайтах на телугу, таких как новостные порталы и Wikipedia. Расширение включает всплывающую подсказку без смещения макета, определение слов на основе каретки, поддержку сенсорного ввода для мобильных устройств и букмарклет для мобильного Chrome, где расширения недоступны. Основная инженерная работа сосредоточена на правильной обработке композиции Unicode телугу, включая матры, вирамы и слитные согласные. Парсер реализован как независимая библиотека, которая сегментирует текст на кластеры произношения и сопоставляет их с фонетическим выводом на английском. Репозиторий также содержит тестовый маршрут-песочницу для оценки взаимодействий при наведении и точности транслитерации. Текущий статус показывает, что движок парсера и расширение для браузера завершены, в то время как основной веб-ридер и элементы управления обучением все еще находятся в разработке. Запланированные функции включают примеры статей, ввод пользовательского текста, элементы управления чтением, режим разбивки по словам, аудиопроизношение, добавление словарного запаса в закладки, а также будущие идеи, такие как OCR и геймифицированное обучение.