Об этом проекте
# LLM Wiki
LLM Wiki — это кроссплатформенное десктопное приложение, которое автоматически преобразует ваши документы в организованную взаимосвязанную базу знаний. Вместо традиционного RAG (извлечение и ответ с нуля при каждом запросе) LLM инкрементально создаёт и поддерживает постоянную вики на основе ваших источников. Знания компилируются один раз и остаются актуальными, а не пересчитываются при каждом запросе.
Этот проект основан на [паттерне LLM Wiki Карпати](https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f) — методологии построения личных баз знаний с помощью LLM.
## Ключевые возможности
### Двухэтапная загрузка с цепочкой рассуждений
- Сначала LLM анализирует, затем создаёт вики-страницы с указанием источников и инкрементальным кэшем
- SHA256 инкрементальный кэш — неизменённые файлы автоматически пропускаются, экономя токены и время
- Неудачные задачи автоматически повторяются до 3 раз
- Генерация с учётом языка (английский или китайский)
### Мультимодальная загрузка изображений
- Извлечение встроенных изображений из PDF
- Генерация фактологических подписей с помощью vision-LLM
- Отображение изображений в результатах поиска с учётом изображений, с предпросмотром в лайтбоксе и переходом к источнику
### Разбор документов во множестве форматов
- PDF, документы Office, EPUB/MOBI, Org mode, изображения, медиа, веб-клипы и пакеты URL
- Встроенная, облачная или локальная обработка PDF через MinerU
- DOCX через docx-rs — заголовки, жирный/курсив, списки, таблицы → структурированный Markdown
- Веб-клипы через Readability.js + Turndown.js → чистый Markdown
### Гибкая настройка моделей
- Настройка моделей для каждого проекта
- Независимая маршрутизация чата и загрузки
- Управление пользовательскими провайдерами, заголовками и потоковым выводом
- Поддержка нескольких провайдеров: OpenAI, Anthropic, Google, Ollama, Custom
### Поиск на основе источников
- Режим «Только источники» для ответов исключительно на основе исходно импортированных материалов
- Граф знаний с 4 сигналами: модель релевантности с прямыми ссылками, перекрытием источников, Адамик-Адар и типовой близостью
- Обнаружение сообществ Лувена — автоматическое обнаружение кластеров знаний с оценкой связности
- Аналитика графа — неожиданные связи и пробелы в знаниях с глубоким исследованием в один клик
### Векторный семантический поиск (опционально)
- Поиск на основе эмбеддингов через LanceDB
- Поддерживает любые совместимые с OpenAI конечные точки
- Отключён по умолчанию; включается в настройках с отдельной конечной точкой, API-ключом и конфигурацией модели
- Бенчмарк: полнота поиска улучшилась с 58,2% до 71,4% при включённом векторном поиске
### Чат-агент на Rust
- Агентский рантайм с использованием инструментов и поиском по вики/источникам/графу/вебу
- Генерация файлов рабочей области, подтверждение shell-команд, отмена и потоковые события инструментов
- Навыки агента — сканирование и включение локальных папок `SKILL.md`, выбор навыков через `/skill`
- Сгенерированные результаты рабочей области отображаются в виде предпросмотра с быстрым доступом к папке
- Более безопасная модель выполнения — команды в рабочей области проекта выполняются без прерываний, а внешние shell-команды требуют явного подтверждения
### Глубокие исследования
- Веб-поиск через Tavily, SerpApi или SearXNG с полным извлечением содержимого
- Несколько поисковых запросов по теме, генерируемых LLM при загрузке
- Диалог подтверждения пользователя — редактируемая тема и поисковые запросы для просмотра
- Панель исследований с динамической высотой и потоковым прогрессом в реальном времени
### Управление проектами
- Экспорт и импорт полных архивов проектов между устройствами
- Пересоздание индекса вики из существующих страниц
- Импорт папок с сохранением структуры каталогов
- Удаление исходных файлов удаляет их вики-страницу с кратким содержанием
- Сопоставление тремя методами находит связанные вики-страницы
### Совместимость с Obsidian
- Каталог вики работает как хранилище Obsidian
- Автоматически создаваемая папка `.obsidian/` с рекомендуемыми настройками
### Дополнительные возможности
- Трёхколоночный макет: дерево знаний / дерево файлов (слева) + чат (центр) + предпросмотр (справа)
- Панель активности с состоянием обработки в реальном времени
- Шаблоны сценариев: Исследование, Чтение, Личностный рост, Бизнес, Общий
- Независимые чат-сессии с сохранением для каждого диалога
- Панель цитируемых источников со сворачиваемыми разделами
- Рендеринг Markdown с математикой KaTeX и диаграммами Mermaid
- Слайдер размера контекста от 4K до 1M токенов
- Расширение Chrome Web Clipper с офлайн-предпросмотром
- Локальный HTTP API + MCP-сервер + навык AI-агента
- i18n — интерфейс на английском и китайском
- GitHub Actions CI/CD для macOS, Windows, Linux
## Архитектура
Приложение использует бэкенд на Rust для чат-агента и векторного поиска, а также фронтенд на Tauri. Структура каталога вики следует дизайну Карпати и включает файлы purpose.md, schema.md, index.md, log.md и overview.md.
## Начало работы
1. Установите приложение для вашей платформы (macOS ARM/Intel, Windows .msi, Linux .deb/.AppImage)
2. Настройте вашего LLM-провайдера (OpenAI, Anthropic, Google, Ollama или пользовательский)
3. Импортируйте документы или папки
4. Дайте LLM автоматически построить вашу вики
5. Исследуйте граф знаний, общайтесь с вашими данными и проводите глубокие исследования
## Лицензия
Открытое программное обеспечение, лицензированное по лицензии MIT.
Comments
0 Rating appears after 10 ratings
Sign in to join the discussion.