Об этом проекте

# LLM Wiki LLM Wiki — это кроссплатформенное десктопное приложение, которое автоматически преобразует ваши документы в организованную взаимосвязанную базу знаний. Вместо традиционного RAG (извлечение и ответ с нуля при каждом запросе) LLM инкрементально создаёт и поддерживает постоянную вики на основе ваших источников. Знания компилируются один раз и остаются актуальными, а не пересчитываются при каждом запросе. Этот проект основан на [паттерне LLM Wiki Карпати](https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f) — методологии построения личных баз знаний с помощью LLM. ## Ключевые возможности ### Двухэтапная загрузка с цепочкой рассуждений - Сначала LLM анализирует, затем создаёт вики-страницы с указанием источников и инкрементальным кэшем - SHA256 инкрементальный кэш — неизменённые файлы автоматически пропускаются, экономя токены и время - Неудачные задачи автоматически повторяются до 3 раз - Генерация с учётом языка (английский или китайский) ### Мультимодальная загрузка изображений - Извлечение встроенных изображений из PDF - Генерация фактологических подписей с помощью vision-LLM - Отображение изображений в результатах поиска с учётом изображений, с предпросмотром в лайтбоксе и переходом к источнику ### Разбор документов во множестве форматов - PDF, документы Office, EPUB/MOBI, Org mode, изображения, медиа, веб-клипы и пакеты URL - Встроенная, облачная или локальная обработка PDF через MinerU - DOCX через docx-rs — заголовки, жирный/курсив, списки, таблицы → структурированный Markdown - Веб-клипы через Readability.js + Turndown.js → чистый Markdown ### Гибкая настройка моделей - Настройка моделей для каждого проекта - Независимая маршрутизация чата и загрузки - Управление пользовательскими провайдерами, заголовками и потоковым выводом - Поддержка нескольких провайдеров: OpenAI, Anthropic, Google, Ollama, Custom ### Поиск на основе источников - Режим «Только источники» для ответов исключительно на основе исходно импортированных материалов - Граф знаний с 4 сигналами: модель релевантности с прямыми ссылками, перекрытием источников, Адамик-Адар и типовой близостью - Обнаружение сообществ Лувена — автоматическое обнаружение кластеров знаний с оценкой связности - Аналитика графа — неожиданные связи и пробелы в знаниях с глубоким исследованием в один клик ### Векторный семантический поиск (опционально) - Поиск на основе эмбеддингов через LanceDB - Поддерживает любые совместимые с OpenAI конечные точки - Отключён по умолчанию; включается в настройках с отдельной конечной точкой, API-ключом и конфигурацией модели - Бенчмарк: полнота поиска улучшилась с 58,2% до 71,4% при включённом векторном поиске ### Чат-агент на Rust - Агентский рантайм с использованием инструментов и поиском по вики/источникам/графу/вебу - Генерация файлов рабочей области, подтверждение shell-команд, отмена и потоковые события инструментов - Навыки агента — сканирование и включение локальных папок `SKILL.md`, выбор навыков через `/skill` - Сгенерированные результаты рабочей области отображаются в виде предпросмотра с быстрым доступом к папке - Более безопасная модель выполнения — команды в рабочей области проекта выполняются без прерываний, а внешние shell-команды требуют явного подтверждения ### Глубокие исследования - Веб-поиск через Tavily, SerpApi или SearXNG с полным извлечением содержимого - Несколько поисковых запросов по теме, генерируемых LLM при загрузке - Диалог подтверждения пользователя — редактируемая тема и поисковые запросы для просмотра - Панель исследований с динамической высотой и потоковым прогрессом в реальном времени ### Управление проектами - Экспорт и импорт полных архивов проектов между устройствами - Пересоздание индекса вики из существующих страниц - Импорт папок с сохранением структуры каталогов - Удаление исходных файлов удаляет их вики-страницу с кратким содержанием - Сопоставление тремя методами находит связанные вики-страницы ### Совместимость с Obsidian - Каталог вики работает как хранилище Obsidian - Автоматически создаваемая папка `.obsidian/` с рекомендуемыми настройками ### Дополнительные возможности - Трёхколоночный макет: дерево знаний / дерево файлов (слева) + чат (центр) + предпросмотр (справа) - Панель активности с состоянием обработки в реальном времени - Шаблоны сценариев: Исследование, Чтение, Личностный рост, Бизнес, Общий - Независимые чат-сессии с сохранением для каждого диалога - Панель цитируемых источников со сворачиваемыми разделами - Рендеринг Markdown с математикой KaTeX и диаграммами Mermaid - Слайдер размера контекста от 4K до 1M токенов - Расширение Chrome Web Clipper с офлайн-предпросмотром - Локальный HTTP API + MCP-сервер + навык AI-агента - i18n — интерфейс на английском и китайском - GitHub Actions CI/CD для macOS, Windows, Linux ## Архитектура Приложение использует бэкенд на Rust для чат-агента и векторного поиска, а также фронтенд на Tauri. Структура каталога вики следует дизайну Карпати и включает файлы purpose.md, schema.md, index.md, log.md и overview.md. ## Начало работы 1. Установите приложение для вашей платформы (macOS ARM/Intel, Windows .msi, Linux .deb/.AppImage) 2. Настройте вашего LLM-провайдера (OpenAI, Anthropic, Google, Ollama или пользовательский) 3. Импортируйте документы или папки 4. Дайте LLM автоматически построить вашу вики 5. Исследуйте граф знаний, общайтесь с вашими данными и проводите глубокие исследования ## Лицензия Открытое программное обеспечение, лицензированное по лицензии MIT.