Первоисточники файловой LLM-wiki: Карпаты, OKF и более ранние идеи
На этой странице собраны источники, которые повлияли на файловый подход, раньше называвшийся на сайте LLM-wiki. Ссылки ведут на оригиналы. Текст ниже представляет собой краткий пересказ.
Откуда растёт идея: Memex, 1945
Оригинал: The Atlantic — «As We May Think», Vannevar Bush, июль 1945
В июле 1945 года американский инженер Вэнивар Буш опубликовал эссе «As We May Think» («Как мы можем мыслить»). В нём он описал memex: гипотетический рабочий стол, в котором человек хранит книги, записи и переписку.
Главная мысль Буша в пересказе:
Буш предложил связывать материалы смысловыми «тропами», которые сохраняют ход рассуждения.
Memex не был построен. Его часто обсуждают как одну из ранних идей, предшествовавших гипертексту. Для этой темы важен принцип смысловых связей между материалами. Современные ИИ-инструменты могут предлагать такие связи, но человеку всё равно нужно проверять источники и актуальность.
Гист Андрея Карпаты «LLM Wiki»
Оригинал: gist.github.com/karpathy — llm-wiki.md
Андрей Карпаты описал в коротком документе паттерн работы с знаниями, который назвал LLM Wiki. Суть в пересказе:
В этой схеме нейросеть поддерживает wiki как накапливаемый рабочий материал. При добавлении нового источника она читает документ, извлекает главное и предлагает обновления страниц и перекрёстных ссылок.
В документе перечислены:
- Три слоя: неизменяемые исходники (raw sources) → wiki-слой из markdown-страниц, которым ИИ владеет полностью → схема-документ (например, CLAUDE.md или AGENTS.md), который делает ИИ «дисциплинированным хранителем wiki».
- Служебные файлы:
index.md— каталог содержимого по категориям;log.md— хронологический журнал добавлений и проверок. - Три процесса: ingest (добавить источник и встроить знания), query (спросить и получить ответ со ссылками), lint (регулярная проверка на противоречия, устаревшие утверждения и страницы-сироты).
Карпаты подчёркивает: описание намеренно абстрактное. Конкретная реализация зависит от области, предпочтений и выбранной нейросети — все элементы опциональны и модульны.
Open Knowledge Format (OKF) от Google Cloud
Оригинал: блог Google Cloud — How the Open Knowledge Format can improve data sharing · Репозиторий: GoogleCloudPlatform/knowledge-catalog
В июне 2026 года команда Google Cloud (авторы — технические лиды Sam McVeety и Amir Hormati) опубликовала Open Knowledge Format v0.1 — открытую спецификацию, которая формализует паттерн llm-wiki в переносимый, независимый от вендора стандарт. Google прямо ссылается на гист Карпаты как на источник вдохновения.
Суть OKF в пересказе:
- знания оформляются как директории markdown-файлов — «концепты»: таблицы, метрики, инструкции, API;
- каждый файл — это YAML frontmatter + markdown-текст: обязательное поле только
type, остальное на усмотрение автора; - три принципа: минимум навязанных правил; независимость производителя знаний от потребителя (формат — это контракт); формат, а не платформа — никаких обязательных аккаунтов и SDK.
Как читать эти источники
Заметка Карпаты описывает способ вести накапливаемую wiki с помощью ИИ. OKF задаёт переносимый формат для markdown-файлов с метаданными. Это связанные идеи, но они не доказывают, что одна схема подходит каждой компании или личному проекту.
Другие материалы
- LLM-wiki простыми словами: статус термина и краткая схема.
- Архитектура LLM-wiki: устройство файлов и процессов.
- LLM-wiki и RAG: сравнение областей применения.
- Memex и OKF в словаре.