← На главную

Google анонсировал OKF 0.1 — знания в Markdown-файлах

05.07.2026 07:59 · hackernews

Долгое время, чтобы дать ИИ-агенту знания о бизнесе, нужно было строить сложную инфраструктуру. Документы нарезали на чанки, подбирали embedding-модель, запускали векторную базу данных (vector database), оборачивали всё в SDK. Знания переставали быть читаемыми — они превращались в запросы к пайплайну, запертые внутри фреймворка. RAG (Retrieval-Augmented Generation) был хорошей идеей, когда контекстные окна были маленькими, а модели — дорогими. Но плата за это — знания становятся недоступными для человека и следующего инструмента без «переводчика». Это не paywall, а format wall.

Параллельно строители агентов нашли другой путь. Пользователи Claude Code или Codex начали писать CLAUDE.md и AGENTS.md — обычные файлы, которые модель читает в начале каждой сессии. Никаких embeddings, никаких vector store. Тот же инстинкт проявился в Obsidian, DESIGN.md, MEMORY.md. Оказалось, что LLM отлично работают с Markdown: у него есть структура (заголовки, списки, ссылки), но нет лишнего церемониала. Человек и машина читают один файл и понимают его одинаково.

Андрей Карпати назвал этот паттерн LLM Wiki. Это трёхуровневая структура из простых файлов: папка sources/ с неизменяемым сырьём, папка wiki/ с Markdown-страницами, которые модель генерирует и поддерживает (саммари, концепты, сущности), и schema-файл (CLAUDE.md), который объясняет агенту, как всем этим управлять. Суть в том, что LLM не скучно обновлять сотню файлов, перелинковывать их и сверять противоречия. RAG пересобирает контекст с нуля на каждый запрос, а wiki компилирует знание один раз и держит его актуальным. И это просто файлы. Их можно открыть, отредактировать, положить в git. Знание больше ничем не заблокировано.

В июне Google Cloud анонсировал Open Knowledge Format (OKF) версии 0.1. Это открытая спецификация, которая формализует паттерн LLM Wiki в переносимый, вендор-независимый формат. OKF-бандл — это директория с Markdown-файлами. Каждый файл — одно понятие (датасет, таблица, метрика, runbook, API) с YAML frontmatter. Требуется только одно поле: type. Остальные (title, description, resource, tags, timestamp) опциональны. Понятия связываются обычными Markdown-ссылками, образуя граф без графовой базы данных. Google подчёркивает: «Никакого сложного сжатия, никакой новой среды выполнения, никакого обязательного SDK». Это «просто Markdown», «просто файлы».

Главное в OKF — не техническая сложность, а договорённость. Проблема знаний была не в выразительности, а в интероперабельности (interoperability). У всех был свой Markdown со своими frontmatter и схемами ссылок. Стандарт делает все эти бандлы портабельными. Знание перестаёт быть тем, что нужно перекодировать на каждой границе. Оно просто течёт.

Мы пытались сделать знание сильным через усложнение, но усложнение же его и заблокировало. Снимает блокировку простая конвенция, которую одинаково прочитают джуниор, заметки сеньора, пайплайн и языковая модель. Знания не должны быть заперты за векторной базой, SDK или чьим-то проприетарным каталогом. Они должны быть в файлах, которые можно открыть и в которых разбираются машины. Google просто записал это как спецификацию, и, вероятно, многие инструменты последуют этому примеру.

Читать оригинал →