Эволюция ИИ харнеса
За последние несколько лет обвязка вокруг LLM‑модели выросла из чатика и файла с правилами в редакторе до самостоятельного технологического слоя — харнеса — со своими протоколами, стандартами и фундаментом, а привязка клиента у вендоров сместилась с уровня конкретной LLM‑модели на уровень этого харнеса.
Определения:
1. Модель — LLM, нейросеть, генерирующая текст по запросу. Сама по себе stateless (не помнит предыдущие вызовы), не имеет доступа к внешнему миру и не способна к действию — только к порождению следующего токена или в итоге вероятного набора фраз по входному контексту.
2. Харнес — программно‑инфраструктурная обвязка вокруг модели, превращающая её из генератора текста в систему, которая может производить «осмысленные» действия. Харнес обеспечивает модель функционалом: инструменты (доступ к внешнему миру), контекст‑менеджмент (память, сессии, компактизация), правила/инструкции (поведение), разрешения и права (безопасность), опционально усиление — хуки, скилы, оркестрацию. Харнес — «тело», модель — «семантический мозг».
3. ИИ Агент — это модель, помещённая в харнес и потому способная действовать, то есть воспринимать состояние среды через инструменты, сохранять контекст между шагами, планировать и выполнять многошаговые задачи. Агент не компонент, а результат сочетания модели и харнеса.
Далее — как примерно происходило развитие идей харнеса и к чему пришло.
1. Правила и промпт (2023 — февраль 2025). Зачатки в редакторах (.cursorrules, ~2024), системно — с выходом Claude Code и CLAUDE.md (февраль 2025), затем открытый стандарт AGENTS.md (OpenAI, август 2025).В декабре 2025 OpenAI передала его в фонд AAIF; к сентябрю 2026 принят более чем в 60 000 open‑source репозиториях, поддержан Amp, Codex, Cursor, Gemini CLI и др.
2. MCP (ноябрь 2024). Стандартизированное подключение внешних инструментов к ИИ‑агенту.
В декабре 2025 Anthropic передала MCP в нейтральный Agentic AI Foundation (Linux Foundation) вместе с AGENTS.md и goose — при поддержке Google, Microsoft, AWS, Cloudflare.
Обновление спецификации от 28.07.2026: stateless‑ядро (сервер — обычный HTTP‑сервис без sticky‑сессий), фреймворк Extensions (enterprise‑аутентификация, интерактивные приложения, долгие задачи).
3. Контекст и сессии (первая половина 2025). Компакция/обобщение длинного контекста, чекпоинты в краткой памяти (кэше модели) и откат шагов, форкирование(клонирование) диалогов (~весна‑лето 2025). Субагенты — июль 2025; в 2026 получили асинхронность, постоянные YAML‑конфиги, файловые промпты и собственные хуки, запускающиеся вместе с субагентом. Компактизация сессий эволюционировала в session memory compaction с фоновыми потоками и prompt caching.
4. Хуки (точки вставки/коррекции, триггеры или якоря) (~июнь 2025). Скрипты на событиях жизненного цикла (до/после любого инференса). Суть: детерминированная логика решения, что сказать/напомнить агенту; сигнал доходит до агента, не прерывая текущую задачу. Этот подход — путь от гигантских markdown‑файлов к подгрузке/напоминании только релевантных инструкций в нужный момент.
В OpenCode аналог — плагины (TS‑модули с хуками); нативный слой хуков на февраль 2026 там всё ещё обсуждался как feature request.
5. Скилы (октябрь 2025). Лёгкая альтернатива MCP: markdown‑инструкции, загружаемые по мере нужды. Эволюционировали до «markdown + исполняемые скрипты»; идеал — максимально покрыты скриптами, а не прозой.
Anthropic опубликовала Agent Skills как открытый кросс‑платформенный стандарт в декабре 2025; к середине 2026 — около 40 совместимых платформ, миллионы скилов, внимание сместилось с портативности на инфраструктуру доверия (сканирование безопасности, контроль качества).
Microsoft добавила пакетный менеджер APM (апрель 2026) — npm/pip‑подобное объявление скилов, промптов, плагинов и MCP‑серверов в одном apm.yml.
6. Оркестрация (2025). Мультиагентные обвязки поверх протоколов управления агентами (ACP и др.): разные агенты под одной точкой управления; на этой базе — бенчмарк‑фреймворки для сравнения моделей и инструментов.
ACP (Zed, август 2025; JetBrains присоединился в октябре 2025) слился с A2A (август 2025, под LF AI & Data); к апрелю 2026 A2A — production‑ready стандарт, 150+ организаций.
Стек 2026: MCP — агент + инструменты, A2A — агент + агент.
На базе оркестрационных слоёв (ACP/A2A) — бенчмарк‑фреймворки для сравнения моделей и инструментов.
Нюансы:
Проблема переносимости. Харнес не переносится копипастой: возможности хуков и структура папок различаются между инструментами. Частично решено на уровне скилов (открытый стандарт, ~40 платформ) и правил (AGENTS.md как де‑факто универсальный формат), но не хуков/плагинов. Стандарта всё ещё нет.
Рабочий костыль: унифицированный харнес в отдельном репозитории + входная инструкция, по которой агент сам адаптирует его под своё окружение; поверх — пакетный менеджер для декларативной установки зависимостей.
Харнес — это продукт с ролью. Универсальных пока нет. Типовые паттерны, устоявшиеся к концу 2025: диалоговые формы, «разговор с базой» (естественный язык → SQL → читаемый ответ), анализаторы кодовой базы, персональные ассистенты.
Модели в 2025-м году стали практически взаимозаменяемыми: разница в качестве нивелируется за месяцы, и удерживать клиента на этом уровне больше не получается. Поэтому привязка клиента у вендора сместилась в харнес — среду‑обвязку, где живут правила, скилы, хуки, MCP‑конфигурация и память агентов. Сменить модель — минуты, сменить харнес — миграция инженерной накопленной базы.
Закономерности развития: open source развивает идеи быстрее и иногда перепрыгивает через возможности от вендоров, подхватывая идеи (хуки/плагины OpenCode богаче клодовских), но де‑факто стандартом становится то, что зафиксирует крупный игрок. В 2025–2026 «фиксатором» стал не один крупный игрок, а «нейтральный» консорциум — договариваться стали, но под эгидой фонда, а не одного победившего вендора.
Три уровня приложения харнеса.
a) под проект;
b) под личность;
c) под команду.
Командный вариант самый проблемный: успешных внедрений почти нет, потому что команда, плотно посадившая агентов на свои задачи, перестаёт быть командой — каждый разработчик становится микро‑менеджером пула агентов при объёме задач как у небольшой команды.
Командный харнес как слой находится в процессе формирования. Anthropic, например, только в 2026 добавила в Team/Enterprise инструменты Shared Skills и отчёты по использованию.
Уровни программной иерархии:
┌─ Интерфейсный слой: ACP (IDE ↔ агент), AG‑UI (frontend ↔ агент)
├─ Оркестрация: A2A (агент ↔ агент) внешняя, субагенты — внутренняя (внутри одного харнеса)
├─ ИИ Агент: <Модель> + харнес
└─ Харнес: MCP (тулы) + правила + контекст + permissions
Статус (на сентябрь 2026).
Цепочка развития харнеса (2023–2026) получается следующей: правила → MCP → контекст‑менеджмент/сессии → permissions/субагенты → хуки → скилы → плагины → оркестрация.
Внутри одного инструмента, как правило, уже всё устоялось. Между инструментами появился нейтральный управляющий слой (stewardship) — Linux Foundation/AAIF: MCP, AGENTS.md, goose, A2A. Но единый стандарт харнеса ещё не сложился.
Для справки основные вендорские харнесы:
первый эшелон — массовые:
a) Claude Code (Anthropic) — эталон категории, ~142k звёзд в гитхабе, лидер по загрузкам, вокруг него строятся стандарты
b) Codex (OpenAI) — CLI + App Server + ChatGPT Work; № 1 по Terminal‑Bench, № 2 по использованию, опенсорс фреймворка в августе 2026
c) GitHub Copilot Harness (Microsoft) — крупнейшая аудитория через базу VS Code; агентный режим + Copilot Studio
d) OpenCode (SST/Anomaly, MIT) — флагман open source, 75+ провайдеров моделей
e) Cursor (Anysphere) — сильнейший in‑editor агент, собственное IDE
f) Antigravity 2.0 / CLI (Google) — НО! Google в июне свернула с открытого пути в проприетарную модель сервиса — единственный среди большой четвёрки, кто сделал такой разворот в 2026
g) Grok Build (xAI) — бета с 25 мая 2026, открытый Rust‑код с июля 2026
второй эшелон — зрелый open source:
a) Kimi Code CLI (Moonshot) — под Kimi K3; лучший pass rate в бенчмарках, прожорлив по токенам
b) Qwen Code (Alibaba) — Apache-2.0, ~27k звёзд
c) Goose (Block) — учредительный проект Agentic AI Foundation
d) Zed Agent + OpenHands (ex‑OpenDevin) — говорят по ACP слою взаимозаменяемы
e) Aider — CLI‑пионер, живой, но теряет долю
f) Cline / Kilo Code — VS Code‑ветка; Roo Code прекращён (май 2026), Kilo — его апгрейд
третий эшелон — новые/нишевые/экзотические:
a) Pi — минималистичный, «идеал маленького харнеса» под компактные модели
b) OpenClaw — персональный ассистент поверх чат‑приложений (Telegram, Slack); независимый фонд, без telemetry
c) Crush (Charm) — “красивый” форк линии OpenCode, FSL
d) Beam CLI — AGPL-3, security‑фокус (офлайн‑сканы, skill‑бандл)
e) DeepSeek‑Reasonix — однофайловый Go‑бинарник, оптимизирован под дешёвый инференс; не путать с основным DeepSeek Harness
Де‑факто стандарты:
— Claude Code;
— OpenCode (open source) — по звёздам;
— DeepSeek Harness — по скорости набора аудитории.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.