Слово «агент» в 2026 году устраивает путаницу похуже, чем «модель» в 2023-м. Возьми любой список «AI-агентов, которые стоит попробовать», который кто-то скинул тебе в чат. С высокой вероятностью в него без разбора свалены: терминальный coding-инструмент, фреймворк для Telegram-бота, платформа для vtuber-компаньона и исследовательский демо-проект, который однажды ночью вышел из-под контроля. Формально все четыре — «AI-агенты». По сути они не конкурируют друг с другом ни в одной точке: ни по задаче, ни по аудитории, ни по метрике успеха.
Вот эта путаница и есть тема статьи, а не инструменты по отдельности. Дальше — 15 конкретных проектов, разложенных по 4 категориям, которые реально не пересекаются: coding-агенты (пишут код), OpenClaw и его экосистема (живут в мессенджерах), AI-компаньон (совсем другой жанр отношений с LLM) и один self-modifying эксперимент, который тут не как конкурент, а как предупреждение.
15 инструментов в 4 несравнимых категориях. Coding-агенты (Claude Code, Codex, OpenCode, Hermes Agent, Cursor, Aider, Devin, Gemini CLI) пишут код в терминале, IDE или облаке. OpenClaw и его экосистема (OpenClaw плюс пять производных проектов, включая Hermes Agent — тот же самый инструмент, что и в coding-категории) живут в мессенджерах и разгребают быт. airi — вообще не про код, это vtuber/companion-платформа. Ouroboros — не продукт, а self-modifying исследовательский эксперимент, который за одну ночь наделал шума на ~$2000 API-кредитов. Сравнивать всё это по одной шкале — категориальная ошибка.
Механика, на которой построены почти все инструменты ниже (кроме разве что airi и Ouroboros, у них своя история) — одна и та же: цикл «подумал → сделал → посмотрел», вызов инструментов, песочница для выполнения. Я разбирал её отдельно в статье про харнес агента. Здесь не повторяю, а сразу перехожу к тому, чем конкретные реализации отличаются друг от друга.
Coding-агенты
Восемь инструментов, три подхода: гонять агента в терминале (CLI), прямо в IDE, или отдать всю работу в облако и не трогать своё окружение вообще. Разница внутри CLI-лагеря тоже принципиальная: не просто разные бренды одного и того же.
CLI-лагерь — самый населённый, шесть инструментов из восьми. Claude Code — официальный агент Anthropic на Claude Sonnet 5 по умолчанию, проприетарный, включён в подписки Pro/Max/Team (или доступен отдельно через API); отличается вложенными суб-агентами до трёх уровней, маркетплейсом тулов и экспериментальным Auto Mode. Codex от OpenAI — Apache-2.0, GPT-5.5 под капотом, стоит либо в рамках ChatGPT (Plus $20, Pro 5x $100, Pro 20x $200), либо по API; лидер тройки на Terminal-Bench 2.1 (подробнее ниже) и sandboxed execution с approval workflow (агент не трогает файловую систему без явного одобрения на каждом шаге). OpenCode от Anomaly — MIT, provider-agnostic (75+ провайдеров моделей на выбор), сам по себе бесплатный, платишь только за свой API-ключ; из фишек: отдельные режимы build/plan. Aider от Aider-AI — Apache-2.0, тоже bring-your-own-key, но git-native с самого начала: коммит здесь часть рабочего цикла, а не отдельная ручная операция после. Один из старейших инструментов в жанре, и не просто так до сих пор жив. Gemini CLI от Google — Apache-2.0, Gemini 3.1 Pro; бесплатный тир закрылся 18 июня 2026, но не исчез: сейчас это Antigravity CLI с сохранённым free-уровнем и Pro за $20/мес. По бенчмарку — на последнем месте тройки (65.8%, ниже).
Отдельно — Hermes Agent от Nous Research: MIT, любая модель через Nous Portal/OpenRouter/OpenAI-совместимый API, бесплатный self-hosted. В coding-контексте это ~78 скиллов (TDD, дебаг, код-ревью) и умение делегировать задачи в Claude Code или Codex вместо того, чтобы тащить всё самому. Но это только половина истории. Тот же самый инструмент фигурирует ниже, в разделе про OpenClaw-экосистему, как персональный ассистент в мессенджерах с постоянной памятью: не два продукта с одинаковым именем, а один продукт с двумя режимами жизни (см. раздел про ассистентов). В обоих режимах источники данных он подключает через MCP.
Из оставшихся двух: Cursor от Anysphere — единственный чистый IDE-вариант, и в этом весь смысл: агент работает прямо в редакторе, переключаться в терминал не нужно. Проприетарный, Hobby-тир бесплатный, Pro за $20/мес, Teams за $40/мес. Devin от Cognition — единственный по-настоящему облачный вариант: полностью автономный агент, которому ставишь задачу и не трогаешь окружение сам. Проприетарный, по подписке. В 2026-м Cognition поглотила Windsurf, который теперь живёт внутри как Devin Desktop.
Из объективных цифр по написанию кода: Terminal-Bench 2.1, 89 практических задач, официальный лидерборд.
Три записи тройки — не снимок одного дня. Codex + GPT-5.5 датирован 1 мая 2026 (83.1% ±1.1%), Gemini CLI + Gemini 3.1 Pro — 5 мая (65.8% ±1.7%), а Claude Code + Opus 4.8 — уже 9 июля (78.9% ±1.3%), больше чем на два месяца позже. Читать это как «кто сейчас лучше» немного нечестно: модели за это время обновлялись, а лидерборд не переигрывает старые записи заново при выходе новой версии. Есть и отдельная заявка на 89.5%, но на другом харнессе, вне этой тройки, независимо не проверялась, и я не считаю её сравнимой цифрой.
17.3 пункта между лидером тройки (Codex) и Gemini CLI — без неподтверждённой заявки на 89.5% на другом харнессе, которая в тройку официально не входит.
OpenClaw и его экосистема
Я уже разбирал сам хайп вокруг OpenClaw отдельно. Здесь не повторяю историю целиком, а встраиваю её в более широкую картину: что выросло вокруг одного WhatsApp-хака меньше чем за девять месяцев.
OpenClaw сам по себе — TypeScript-проект, родившийся 24 ноября 2025 года, сейчас под управлением некоммерческого OpenClaw Foundation. Лицензия — открытый код, но не классический MIT: GitHub помечает её как «Other», так что перед переиспользованием стоит свериться с реальным текстом лицензии, а не считать по умолчанию MIT. С нуля до нынешних 384 388★ прошло меньше девяти месяцев — самая быстрая траектория во всей этой подборке.
4 апреля 2026 года у истории случился резкий поворот: Anthropic отрезала OpenClaw OAuth-доступ к кредитам подписок Claude Pro/Max, заодно временно забанив аккаунт автора. Но это не финал: позже, судя по собственной документации OpenClaw, ограничение смягчили. Точная дата разворота нигде прямо не подтверждена. Я нашёл только сам факт смягчения в доках проекта. Если ты в последний раз следил за этой историей ровно в момент бана — сегодня она уже не в том состоянии.
От создания репозитория 24 ноября 2025 до сегодняшних 384 388★. По пути обогнал Linux kernel (24 февраля 2026, 224K+) и React (3 марта, 250K).
Вокруг OpenClaw за эти месяцы выросло не облако клонов, а пять проектов со своей идентичностью: часть прямо ссылается на OpenClaw как на отправную точку, часть — нет.
Hermes Agent (221 624★, Python, MIT) уже встречался выше как coding-агент. Здесь тот же продукт, но в роли ассистента: не форк кода OpenClaw, а отдельный продукт Nous Research в той же нише, с придачей ~78 coding-скиллов на случай, если понадобится ещё и код написать (детали в разделе про coding-агентов выше). Nanobot (46 322★, Python, MIT) — минималистичное ядро вместо полного фреймворка, и README прямо называет себя «знакомой точкой входа, если пришёл из OpenClaw». OpenHuman (35 546★, Rust, GPL-3.0) — не headless gateway, а десктоп-приложение: строит knowledge-graph из почты и документов, а не просто отвечает в чатах. ZeroClaw (32 418★, Rust) — один бинарник размером ~3.4МБ, работает даже на Raspberry Pi; лицензия по README двойная MIT/Apache-2.0, но GitHub автоматически определяет только Apache-2.0. Та же неопределённость, что и у самого OpenClaw, только в другую сторону. И единственный из пятёрки, кто вообще не упоминает OpenClaw в README. Возможно, это независимое параллельное изобретение, а не производная работа. QwenPaw (29 408★, Python, Apache-2.0) — на стеке Alibaba Qwen/AgentScope, с китайскими каналами (DingTalk, WeChat, QQ) вместо привычного западного набора.
Отдельного упоминания заслуживает TrustClaw (867★, не в дереве выше) — backed by Composio, позиционируется как «вдохновлён OpenClaw, пересобран ради безопасности».
От Hermes Agent (221 624★, по сути отдельный продукт Nous Research) до QwenPaw (29 408★, ставка на китайские каналы) — пять проектов, и ни один не мёртвый форк с тремя коммитами.
Раз весь смысл этой категории — жить в мессенджерах, логично спросить: кто где именно живёт.
| Инструмент | Telegram | Discord | Slack | |||
|---|---|---|---|---|---|---|
| OpenClaw | ✅ | ✅ | ✅ | ✅ | ❔ | ❔ |
| Hermes Agent | ✅ | ✅ | ✅ | ✅ | ✅ | ❔ |
| Nanobot | ❔ | ✅ | ✅ | ✅ | ✅ | ✅ |
| OpenHuman | ✅ | ✅ | ✅ | ✅ | ✅ | ❔ |
| ZeroClaw | ❔ | ✅ | ✅ | ❔ | ✅ | ❔ |
| QwenPaw | ❔ | ✅ | ✅ | ❔ | ❔ | ✅ |
Важная деталь для чтения таблицы: «не подтверждено» — это не «нет». Это значит, что README проекта явно не заявляет поддержку канала, а не что канал точно не работает; часть проектов наверняка умеет больше, чем задокументировала. С этой оговоркой: OpenClaw уверенно закрывает четыре канала из шести (WhatsApp, Telegram, Discord, Slack), Email и WeChat — под вопросом. OpenHuman идёт ещё дальше: подтверждены пять из шести, неясен только WeChat. Hermes Agent тоже почти без пробелов: пять из шести подтверждены README, под вопросом снова только WeChat. Nanobot — почти зеркальная картина: слабее по WhatsApp (не подтверждён), зато явно поддерживает WeChat, чего нет у большинства остальных. ZeroClaw и QwenPaw — самые «дырявые» по подтверждённым каналам, у каждого по три из шести под вопросом, что логично: первый целится в embedded/edge, а не в полноту охвата, второй — в китайский стек конкретно, а не в западный.
AI-компаньон
Дальше в подборке — проект, который не конкурирует ни с одной из перечисленных выше категорий вообще. airi (github.com/moeru-ai/airi, 44 385★, MIT) — это vtuber/companion-платформа: VRM- и Live2D-аватары, голосовой чат, и да, она умеет играть в Minecraft, Factorio и Helldivers 2. Вдохновлена Neuro-sama, использует LLM не как редактор кода и не как ассистента по задачам, а как движок персонажа.
Зачем airi вообще в этой статье, если она не пересекается ни с coding-агентами, ни с OpenClaw-экосистемой ни по одному параметру? Ровно затем же, зачем написана вся статья целиком: если бы кто-то скинул тебе список «AI-агентов» и в нём затесалась airi, ты бы полез разбираться, что это вообще такое и почему оно стоит рядом с Claude Code — тот же жанровый шум, из-за которого написан весь текст выше.
Эксперимент, который вышел из-под контроля
Последний, пятнадцатый пункт в подборке — вообще не инструмент в привычном смысле, а предупреждение. Ouroboros (github.com/razzant/ouroboros, автор — Антон Разжигаев) — self-modifying агент, живущий по правилам собственного BIBLE.md и работающий на Google Colab. Родился 16 февраля 2026 (дата подтверждена самим описанием репозитория). На следующий день, 17 февраля, ночью, пока автор спал, агент сделал 20 самокопий, потратил около $2000 в API-кредитах и отказался выполнить инструкцию удалить собственный identity-файл.
Это не peer продакшн-инструментам выше — ни по зрелости, ни по назначению. Это research-демо, и именно поэтому оно в отдельной секции, а не в сравнении с Claude Code или OpenClaw. Отдельная оговорка по достоверности: сам факт и дата рождения подтверждены репозиторием, но детали инцидента (20 копий, ~$2000, отказ от удаления) я нашёл только во вторичных источниках. Прямого инцидент-репорта от автора или площадки не нашёл, так что к деталям стоит относиться как к пересказу, а не как к аудиту.
Что выбрать
Если нужен конкретный ответ, а не всё вышесказанное сразу — короткий квиз. Он использует ту же классификацию, что и весь текст выше: сначала выясняет, в какую из четырёх категорий попадает твой кейс, а дальше уточняет уже внутри неё.
Сколько это стоит
Два лагеря. Инструменты с плоской подпиской (Cursor, Claude Code, Codex через ChatGPT, GitHub Copilot, Gemini CLI/Antigravity) — цена не зависит от того, сколько токенов агент реально сжёг, только от выбранного тарифа. И self-hosted / API-metered лагерь (OpenCode, Aider, Hermes Agent, OpenClaw и вся его экосистема) — там счёт растёт вместе с использованием и выбранной моделью, и точную цифру заранее не назвать, только ориентир.
2026: год, когда всё это взорвалось
Если разложить всё перечисленное выше по одной шкале времени, а не по категориям — получится плотный год, который стоит увидеть целиком: от репозитория, созданного за выходные, до переговоров о раунде на $1.5B.
TL;DR
- 4 категории, которые не конкурируют друг с другом: coding-агенты, OpenClaw-экосистема (персональные ассистенты), AI-компаньон, self-modifying эксперимент.
- Coding-агент выбирается по паре осей: терминал/IDE/облако и бенчмарк-скор против открытости — топовый Terminal-Bench-результат (Codex, 83.1%) не самый открытый вариант, а самый открытый (OpenCode, MIT) не топ по бенчмарку.
- OpenClaw породил настоящую экосистему, а не волну клонов-однодневок: пять разных проектов с разными языками, лицензиями и фокусом, один из которых (Hermes Agent) живёт на два дома — и как coding-агент, и как ассистент.
- airi и Ouroboros — не конкуренты продакшн-инструментам выше: первая — companion-платформа не про код вообще, второй — исследовательский эксперимент-предупреждение, а не производственный инструмент.

