# Claude Code или Codex: что выбрать для вайбкодинга и агентной разработки

Это decision page для выбора между Claude Code и Codex в 2026. Не вечная таблица “какая модель умнее”, а практическая развилка: где жить каждый день, кому отдавать длинные задачи, чем ревьюить diff и как не превратить рабочий контекст в болото.

**Короткий ответ:** если нужен привычный агент в терминале, плотная работа с репой, MCP и skills — начинайте с Claude Code. Если нужен стабильный второй исполнитель, ревьюер и запасной агент, когда Claude просел по лимитам или качеству, — держите Codex рядом. Для настоящей агентной разработки выигрывает не один инструмент, а связка: Claude Code / Codex пишут и ревьюят, Cursor помогает руками в IDE, а память и правила живут вне вендора — в GBrain, markdown-контексте, skills и тестах.

## Быстрый выбор

| Сценарий | Что выбрать | Почему |
| --- | --- | --- |
| Хочу быстро вайбкодить в существующей репе | Claude Code | CLI ближе к рабочей директории, удобнее давать файлы, запускать проверки, держать привычный цикл правок |
| Нужен второй агент для ревью и альтернативного решения | Codex | Хорошо работает как независимый исполнитель: “посмотри на diff”, “найди риск”, “предложи другой план” |
| Длинная агентная задача на несколько часов | Связка Codex + Claude Code + внешний план | Один агент легко зарастает контекстом; лучше делить план, реализацию и ревью |
| Много MCP, skills, hooks и локальной грязи | Claude Code, но с hygiene | Claude силён в этом режиме, но именно здесь чаще начинается “почему он тупит” из-за перегруженного контекста |
| Нужно не зависеть от одного вендора | Codex рядом с Claude Code | Переносимость становится частью рабочего флоу, а не планом на случай пожара |
| Хочу always-on агента в Telegram, cron и память | Не Claude/Codex напрямую | Нужен слой выше: Hermes Agent, OpenClaw, свой harness, GBrain, allowlists и безопасные tools |
| Работаю глазами в интерфейсе и руками правлю UI | Cursor + агент в терминале | Cursor хорош как IDE-слой, но для автономной работы в репе я всё равно держал бы отдельного агента |

## Что мы вообще сравниваем

Под “вайбкодингом” я имею в виду не “написал одну фразу и молюсь”. Нормальный вайбкодинг — это быстрый цикл:

1. Дать агенту цель и границы.
2. Попросить план до кода.
3. Дать ему трогать файлы маленькими кусками.
4. Запустить проверки.
5. Отдельно попросить ревью: что могло сломаться.
6. Принять diff глазами.

Агентная разработка — следующий уровень. Там важнее не скорость первой версии, а управляемость: план, сабагенты, контекст, память, тесты, прогресс-артефакты, rollback и способность продолжить задачу завтра.

Из-за этого вопрос “Claude Code или Codex” быстро превращается в вопрос “какую роль отдать каждому инструменту”. Один агент не обязан быть всем.

## Где Claude Code сильнее

Claude Code мне всё ещё нравится как основной рабочий агент в репозитории.

Сильные места:

- **терминальный флоу**: агент рядом с файлами, тестами, git и локальными правилами проекта;
- **MCP и skills**: удобно собрать рабочую среду вокруг конкретной репы, браузера, базы знаний, smoke-тестов;
- **маленькие итерации**: “проверь”, “поправь”, “добавь тест”, “сделай diff меньше” ощущаются естественно;
- **работа с привычками проекта**: если у вас есть `AGENTS.md`, `CLAUDE.md`, skills и нормальные проверки, Claude быстрее начинает вести себя как участник команды;
- **инженерный UX**: меньше ощущения, что вы переписываетесь с отдельным продуктом, больше ощущения, что агент сидит в терминале.

Но сила Claude Code легко превращается в слабость. Чем больше вы накидываете skills, MCP, файлов, старых инструкций и “полезного контекста”, тем выше шанс получить мутную деградацию. Кажется, что модель стала глупее, а на деле вы скармливаете ей комнату, в которой давно не убирались.

## Где Codex сильнее

Codex для меня стал не “убийцей Claude Code”, а хорошим вторым центром тяжести.

Сильные места:

- **независимое ревью**: полезно дать Codex тот же diff и спросить, что я не вижу;
- **стабильный запасной исполнитель**: когда Claude просел по лимитам, качеству или просто бесит, работа не останавливается;
- **другой стиль мышления**: иногда он дольше думает, но выдаёт более ровную структуру решения;
- **меньше завязки на один harness**: если весь рабочий процесс сидит только в Claude Code, вы становитесь заложником очередной деградации, квоты или продуктового решения;
- **хороший режим “сделай второй вариант”**: особенно для архитектурных решений, миграций, ревью security и cleanup.

Главная претензия к Codex в моём флоу: он быстрее забивает контекст, и его приходится дисциплинировать. Чаще начинать новую сессию. Чаще явно говорить “используй сабагентов / вынеси детали / не тащи лог в ответ”. Это не катастрофа, но привычки меняются.

## Decision matrix

| Критерий | Claude Code | Codex | Как выбирать |
| --- | --- | --- | --- |
| Первый прототип | Очень хорошо | Хорошо | Если репа локальная и много файлов — Claude. Если нужен независимый взгляд — Codex |
| Рефакторинг | Хорошо при жёстких тестах | Хорошо как ревьюер | Большие рефакторы лучше вести в два агента: один пишет, второй ищет риск |
| Контекст | Силен, пока чисто | Требует дисциплины | Любой инструмент сломается, если тащить в него весь мир |
| Сабагенты | Полезны, но надо явно проектировать флоу | Полезны, но надо напоминать | Для задач дольше 30–60 минут всегда думать про decomposition |
| MCP / tools | Сильная зона Claude Code | Зависит от окружения | Если рабочий процесс вокруг MCP, Claude часто удобнее как основной агент |
| Skills / инструкции | Хорошо, если skills короткие и живые | Лучше держать в внешнем контексте | Skills должны быть операционными контрактами, не prompt soup |
| Ревью diff | Норм | Очень полезен как второй reviewer | Не ревьюить тем же агентом, который написал код, если риск высокий |
| UX | Терминал, ближе к разработчику | Больше ощущение отдельного продукта | Выбирайте по тому, где меньше трения именно у вас |
| Переносимость | Нужно отдельно выносить память | Тоже нужно отдельно выносить память | GBrain/markdown/tests важнее, чем вера в одного клиента |

## Мой текущий рабочий флоу

Я бы не выбирал “один навсегда”. Нормальная схема сейчас такая:

1. **Claude Code** — основной агент в репе: правки, тесты, маленькие фичи, MCP, локальные проверки.
2. **Codex** — второй исполнитель и ревьюер: альтернативный план, поиск риска, cleanup, “что мы не видим”.
3. **Cursor** — ручной IDE-слой: быстро открыть файл, поправить глазами, проверить UI, не терять контроль.
4. **GBrain / markdown-контекст** — память вне клиента: решения, project facts, source packs, reusable learnings.
5. **Hermes / OpenClaw / свой harness** — если агент должен жить дольше одной сессии: Telegram, cron, webhooks, delivery, профили, allowlists.

Главный вывод неприятный, но полезный: лучший агентный флоу — это не “самая умная модель”, а нормальная операционная система вокруг неё.

## История: почему я на время переехал на Codex

Snapshot на середину мая 2026: я временно переехал с Claude Code на Codex, потому что Claude Code увидели клюшку в метриках, не справились с ростом и начали ощущаться хуже. Ранее добавили кеширование и “оптимизации”, юзеры стали чувствовать, что Claude Code тупит жоска. В нашем чате и в твиттере это было не только у меня.

Сами Claude Code объясняли часть деградации количеством установленных skills, MCP и другой контекстной грязи.

Они добавили `/doctor`, чистки, кредиты и лимиты, но я уже чёрнулся. Пока такой вайбик: если инструмент ломает мой рабочий цикл, я не обязан героически ждать исправления. Должен быть запасной путь.

Мой фидбек по Codex тогда был такой:

1. Дал задачу — долго думает — выдаёт хороший ответ, но контекст уже заполнен. Приходится чаще явно начинать новую сессию.
2. Чтобы экономить контекст, приходится напоминать использовать сабагентов и не тащить всё в основной чат.
3. Через desktop-приложение чувствуешь себя чуть более корпоратом, чем в любимом CLI. Микрофончик есть, но я всё равно продолжаю использовать Spokenly на правый command.
4. Нет ощущения, что тебя сейчас накажут за эксперименты с другими tools. Пока что.

План с тех пор не изменился: переносить рабочий контекст в GBrain/OpenBrain/markdown-слой, чтобы переезд между клиентами был обычной операцией, а не личной драмой.

## Что добавилось из обсуждений

В [нашем тг чатике](https://t.me/ohld_chat) вокруг этого периода шло много сравнений Claude Code и Codex. Полезный сигнал: опыт стал примерно поляризованным. Часть людей оставалась на Claude Code из-за привычного CLI и качества флоу, часть уходила в Codex из-за стабильности, доступности и меньших рисков.

Повторяющийся community insight: люди недооценивают стоимость context hygiene. Когда в Claude Code лежит много MCP, skills и локальной грязи, деградация ощущается как “модель тупит”, хотя часть проблемы может быть в среде. В Codex похожая проблема выглядит иначе: ответ хороший, но контекст быстрее заполняется, и нужно дисциплинированнее начинать новые сессии.

Ещё один паттерн: опытные пользователи всё реже спрашивают “какой инструмент победил”. Они собирают связки: один агент пишет, второй ревьюит, третий живёт в Telegram и запускает фоновые задачи, а память лежит отдельно.

## Как проверить на своей задаче

Не надо выбирать по моему фанатству. Сделайте маленький benchmark на своём проекте.

### Тест 1: маленькая фича

Дайте Claude Code и Codex одинаковый issue:

- цель;
- 3–5 релевантных файлов;
- ограничения;
- команду проверки;
- критерий готовности.

Сравнивайте не красоту ответа, а diff, количество вмешательств и то, сколько раз агент сделал что-то “почти, но не то”.

### Тест 2: ревью чужого diff

Пусть один агент пишет, второй ревьюит. Вопрос ревьюеру:

```text
Посмотри на diff как инженер, который будет это поддерживать.
Найди риски, missing tests, edge cases, security/privacy проблемы и места,
где изменение слишком широкое для задачи. Не переписывай код без причины.
```

Если второй агент находит реальный риск, он уже окупил своё место в стеке.

### Тест 3: длинная задача

Возьмите задачу на 2–4 часа и проверьте:

- держит ли агент план;
- умеет ли он не тащить весь лог в ответ;
- просит ли проверки в правильные моменты;
- не забывает ли ограничения из начала;
- можно ли продолжить после context reset.

Вот тут обычно и становится видно, что “модель умная” и “агентный флоу управляемый” — разные вещи.

## Что делать с контекстом

Если после каждой новой сессии вы заново объясняете проект, проблема не в Claude Code и не в Codex. Проблема в том, что у вас нет нормального слоя памяти.

Минимальная версия:

- `AGENTS.md` рядом с проектом;
- короткие specs для задач;
- маленькие reusable skills;
- decision log: что решили и почему;
- команды проверки;
- список forbidden actions;
- source packs для больших исследований.

Более взрослая версия:

- GBrain/OpenBrain как retrieval layer;
- отдельные project facts вместо сырых логов;
- ссылки на реальные артефакты;
- регулярная чистка устаревших правил;
- отдельные профили для личного агента, публичного бота и проектного teammate.

Контекст должен переживать смену клиента. Иначе вы не работаете с агентами, вы ухаживаете за одной очень дорогой вкладкой.

## Когда не надо автоматизировать

Главное правило из практики: не надо автоматизировать то, что вы ещё не задолбались делать руками.

Если флоу не повторяется, не надо сразу строить multi-agent систему. Сначала сделайте задачу руками с Claude Code или Codex. Потом повторите. Потом вынесите в skill. Потом добавьте проверки. И только потом думайте про Telegram-агента, cron, webhooks и память.

Плохая агентная разработка выглядит так: “я дал агенту всё, он что-то делает, страшно нажать merge”. Хорошая — скучнее: маленькая задача, понятный контекст, проверка, diff, ревью, запись полезного вывода в память.

## FAQ

### Claude Code лучше Codex?

Для ежедневной работы в репозитории Claude Code часто удобнее: терминал, tools, MCP, skills, привычный инженерный цикл. Но “лучше” не значит “единственный”. Codex полезен как второй агент и страховка от vendor/regression риска.

### Codex лучше для вайбкодинга?

Если под вайбкодингом понимать “быстро получить первый рабочий вариант”, оба справляются. Разница в ощущении флоу. Claude Code ближе к терминалу и проекту, Codex часто ощущается как более отдельный исполнитель, которому надо чётче резать контекст.

### Что выбрать новичку?

Если вы разработчик и живёте в терминале — начните с Claude Code. Если уже используете Codex или вам важен запасной агент для ревью — добавьте Codex вторым. Если вы вообще не хотите терминал, Cursor может быть мягче как вход.

### Нужно ли использовать оба?

Да, если вы делаете что-то серьёзнее одноразовой правки. Один агент пишет, второй ревьюит. Это не серебряная пуля, но снижает шанс, что вы примете красивый, но опасный diff.

### Где здесь Hermes Agent?

Claude Code и Codex — инструменты для работы над задачей. Hermes Agent или OpenClaw — слой, где агент может жить постоянно: Telegram, cron, профили, память, delivery, tools. Это другой уровень. Если вам нужен “агент, которому можно написать с телефона и получить результат позже”, смотрите в сторону такого harness.

## Читать ещё

- [AI-агенты: с чего начать в 2026](/ru/blog/ai-agents-s-chego-nachat/)
- [AI-агент в Telegram: где заканчивается бот и начинается рабочий интерфейс](/ru/articles/ai-agent-v-telegram-rabochiy-interfeis/)
- [GStack, /goal и office hours: рабочий цикл для AI-агента](/ru/blog/gstack-goal-office-hours-ai-workflow/)
- [Claude Code + Codex: двойное ревью AI-агентов](/claude-codex-dual-review/)
- [Мой сетап Claude Code после 4 месяцев ежедневной работы](/claude-code-nastrojka-mcp-hooks-skills-2026/)
- [Мой AI-сетап 2026: Claude Code, Cursor, Ghostty и база всех чатов](/ru/blog/my-ai-setup-2026-claude-code-cursor-spokenly-ghostty/)
