← Блог

AI-инструменты для разработки

Cursor, Codex или Claude Code: что выбрать разработчикам в 2026 году

Все три читают проект, правят файлы и запускают команды. Год я работал на них каждый день и понял: выбирать надо не по списку фич, а по токенам, галлюцинациям и по тому, мешает инструмент думать о задаче или нет.

Коротко: бери Claude — он лучше всех сбалансирован. Codex умный, но лимиты сжигает за пару вечеров. Cursor — просто агрегатор чужих моделей, и со своим Composer он безбожно отстал.

Сравниваю то, что стоит одинаково — по 20 долларов в месяц: Claude Pro, ChatGPT Plus и Cursor Pro. Это не бенчмарк, а опыт человека, который каждый день пишет на них продукт. Всё дальше — про август 2026-го; тарифы и лимиты меняются чаще, чем выходят статьи.

Что выбрать: Cursor, Codex или Claude Code?

Если смотреть на список функций, все трое одинаковые: читают репозиторий, правят файлы, гоняют команды, умеют в MCP. Разница вылезает на третий день — когда кончаются токены, когда агент чинит совсем не то, и когда ловишь себя на том, что думаешь про инструмент, а не про продукт.

Инструмент За что ты платишь 20 долларов Итог
Claude Code Доступ к своим моделям вендора, лимиты на день и на неделю Основной инструмент на каждый день
Codex Доступ к своим моделям вендора, недельный бюджет Второе мнение, аналитика, тяжёлые разборы
Cursor Пул запросов к чужим моделям плюс свой Composer Хорошая IDE, слабый агент за эти деньги

Дальше по пунктам, почему так вышло.

Чьи модели внутри и почему это важно

У Anthropic и OpenAI своя инфраструктура и свои сети — ты покупаешь доступ у тех, кто модель обучил. Cursor таких моделей не делает: он перепродаёт тебе Anthropic, OpenAI и Google по ценам их API, а сверху даёт редактор. Никакой философии, обычная наценка посредника.

  • Claude: Sonnet 5 — на каждый день, Opus 5 — когда задача реально сложная, Haiku 4.5 — быстрая мелочь, Fable 5 — ещё один вариант верхнего уровня. Модель выбираешь сам, и это главный способ не жечь бюджет.
  • Codex: линейка OpenAI, там есть варианты попроще и подешевле для мелких правок и «думающие» для тяжёлого. Честно — я всё время сидел на sol и почти не переключался, так что за остальные не скажу.
  • Cursor: любые чужие модели по API плюс свой Composer. Про Composer говорят, что внутри дообученный опенсорс из семейства Qwen. Официально это не подтверждали, но ведёт он себя именно так.

Вывод простой: у держателя модели ты платишь за токены, у агрегатора — за токены плюс маржу. На тех же 20 долларах работы выходит заметно меньше.

Токены: тут всё и ломается

Про качество моделей спорят в твиттере, а рабочий день ломается всегда об одно — про токены. И вот тут трое ведут себя совсем по-разному.

Codex: недельные лимиты и лотерея сбросов

На август 2026 лимиты недельные, и сжечь их можно часа за три плотной работы. А дальше начинается странное: их периодически сбрасывают вне расписания. С одной стороны приятно — к вечеру ты снова в игре. С другой, опираться на это нельзя: выжигаешь недельный запас в понедельник и надеешься, что вернут. Никаких гарантий, а значит и никакой дисциплины. Мне так пару раз ломало рабочий день, и это обиднее любого бенчмарка.

Claude: день, неделя, месяц

Здесь лимиты разложены по горизонтам: дневной, недельный, месячный. Скучно — и отлично. Ты заранее видишь, сколько ещё можешь потратить сегодня, и не лезешь в тяжёлый рефакторинг за час до того, как всё кончится. Сбросы тоже бывают — обычно когда выходит новая модель или был сбой, — но это бонус, а не способ выжить.

Второй рычаг — выбор модели. Sonnet спокойно тянет рутину: правки, тесты, мелкие фичи, разбор чужого кода. Opus включаешь там, где реально сложно. Такой сплит экономит бюджет лучше, чем любые пляски с промптами.

Cursor: те же деньги, работы меньше

Тут твои 20 долларов — это пул запросов к чужим моделям по ценам API, то есть заведомо дороже, чем у самих вендоров. За те же деньги реальной работы выходит на порядок меньше. Composer при этом ощущается почти бесконечным, но он слишком слабый, чтобы тащить серьёзные задачи в одиночку.

Схема, которая работает: сильной моделью делаешь постановку и план — что меняем, где границы, как проверяем. Механику отдаёшь Composer: переименовать по проекту, растащить файл, дописать тесты по образцу, пройтись по однотипным местам. И дифф читаешь сам, обязательно: Composer сдаётся раньше, чем об этом говорит, и спокойно отдаёт незаконченное как готовое.

Продуктовая мысль: лимит — это не ограничение, а единица планирования дня. Когда бюджет предсказуемый, ты режешь задачи на куски, которые точно влезут в один заход. Когда нет — планирование превращается в ставку.

Вывод по пункту: здесь однозначно Claude.

Как они решают задачи

Codex

Sol невероятно крут в аналитике продукта, в сложных разборах и в планах. Дай ему мутное «почему у нас разъезжается воронка регистрации» — он разложит гипотезы лучше многих живых коллег. Тексты тоже пишет нормальные.

Минуса ровно два, и оба неприятные. Первый — вёрстка: получается шаблонный нейрослоп, который проще переписать, чем править. Второй — он может в какой-то момент уйти от заданного вопроса и по дороге поправить смежную область, которую его не просили трогать; контроль теряется. Лечится узкой постановкой: перечислить файлы и прямо запретить всё остальное.

Claude

Главное — он делает ровно то, что ты попросил. Sonnet в пятой версии очень прокачали: закрывает процентов восемьдесят рутины и дневных задач, мне прям зашло. Opus достаю, когда задача реально комплексная. С Fable я прикола не понял: сильных отличий от Opus не заметил, и думаю, что большинство разработчиков, как и я, в повседневных задачах разницы тоже не увидят. Разве что в цене.

Cursor

Пользовался им около года и страдал изо дня в день. Спотыкаешься о каждый чих, постоянно думаешь про контекст сторонних моделей, и в итоге думаешь не о задаче, а о том, как не сожрать весь бюджет за один день. Отсюда и ошибки: экономишь ровно там, где надо было дать агенту прочитать ещё три файла. Composer сам по себе мне нравился, но в 2026-м я бы вообще не рассматривал его как ежедневную модель.

Что реально уравнивает модели: пиши задачу как тикет. Цель, границы («не трогай публичный API и стили») и критерий готовности («тесты формы зелёные, в конце список изменённых файлов»). С такой формулировкой даже средняя модель попадает в цель, а сильная перестаёт растекаться.

Пример постановки, которая работает везде

«Исправь повторную отправку формы регистрации. Меняй только файлы формы и её хук. Не трогай публичный API и стили. Добавь регрессионный тест, прогони тесты формы и в конце перечисли, что изменил».

Клиенты: терминал, IDE, десктоп и облако

Модель — половина впечатления. Вторая половина — где ты с ней разговариваешь.

Claude Code

Начинался в терминале и в терминале до сих пор лучше всего: git, логи, тесты, поиск по файлам — всё рядом, без переключения окон. Но называть его только CLI уже неправда: есть расширение для IDE, десктоп и работа в браузере. Десктоп удобен, когда параллельно идут две-три сессии по разным задачам — их видно списком, а не вкладками терминала.

Codex

Живёт в CLI, в расширении для IDE и в приложении. Приятно, что задачу можно поставить с телефона и вернуться к результату позже. Мне зашло использовать его не как руки, а как голову: разбор и план прошу в приложении, а делаю уже в другом месте.

Cursor

Сама IDE честно приятная, и это её сильная сторона. Форк VS Code, все привычки и расширения переезжают за пять минут. Tab-автодополнение до сих пор лучшее на рынке: угадывает не следующее слово, а следующую правку, вместе с соседними строками. Inline-правка выделенного куска и чекпоинты тоже сделаны хорошо. Если бы я платил Cursor только за редактор — вопросов бы не было. Но за агента там платишь отдельно и дороже.

Облако и асинхронные режимы

У всех троих сейчас есть режим «поставил задачу и ушёл»: работа идёт не на твоей машине, а результат приходит пулл-реквестом. Плюсы понятные — ноут свободен, задачи идут параллельно, а постановка сама собой превращается в тикет.

  • Плюс: параллельность — две-три независимые задачи едут, пока ты занят своей.
  • Плюс: дисциплина — в облако не крикнешь «сделай нормально», приходится формулировать.
  • Минус: окружение не твоё. Нет доступа к внутренним сервисам и секретам, а тесты надо отдельно учить запускаться.
  • Минус: нет быстрой обратной связи. Что агент пошёл не туда, узнаёшь через двадцать минут, а не через двадцать секунд.
  • Минус: красиво оформленный PR легко принять на веру. Его надо смотреть строже, чем локальный дифф, а хочется наоборот.

Я делаю так: в облако уходит изолированное и с нормальными тестами, а всё, что трогает продукт, делаю локально.

Что вокруг: фичи, которыми я почти не пользуюсь

У всех троих накопился слой всего: субагенты, хуки на события, наборы правил и скиллов, задачи по расписанию, артефакты и генерация страниц, встроенный веб-поиск. Скажу честно — я почти ничем из этого не пользуюсь.

Прижилось ровно две вещи: MCP, потому что он подключает агента к реальным данным проекта, и пара проектных инструкций в репозитории, чтобы не повторять одно и то же в каждом запросе. Остальное включал, пробовал и выключал.

Совет: не тащи весь набор сразу. Каждая новая фича — это ещё один способ потратить контекст и ещё одно место, где что-то тихо сломается. Включай, когда уже болит конкретное место, а не потому что оно есть в списке.

Как встроить агента в работу

Чем сильнее агент, тем важнее, чтобы его работа не оставалась в истории чата. Код уезжает в git, а решение, контекст и статус — никуда. Через неделю никто, включая тебя, не вспомнит, почему поле назвали именно так и что там было с миграцией.

  1. Режь задачи по бюджету. Один заход — одна задача, которая влезает в дневной лимит.
  2. Пиши критерий готовности до старта. Не «сделай красиво», а «тесты зелёные, публичный API не изменился».
  3. Требуй след. Агент меняет статус задачи, оставляет комментарий и ссылку на PR.
  4. Необратимое оставляй себе. Деплой, миграции, удаление данных — только руками.

Если хочешь, чтобы агент сам двигал статусы и писал комментарии там, где их видит команда, подключи Kelvia по MCP. Работает со всеми тремя: агент берёт задачу с доски, двигает её по статусам и возвращает результат туда, где уже идёт работа команды.

Вывод

Claude — огонь. Предсказуемые лимиты, нормальный сплит моделей и главное — он делает то, что попросили, а не уходит чинить соседний модуль. За те же 20 долларов это самое честное количество полезной работы.

Но подписку на ChatGPT я на всякий случай держу. Во-первых, новые модели и фичи появляются там первыми, а мне важно щупать их руками, а не читать пересказы. Во-вторых, sol реально силён в продуктовой аналитике: разложить гипотезы, посчитать сценарии, собрать план. В-третьих — и это, наверное, главное — вторая модель смотрит на проект другими глазами и регулярно находит то, что первая уже приняла за данность.

Cursor — единственный, от кого я в итоге отказался. Как редактор он по-прежнему хорош, и я понимаю тех, кто платит за один только tab-автокомплит. Но как основного агента в 2026-м я бы его не брал.

Оговорки

Это личный опыт, а не бенчмарк: другой стек, другие задачи и другой стиль постановки могут дать другую картину. Всё написанное — про август 2026-го и про подписки за 20 долларов; на верхних тарифах расклад по лимитам другой.

Что каждый инструмент умеет прямо сейчас, проще свериться по докам: Cursor, Codex и Claude Code. Тарифы и лимиты меняются, так что перед покупкой проверь условия.

Если дальше по плану лендинг для продукта, пригодится «Как сделать лендинг с помощью нейросети без шаблонного дизайна».

Частые вопросы

Что взять, если подписка будет только одна?

Claude. Не потому что модели там объективно умнее всех, а потому что лимиты понятные: младшая модель тянет рутину, старшая остаётся на сложное. Рабочий день перестаёт зависеть от лотереи.

Правда, что Codex умнее в сложных задачах?

В аналитике, разборах и планах — часто да. Но недельные лимиты уходят за несколько вечеров, а в коде он любит починить соседнюю область, которую его не просили трогать.

Стоит ли брать Cursor в 2026-м?

Как редактор — да, автодополнение и inline-правки там всё ещё приятные. Как основного агента за те же 20 долларов — нет: ты платишь посреднику за чужие модели.

Что делать, если лимиты кончились посреди задачи?

Не ждать сброса, а переложить состояние в задачу: что сделано, что осталось, какие файлы трогал. Дальше добить рутину на младшей модели или руками.

Как безопасно дать агенту доступ к проекту?

Минимум прав, никаких секретов в контексте, ревью команд и диффа. Необратимое — деплой, миграции, удаление данных — оставляй себе.