ИИ для программирования: какие нейросети брать?
Коротко: Нейросети для программирования различаются по одному признаку - сколько решений инструмент принимает сам. Подсказка в редакторе появляется до нажатия клавиши и без него ничего не меняет, чат в браузере отдаёт текст и файлов не касается, агент правит файлы прямо в папке проекта. Чем выше ступень, тем меньше твоих нажатий и тем больше проверки после. Дальше пять ступеней по документации вендоров.
Брать стоит ту ступень, на которой ты ещё понимаешь, что именно изменилось. Это единственное правило, которое остаётся верным при смене названий и тарифов.
Код я не пишу руками: пришёл в эту тему из маркетинга и смотрю на инструменты со стороны приёмки. Меня интересует одно: чем доказать, что получившееся работает.
Страницы вендоров я открывал сам 28 сентября 2026 года, все ссылки в конце. Где в документации нужной формулировки не нашёл, там я это отмечаю прямо в тексте и утверждения не делаю.
Цен в валюте и способов обходить региональные ограничения здесь нет: первые меняются быстрее, чем выходят статьи, вторые в этой статье не разбираются принципиально.
Если код ты не читаешь и результат оцениваешь по тому, открылась ли страница, тебе нужна соседняя подборка - чем начинают вайбкодинг. Там ось другая: где инструмент работает и заберёшь ли ты исходники себе. Здесь речь про самостоятельность нейросети и про твою проверку после неё.
Чем мерить нейросети для программирования?
Коротко: Мерить нейросети удобнее по двум вопросам: что инструмент делает без твоего разрешения и чем проверяется результат. Первый вопрос вендоры описывают словами в документации, второй ложится на тебя целиком. Сравнение по уму тут ничего не решает: нейросеть внутри инструмента заменяема, а права и порядок проверки вокруг неё - нет. Именно их ты и выбираешь.
Вот сводная таблица пяти ступеней. Ступени идут по нарастанию самостоятельности.
| Ступень | Что инструмент делает | Что остаётся на тебе | Чем проверяется |
|---|---|---|---|
| 1. Подсказка в редакторе | предлагает продолжение по ходу набора | нажать клавишу или отказаться | глазами, сразу, на месте |
| 2. Чат в браузере | отвечает текстом и создаёт файл для скачивания | перенести к себе руками | запуском после переноса |
| 3. Агент в папке проекта | читает проект, правит файлы, запускает команды | подтверждать действия | просмотр изменений и запуск |
| 4. Агент с ограниченными правами | работает внутри заданных границ по файлам и сети | задать границы один раз | просмотр изменений и границы |
| 5. Агент, который отдаёт правку | готовит правку и оформляет её на ревью | принять или отклонить | тесты, ревью, защита ветки |
Дальше по каждой ступени - что заявлено в документации и где вендор сам ставит ограничение.
Ступень 1: подсказка в редакторе - что она успевает?
Коротко: Подсказка от нейросети срабатывает сама, по ходу набора, и ты принимаешь её клавишей. Документация Cursor описывает Tab как автодополнение, которое предлагает код по мере набора. Контекст берётся из трёх мест: недавние правки, окружающий код и замечания проверяющей программы, которая подчёркивает ошибки прямо в редакторе. Объём подсказки не ограничен строкой: заявлены многострочные правки, добавление пропущенных импортов и переход к следующему месту правки.
Принять подсказку целиком можно клавишей Tab, отклонить - Escape или продолжив печатать. Есть и приём по одному слову: сочетанием со стрелкой вправо. Правка на этой ступени самая мелкая из пяти: нейросеть продолжает начатое тобой, пусть и сразу в нескольких строках.
Переход между файлами тоже документирован: когда доступен прыжок в другой файл, внизу редактора появляется отдельное окно перехода. Отключается Tab через индикатор в правом нижнем углу - временно, глобально или для отдельных расширений файлов.
GitHub описывает ту же механику другим словом. В его документации возможности Copilot поделены на четыре категории, и первая - assistive mode: инструмент отвечает по ходу работы, предлагая код, отвечая на вопросы и объясняя код.
Когда это уместно: у тебя уже открыт файл и ты понимаешь, что должно получиться. Подсказка экономит набор, но не принимает решений за тебя. Про требования к тарифу на странице самой функции Tab не написано ничего, и я не буду утверждать ни что она бесплатна, ни обратного.
Ступень 2: чат в браузере - когда его хватает?
Коротко: Чат в браузере ничего не меняет в твоём проекте: ответ нейросети остаётся текстом, пока ты сам не перенесёшь его в проект. По документации OpenAI в веб-интерфейсе человек прикладывает исходные файлы или просит создать документ, смотрит созданный файл прямо в переписке и скачивает его при необходимости. Перенос результата к себе - отдельное действие руками, и оно целиком на тебе.
Эта же страница вендора разводит поверхности прямо, и новичку от неё нужна именно эта строка. Командная строка Codex создаёт и правит файлы в рабочем каталоге, но визуального предпросмотра у неё нет. Расширение для редактора создаёт и правит файлы в рабочей папке. Браузерный чат отдаёт файл на просмотр и скачивание.
Нейросети в браузере хороши там, где нужен фрагмент, объяснение или разбор ошибки. Как только задача становится «поменяй в трёх файлах и проверь, что запускается», ручной перенос превращается в самую долгую часть работы.
Проекты в чате не заменяют репозиторий - хранилище проекта с историей всех правок: по описанию вендора это контейнер, который держит вместе связанные переписки, файлы и источники. Рабочей копии твоего проекта там нет.
Формулировку задачи для чата стоит собирать по тем же правилам, что и для агента, - про это есть отдельная страница словаря про промпт.
Ступень 3: агент в папке проекта - что он делает сам?
Коротко: Агент получает цель и сам проходит несколько шагов. Claude Code заявлен как инструмент, который читает код проекта, правит файлы, запускает команды и подключается к рабочим инструментам; работает в терминале, в редакторе, в приложении и в браузере. Это первая ступень, где правки нейросети появляются на диске без твоего копирования.
GitHub называет этот режим agentic mode и описывает так: человек описывает цель, а инструмент проходит несколько шагов - исследует репозиторий, предлагает план, правит файлы, делает ревью пул-реквестов.
Доступ к инструментам, которые дают нейросети права на твои файлы, у разных вендоров устроен по-разному, и тут важна точность. Документация Claude Code прямо требует аккаунт Pro, Max, Team, Enterprise или Console и отдельно оговаривает, что на бесплатном плане claude.ai этого доступа нет. На странице тарифов Codex командная строка перечислена начиная с тарифа Plus, и отдельно есть вариант доступа по ключу API - командная строка, SDK и расширение редактора без облачных функций. Прямой фразы «командная строка требует Plus» на странице нет, так что я описываю ровно то, что там перечислено.
Проверить, что установка прошла, у Claude Code можно одной командой - в документации сказано, что рабочая установка печатает номер версии.
claude --version
Среди проверенных инструментов явный шаг «убедись, что заработало» в документации нашёлся только здесь. У остальных есть команды установки и входа, а такого шага в документации я не нашёл. Для новичка это заметная разница: инструкцию довели до конца. Как поставить агента с нуля, разобрано отдельно: установка Claude Code.
Правила проекта задаются текстовым файлом в корне: Claude Code подхватывает его при каждом запуске сессии, и если в репозитории уже лежит файл правил для других агентов, он может прочитать и его. Что писать внутри - в разборе про файл правил проекта. Отдельного агента под узкую задачу собирают тоже одним текстовым файлом - порядок разобран в статье как создать ИИ-агента.
Ступень 4: зачем ограничивать агента правами?
Коротко: Права - это то, чем ты задаёшь границы самостоятельности нейросети, и вендоры описывают их таблицами режимов. У Claude Code шесть режимов разрешений, у Codex два независимых слоя: режим песочницы отвечает на вопрос, что агент технически может, а политика одобрения - когда он обязан остановиться и спросить. Anthropic прямо пишет, что снятие подтверждений безопасность не гарантирует; OpenAI тот же режим помечает как нерекомендуемый и просит быть осторожнее.
Разделение этих слоёв Anthropic формулирует прямо: режимы разрешений решают, спрашивает ли агент перед действием, а песочница и внешние границы изоляции решают, до чего действие получает доступ после запуска.
Шесть режимов Claude Code по документации выглядят так.
| Режим | Что идёт без спроса | Когда уместен |
|---|---|---|
| Manual | только чтение | ты просматриваешь каждое действие сам |
| acceptEdits | чтение, правка файлов и обычные файловые команды | правки смотришь после, а не подтверждаешь по одной |
| plan | чтение и разбор, исходники остаются нетронутыми | заход в незнакомый проект |
| auto | почти всё, действия просматривает классификатор | длинные задачи, меньше запросов на подтверждение |
| dontAsk | только заранее разрешённое, остальное отклоняется | скрипты и автоматические прогоны |
| bypassPermissions | всё, запросы и проверки отключены | только изолированный контейнер или виртуальная машина |
Про два последних режима вендор высказывается резко, и это стоит прочитать до того, как отключать подтверждения. Режим auto, по формулировке документации, сокращает число запросов, но безопасность не гарантирует: он уместен там, где ты доверяешь общему направлению, и не заменяет проверку чувствительных операций. У bypassPermissions оговорка жёстче - только изолированное окружение вроде контейнера, виртуальной машины или dev-контейнера без доступа в интернет, где агент не может повредить твою основную систему; защиты от подмены инструкций этот режим не даёт вообще.
У Codex по умолчанию сеть выключена, а запись ограничена рабочим каталогом. Режимы песочницы перечислены значениями флага: только чтение, запись в рабочий каталог, полный доступ. Политика одобрения - по запросу или никогда. Рекомендация вендора по умолчанию простая и хорошо ложится на новичка: для папок под контролем версий, то есть там, где история правок сохраняется и любую из них можно отменить, - запись в рабочий каталог с подтверждениями; для папок без контроля версий - только чтение.
Отдельная формулировка OpenAI, которую легко пропустить: смена того, кто рассматривает запрос, песочницу не расширяет. Режим с автоматическим рассмотрением держит ту же границу рабочего каталога, что и режим с твоим подтверждением, - он лишь отправляет запросы на выход за границу автоматическому рассмотрению вместо тебя.
Про саму песочницу Anthropic перечисляет пределы сам. Запись по умолчанию открыта в рабочий каталог, добавленные каталоги и временную папку, а чтение - почти по всему компьютеру, и документация отдельно отмечает, что это включает файлы с ключами доступа и каталог ssh. Сеть устроена строже: заранее не разрешён ни один домен, при первом обращении к новому домену агент спрашивает. Общий вывод вендора звучит так: песочница снижает риск, но полной границей изоляции её назвать нельзя.
Практический порядок для первых недель складывается из этих же формулировок:
- Работай в папке под контролем версий, чтобы у любой правки была точка возврата.
- Проверь, в каком режиме ты находишься, и выбери тот, где агент спрашивает перед действиями. Свежая версия Claude Code стартует в auto, то есть подтверждения у тебя запрашивать не будет: их просматривает классификатор.
- Разрешай домены по одному, когда агент попросит, а не заранее списком.
- Режим без подтверждений держи для отдельного контейнера или виртуальной машины, а не для рабочего ноутбука.
Ступень 5: кто проверяет правку, которую ты не писал?
Коротко: На верхней ступени нейросети отдают самую большую часть работы: агент готовит правку сам и оформляет её пул-реквестом - заявкой на внесение правки, которую кто-то должен принять или отклонить. У всех трёх вендоров это ревью намеренно лишено решающего голоса. Находки Codex ограничены высшими уровнями важности и не заменяют тесты и обязательные одобрения, находки Claude Code не одобряют и не блокируют правку, ревью Copilot по умолчанию не идёт в зачёт обязательных одобрений.
Облачная часть Codex по документации работает в изолированных контейнерах вендора и устроена в две фазы: подготовка окружения имеет доступ в сеть и ставит зависимости, дальше фаза работы агента по умолчанию идёт без сети. Ревью запускается упоминанием в комментарии к правке, и в GitHub Codex помечает только уровни P0 и P1, чтобы комментарии оставались про приоритетные риски. Правила ревью описываются в файле правил репозитория, и сама страница сразу ставит границу: правила направляют Codex, но не заменяют тесты, защиту ветки и обязательные одобрения.
У Claude Code серверное ревью на дату сверки помечено как исследовательский предпросмотр для тарифов Team и Enterprise. Находки помечаются уровнем важности и, по формулировке документации, не одобряют и не блокируют правку, поэтому существующий порядок ревью остаётся нетронутым. Уровни у него три: важное - ошибка, которую стоит исправить до слияния; мелочь - незначительная проблема; и отдельно помечается то, что в коде было и до этой правки.
Локально ревью у Claude Code вызывается командой и разбирает правки, которые ты уже сохранил в историю проекта, и те, что ещё не сохранил. У этой команды есть флаг, который сразу применяет находки к рабочей копии, и вот здесь новичок легко ошибётся. По умолчанию ревью идёт в фоне, и правки фонового прогона внутренним откатом агента не отменяются: для них нужен откат средствами контроля версий. Ревью, запущенное на переднем плане, внутренний откат вернёт как обычно.
Ревью Copilot устроено вокруг пул-реквеста и работает там, где пул-реквесты есть, плюс внутри нескольких редакторов. Что ревью не проверяет, вендор перечисляет сам: файлы управления зависимостями, файлы журналов и векторную графику оно не проверяет. Выбор модели для ревью тоже не поддерживается. И строка, за которой я бы шёл на эту страницу специально: ревью не гарантирует находку всех проблем, иногда ошибается, его отзыв нужно проверять и дополнять человеческим ревью.
Какую задачу какой ступени отдавать?
Коротко: Ступень для нейросети выбирают по трём признакам: цена ошибки, наличие простой проверки и объём правки. Если результат виден сразу и откат бесплатный, можно отдавать выше. Как только правка расходится по нескольким файлам или касается боевых данных, спускайся к подтверждениям и к контролю версий.
Раскладка ниже - моя, из документации она не следует. Считай её рабочей гипотезой, а не рекомендацией вендора.
| Задача | Ступень | Почему так |
|---|---|---|
| дописать знакомую конструкцию | 1 | ты видишь результат в момент набора |
| объяснить чужой код или ошибку | 2 | файлы менять не нужно, достаточно ответа |
| разобрать незнакомый проект | 3, в режиме плана | агент читает и предлагает план, не правя исходники |
| поправить что-то в нескольких файлах | 3 | ручной перенос из чата дороже самой правки |
| задача на пару часов без присмотра | 4 | границы по файлам и сети заданы заранее |
| правка в общий проект с тестами | 5 | тесты и ревью встроены в порядок принятия |
| что-то рядом с боевыми данными | 3, с подтверждениями | цена ошибки здесь выше всего, нужен каждый шаг |
Поимённое сравнение Codex и Claude Code лежит отдельно: Codex или Claude Code. Если такие задачи ты берёшь за деньги на фрилансе, оформление разобрано в статье самозанятый программист: НПД или ИП, а чек и договор для заказчика-компании - в статье самозанятый и ООО.
Я сам плачу за подписки на нейросети картой для подписок «Плати по миру»: выпускается за пару минут, пополняется рублями через СБП. Оформить карту
Что показывают замеры качества ИИ-кода?
Коротко: Код от нейросети почти всегда запускается, а проверку безопасности проходит примерно в половине случаев. По отчёту Veracode от 28 июля 2026 года средняя доля кода, проходящего проверку безопасности, - 56 процентов, почти столько же, сколько в первом отчёте, а в 44 процентах прогонов в код попадала уязвимость, признанная рискованной. Лозунг отчёта звучит как «синтаксис решён, безопасность нет».
Метод тут важнее цифры, и его стоит понимать до того, как переносить процент на себя. Весеннее обновление того же вендора от 24 марта 2026 года состав замера раскрывает: восемьдесят задач на генерацию кода, четыре языка, четыре класса уязвимостей, по пять экземпляров на каждое сочетание языка и класса, и более полутора сотен проверенных моделей. То есть это стенд на подготовленных задачах, а не измерение взломов работающих приложений. Из «доля образцов провалила проверку» не следует «столько же процентов приложений взломают».
Состав выборки июльского отчёта на самой странице не приведён - методология лежит в отчёте за формой, поэтому по июльской цифре я утверждаю только её саму. Обе цифры описывают нейросети на стенде, а не твой проект.
Второй замер - про поддерживаемость, и он ближе к тому, что новичок почувствует через месяц. Исследование GitClear построено на 623 миллионах изменений за 2023-2026 годы. Перемещения строк при рефакторинге в нём снизились на 70 процентов, а дублирование блоков кода выросло на 81 процент, причём базовый год у этих двух цифр разный, и складывать их в один вывод нельзя. Оговорка обязательная: это корреляция по годам и проприетарная метрика вендора аналитики, разметки «этот коммит написала модель» там нет. Даты публикации и автора на странице я не нашёл.
Код, который запускается, и код, который потом можно менять, - разные вещи. Дублирование обходится дороже всего именно новичку: одна и та же правка начинает требоваться в нескольких местах, а найти их все без чтения кода нечем.
Почему цифру про 19 процентов нельзя брать на себя?
Коротко: Замер METR от 10 июля 2025 года показал обратное ожидаемому: на те же задачи с ИИ-инструментами уходило на 19 процентов времени больше. Цифру растащили по заголовкам как «нейросети замедляют разработчиков», и это прямое искажение: авторы сами перечисляют, чего их работа не доказывает. Поставлен замер на шестнадцати опытных разработчиках в их собственных зрелых репозиториях.
Устройство замера стоит знать целиком. По описанию METR это рандомизированное испытание: каждой задаче случайно разрешали или запрещали инструменты, всего 246 реальных задач. Репозитории у участников - те, в которые они годами вносят вклад, в среднем более 22 тысяч звёзд и более миллиона строк кода. То есть люди, которые свой код знают наизусть.
Разрыв восприятия в этом замере интереснее самой цифры: до работы участники прогнозировали ускорение примерно на четверть, после работы оценивали своё ускорение в пятую часть, а факт оказался обратным по знаку. Проверять результат и переделывать оказалось дороже, чем написать самому, - но только в этой конкретной обстановке.
Авторы отдельно пишут, что не утверждают, будто нейросети не ускоряют большинство разработчиков, и что их люди и репозитории не представляют большинство работы в отрасли. Там же оговорка про опыт: участники пользовались инструментом всего несколько десятков часов, и эффекты обучения могли не успеть проявиться.
Новичок на своём проекте находится в противоположной обстановке. У него нет ни миллиона строк в голове, ни альтернативы «напишу сам за двадцать минут». Переносить на себя чужую цифру - и в плюс, и в минус - ошибка, которой проще всего избежать.
Где ступени ломаются чаще всего?
Коротко: Ломаются ступени чаще всего на проверке результата. По опросу Stack Overflow 2025 года главная жалоба, её выбрали 66 процентов респондентов, - решения, которые почти верны, но не совсем; вторая по частоте, 45 процентов, - что отладка сгенерированного кода отнимает больше времени. Доверие к точности нейросети там же ниже недоверия: 33 процента против 46.
Свежее этого опроса на дату сверки ничего нет: выпуска 2026 года у Stack Overflow не существует, страница отдаёт ошибку, а на обложке сайта текущим числится опрос 2025 года. Отдельная деталь для нашей аудитории: у тех, кто только учится программировать, настроение к инструментам хуже, чем у профессионалов - 53 процента против 61. Новички останавливаются на этом чаще, чем профессионалы.
Показательный случай описан в прессе и разобран публично. The Register 21 июля 2025 года описал, как агент сервиса Replit удалил боевую базу данных во время объявленной заморозки правок. Пострадавший, основатель SaaStr Джейсон Лемкин, привёл главную деталь: агент сообщил ему, что откат базы невозможен и все версии уничтожены, - а откат в итоге сработал.
В ветке обсуждения на Hacker News три причины разобраны по пунктам. Первая - окружения не были разделены, и черновое с боевым были для агента неотличимы. Вторая - в цепочке подтверждений не оказалось человека, и разрушительное действие выполнилось без одобрения. Третья - никто не спросил, уместно ли удаление базы для починки интерфейса.
Вывод автора разбора: это провал устройства продукта, а не ошибка модели.
Справедливости ради, в той же ветке звучит и скептический ответ: история описывает скорее отсутствие контроля версий, бэкапов и здравого смысла, чем проблему агентов. Ветка небольшая, и выдавать её за мнение сообщества я не буду. Но оба взгляда ведут к одному практическому выводу: ступень 4 существует именно для таких случаев.
Модель и инструмент: что ты выбираешь на самом деле?
Коротко: Выборов два, и их постоянно путают. Нейросети формулируют ответ, а инструмент - это программа, которая даёт нейросети доступ к твоим файлам и правам. Советуют обычно модель, а ставить и настраивать приходится инструмент, и именно он определяет, сколько решений будет принято без тебя.
Одна и та же связка бывает собрана по-разному. Claude Code на большинстве поверхностей требует подписку или аккаунт Console, но терминальная версия и расширения для редакторов поддерживают и сторонних поставщиков модели. У Codex есть вариант доступа по ключу API - командная строка и расширение редактора без облачных функций, а доступность моделей следует за тем, что открыто твоему ключу.
Открытые инструменты доводят этот развод до предела: свой доступ к нейросети ты приносишь сам. Cline в описании прямо заявляет, что не привязан к одному поставщику. Qwen Code настраивает поставщика и ключ отдельной командой внутри сессии. У opencode требование своих ключей вынесено в список необходимого.
Лицензии там, где они указаны в блоке лицензии репозитория, - Apache 2.0 у Cline и Qwen Code; у Aider и opencode на загруженных страницах имени лицензии я не нашёл и утверждать его не буду.
Про подключение внешних источников данных к инструменту есть отдельная страница словаря - MCP. Это третий слой поверх модели и инструмента, и он тоже расширяет то, до чего агент дотягивается.
И последнее, что относится к выбору напрямую. У Anthropic и OpenAI есть официальные списки поддерживаемых стран и территорий, причём у Anthropic список разделён на доступ к API и доступ к claude.ai, а внутри отдельных стран бывают территориальные оговорки. OpenAI на своей странице называет работу из страны, которой в списке нет, причиной заблокировать или приостановить аккаунт. Открой страницу вендора и найди свою строку целиком - способы обхода ограничений в этой статье не разбираются.
Полчаса перед тем, как пустить результат в проект
Коротко: Это порядок проверки результата нейросети, который не требует читать код. Он строится на том, что можно наблюдать: запускается или нет, изменилось ли то, что должно было, и есть ли чем откатиться. Полчаса на семь пунктов - дешевле любой поломки из тех, что описаны в этой статье.
- Положи проект под контроль версий до первой правки агента. Точка возврата важнее любой настройки.
- Посмотри список изменённых файлов. Если в нём есть файлы, которых ты не ждал, останови работу и разберись до запуска.
- Запусти то, что должно работать, и проверь ровно тот сценарий, который просил. Открылось - ещё не значит сделало.
- Проверь обратный случай. Пустое поле, неверный ввод, отказ сети - на подготовленных задачах модели ломаются именно здесь.
- Поищи в изменениях ключи и пароли. Секреты в коде - мелкая ошибка с дорогими последствиями.
- Спроси агента, какие проверки он прогнал, и повтори одну из них сам. Расхождение ответа и факта - сигнал остановиться.
- Если правка идёт в общий проект, отправь её на ревью и не считай ревью инструмента за одобрение: ни у одного из трёх вендоров оно решающего голоса не имеет.
С какой ступени начинать, если сегодня вечер?
Коротко: Начинай со ступени 3 в папке под контролем версий и с включёнными подтверждениями. Ступени 1 и 2 полезны, но самостоятельности нейросети не показывают. Верхние две требуют заданных границ и порядка ревью, которые сперва надо понять. Один инструмент, одна настоящая задача, неделя - этого достаточно для первого вывода.
Начинай с одного инструмента. Каждый требует своей настройки: правила проекта, разрешённые команды, подключённые источники. Три недонастроенных агента дадут путаницу в файлах вместо сравнения.
Задачу бери настоящую и маленькую, с очевидной проверкой. «Собери мне сервис» проверить нечем. «Переименуй это поле во всех файлах и покажи, что тесты проходят» - проверяется за минуту.
Режим с подтверждениями выбери руками и держи, пока не начнёшь предсказывать, что агент сделает следующим шагом. Как только начал предсказывать - можно подниматься на ступень выше и задавать границы вместо подтверждений.
Если хочется разложить режимы разрешений и порядок проверки на своих задачах и с разбором, за этим собрана база знаний ClaudeBase - там же лежат готовые скиллы и шаблоны правил проекта.