АИШНО МЕДИА
← АИШНО Медиа

Claude или DeepSeek для программирования: как сравнить на одном баге

Воспроизводимый протокол сравнения Claude и DeepSeek: одинаковый контекст, регрессионная проверка, ограничения доступа и цена принятого исправления.

Редакция АИШНО · 2026-09-06 · 4 минут
Иллюстрация к статье: Claude или DeepSeek для программирования: как сравнить на одном баге
Авторская AI-иллюстрация АИШНО. Персонажи и сценки вымышлены.

Баг у Аишника очень воспитанный: проявляется только после оплаты. В вымышленной истории взрослый разработчик небольшого магазина просит два AI-инструмента разобраться с повторным списанием заказа. Один ответ выглядит как выступление архитектора, другой — как записка человека, который уже нашёл отвёртку. Аишник тянется выбрать того, кто написал увереннее. Тут из соседнего окна приходит сообщение клиента: «Почему два заказа?» Клиент, как выяснилось, не оценивает литературные достоинства объяснения. Он вообще не подписывался на конкурс языковых моделей. Поэтому сравнивать Claude и DeepSeek для кода стоит по исправленному поведению программы, а красоту ответа оставить для корпоративной стенгазеты.

КОРОТКО

Сравнивайте конкретные модели в одинаковом окружении на воспроизводимой ошибке. Claude Code предоставляет инструменты работы с проектом; DeepSeek можно подключать через API к совместимым агентным инструментам. Нельзя честно объявить модель победителем, если одной дали репозиторий и терминал, а другой — обрезанный фрагмент.

Модель и рабочий инструмент — разные участники

В документации Claude Code описаны чтение проекта, изменение файлов и запуск команд. Это свойства среды работы, а не доказательство, что любая модель Claude исправляет любой баг лучше конкурента. Обзор Claude Code.

DeepSeek описывает API и подключение к агентным инструментам. Поэтому сравнение «агент Claude против текста в чате DeepSeek» проверяет сразу несколько различий: модель, доступный контекст, инструменты и ваши ручные действия. Документация DeepSeek.

Сначала решите, что выбираете. Если готовое рабочее место, сравнивайте процесс целиком. Если модель для собственной системы, держите одинаковыми инструменты и набор файлов. Это как сравнивать поваров: либо оба готовят на одной кухне, либо вы честно оцениваете рестораны вместе с официантами и парковкой.

Сформулируйте баг до знакомства с советчиком

Подготовьте минимальное описание: действие пользователя, ожидаемый результат, фактический результат и условия повторения. Для учебного примера с повторным запросом зафиксируйте требование: повтор одной и той же операции не должен создавать второй заказ. Реальную платёжную систему для эксперимента не подключайте; используйте изолированную копию с тестовыми данными.

Добавьте версии языка и зависимостей, относящийся к ошибке код и уже существующие проверки. Секреты, токены и данные клиентов удалите. Обоим участникам передайте одинаковое задание и ограничения: какие файлы можно менять, допустимы ли новые зависимости, какие команды разрешены. Иначе победит тот, кому вы разрешили снести полдома.

Разбери воспроизводимую ошибку по приложенным файлам. Сначала назови проверяемую причину и способ подтвердить её. Предложи минимальное исправление без новых зависимостей. Добавь проверку, которая выявляет старую ошибку, и объясни ограничения решения. Не утверждай, что команды выполнены, если у тебя нет результатов запуска.

Зелёный тест ещё надо прочитать

Хорошая проверка демонстрирует дефект до исправления и перестаёт его показывать после. Если тест одинаково зелёный на обеих версиях, он не доказывает устранение именно этой ошибки. Посмотрите, проверяет ли он поведение, нужное пользователю, или просто повторяет детали написанного решения.

Затем проверьте соседний сценарий. В примере с заказами это может быть новая операция с другим идентификатором и повтор запроса после частичного сбоя. Не нужно превращать маленькое сравнение в сертификацию всей платформы, но очевидная граница задачи должна присутствовать. Результат, работающий только в нарисованном моделью мире, в реальный магазин пока не принимается.

Отдельно прочитайте изменения. Не удалена ли проверка доступа ради прохождения теста? Не заменена ли ошибка молчаливым возвратом успеха? Не появилась ли зависимость, существование которой никто не подтвердил? Быстрое исправление иногда просто переселяет проблему в соседний кабинет.

Считайте принятые изменения, не скорость печати

Записывайте время до принятого исправления, число ручных уточнений, затронутые файлы и обнаруженные побочные эффекты. Стоимость запросов считайте вместе с повторными попытками. При этом один баг даёт информацию об одном типе работы. Он не устанавливает мировую иерархию интеллекта на ближайшие полгода.

Чтобы снизить случайность, повторите проверку на нескольких разных задачах из своего стека: граничное значение, ошибка обработки данных, неверное взаимодействие модулей. Сохраните не только удачный ответ, но и причины отклонения других. Тогда через месяц сможете понять, изменился инструмент или просто досталась более лёгкая задача.

Российский доступ — часть решения

Россия отсутствует в опубликованных списках поддерживаемых регионов Anthropic для Claude.ai и коммерческого API. Это нужно учитывать до выбора постоянного инструмента. Список Anthropic.

Для DeepSeek в этом материале проверена документация API, но не регистрация и оплата российского аккаунта. Не выдаём такую проверку за выполненную. Корпоративному проекту дополнительно нужен согласованный порядок передачи кода и хранения запросов, независимо от языка интерфейса и симпатий команды.

Мой вывод

Мне нужен помощник, после которого понятно, почему баг исчез. Ответ без проверяемой причины — очень уверенная записка на сломанном лифте.

Что попробовать

Опишите один уже известный баг и подготовьте проверку старого поведения. Это даст сравнению твёрдую точку отсчёта.

Частые вопросы

Кто всё-таки лучше чинит код?

По этому обзору победитель не установлен: практического прогона не было. Протокол позволяет выбрать инструмент на задачах вашей команды.

Можно ли сравнить бесплатно в чатах?

Можно сравнить качество предложений на одинаковом фрагменте. Но полученный вывод нельзя автоматически переносить на агентную работу со всем проектом.

Продолжить по теме

Источники и проверка