Track
Большинство сравнений кодовых агентов сводится к скорости, цене, количеству инструментов или бенчмаркам. Такой подход упускает главный вопрос, разделяющий эти два решения: какую часть рантайма агента разработчик может заменить?
DeepSeek Harness и Claude Code отвечают на этот вопрос на разных уровнях. Harness раскрывает адаптеры моделей, хранилище, песочницы и цикл агента как подключаемые модули. Claude Code упаковывает встроенный цикл вокруг Claude и добавляет точки расширения для рабочего процесса. Эта граница важнее, чем сравнение DeepSeek и Claude как моделей.
Я дал обоим инструментам один и тот же сломанный репозиторий и одну и ту же модель Claude, чтобы увидеть, что меняет рантайм. Одно исследование не может расставить продукты по местам, но оно показывает, почему «harness» — это не второстепенная деталь. Я сосредоточусь на различиях в выборе модели, настройке, проверке, логах и стоимости.
Итоги кратко
- Если рантайм — часть задачи: Harness раскрывает адаптер модели, хранилище, песочницу и цикл агента как взаимозаменяемые плагины, поддерживая несколько провайдеров моделей.
- Если основная работа — прикладной код: Claude Code упаковывает больше рантайма и расширяет рабочий процесс через Skills, хуки, MCP и сопутствующие возможности.
- Тест с одной и той же моделью: Оба инструмента выдали байт-в-байт идентичный патч и прошли исходный набор тестов. В этом запуске на Windows Claude Code показал 55,0 секунды; Harness — 125,4 секунды после трёх запросов на одобрение.
- Стоимость: За сам DeepSeek Harness лицензия не взимается; использование модели тарифицируется выбранным провайдером, плюс инфраструктурные издержки при наличии. Claude Code включён в платные планы Claude.
- Быстрое правило: Начинайте с Claude Code для рутинной прикладной работы. Начинайте с Harness, когда изменение или инспекция рантайма — часть задачи.
DeepSeek Harness и Claude Code: краткое сравнение
|
Аспект |
DeepSeek Harness |
Claude Code |
|---|---|---|
|
Что это |
Рантайм агента со сменными частями |
Упакованный кодовый агент |
|
Лицензия и статус |
MIT, предпросмотр для разработчиков, стабильного релиза нет |
Проприетарный, продуктивный продукт |
|
Модели |
DeepSeek, Anthropic, OpenAI, Bedrock, Vertex, Azure, локальные |
Claude, напрямую или через Bedrock и Vertex |
|
Заменяемый цикл |
Да, точка входа плагина с возможностью переопределения |
Нет, расширения подключаются вокруг него |
|
Единица расширения |
Плагин Cordis, любая возможность рантайма |
Плагин, объединяющий skills, хуки, агентов, MCP |
|
История запусков |
Добавочный типизированный лог событий, воспроизводимый |
Транскрипт JSONL, контрольные точки, OpenTelemetry |
|
Интерфейсы |
Локальный веб‑интерфейс, headless CLI, Python SDK |
Терминал, IDE, desktop, web, Slack, CI |
|
Настройка |
Требует настройки провайдера и понимания профилей |
Более простой старт по умолчанию; опционально — разрешения, хуки, MCP и конфигурация проекта |
Что такое DeepSeek Harness?
DeepSeek Harness — это агентный harness с открытым исходным кодом, сейчас в предпросмотре для разработчиков. Он предоставляет рантайм, в котором модели используют инструменты и контекст, и может запускать модели от провайдеров, отличных от DeepSeek. В README предупреждается, что обновления могут ломать существующие настройки.
Если хотите попробовать, рекомендуем начать с нашего руководства по DeepSeek Harness.
Как работает DeepSeek Harness
Цикл агента реализован как плагин. Harness использует Cordis, чтобы компоновать адаптеры моделей, инструменты, сессии, хранилище, песочницы и сам цикл.
Cordis позволяет плагинам находить сервисы и обмениваться событиями. Изменения зависимостей загружают или выгружают плагины; горячая перезагрузка очищает «застывших» слушателей и фоновые задания.
Профиль по умолчанию показывает цикл как конфигурацию. dsh --profile headless --dump-default-config включает следующую запись:
- id: agent-loop
name: '@deepseek-ai/dsh-agent-loop'
config:
agents: []
Эту запись можно заменить через cordis.patch.yml, что показывает: сам цикл не зашит жёстко.
Панель плагинов с компонентами рантайма. Видео автора.
Четыре режима рантайма
DeepSeek Harness предлагает четыре режима выполнения.
- Standard: полный режим кодового агента
- PTC/Code: объединяет несколько вызовов инструментов в одной программе на TypeScript
- Minimal: оставляет только persistent bash и str_replace_editor
- Creator: для инспекции и тестирования рантайма
DeepSeek использовал режим Minimal для своих бенчмарков.
Что такое Claude Code?
Claude Code — это проприетарный кодовый агент Anthropic и агентный harness для локального или управляемого использования через терминал, IDE, desktop, web, Slack и CI.
CLI запускается командой claude в директории проекта. Эта директория становится областью файлов по умолчанию, а сессия читает проектные инструкции из CLAUDE.md. Пользователи могут позже расширить доступ к файлам или добавить внешние сервисы.
Anthropic рассматривает эти интерфейсы как способы доступа к Claude Code. Локальные сессии работают на вашей машине. Облачные — в управляемых средах или на серверах вашей организации. Remote Control позволяет управлять локальной работой из браузера.
Лучшие точки для старта — это наши учебник по Claude Code и гайд по лучшим практикам Claude Code.
Встроенный цикл и расширения
Anthropic описывает Claude Code как агентный harness вокруг Claude, с повторяющимся циклом контекста, действия и проверки. Пользователь может управлять им во время запуска.
Claude Code хранит сессии локально и уплотняет старый контекст по мере заполнения окна. CLAUDE.md и auto memory переносят выбранные инструкции и детали проекта между сессиями. Субагенты используют отдельные окна контекста и возвращают родительской сессии сводки.
Как работает слой расширений Claude Code
Claude Code поддерживает несколько механизмов расширения. CLAUDE.md, skills, хуки, MCP, субагенты, плагины, Agent Teams и Agent SDK — всё это расширяет его рабочий процесс.
Эти расширения работают вокруг встроенного цикла Claude Code. Хуки могут навязывать правила вызова инструментов, а Agent SDK предоставляет инструменты и управление контекстом в коде.
DeepSeek Harness и Claude Code: архитектура и контроль
DeepSeek Harness раскрывает нижележащие части рантайма для замены. Claude Code сохраняет встроенный цикл фиксированным и поддерживает расширения вокруг него.
Заменяемый рантайм против упакованного агента
DeepSeek Harness рассматривает рантайм как настраиваемую инфраструктуру: адаптеры моделей, хранилище, песочницы и цикл можно заменить через записи профиля. Claude Code держит встроенный цикл фиксированным и расширяет рабочий процесс вокруг него.
DeepSeek Harness может таким образом менять провайдеров моделей или другие части рантайма. Слово «плагин» здесь тоже имеет разный охват:
- Плагины Claude Code объединяют возможности вокруг цикла.
- Плагины DeepSeek Harness могут определять части самого рантайма.
Поддержка моделей и выбор провайдера
DeepSeek Harness поддерживает больше провайдеров моделей. Он запускает DeepSeek, Anthropic, OpenAI, облачных провайдеров и совместимые локальные эндпоинты. Claude Code запускает… собственно, Claude. Иными словами, DeepSeek Harness может хостить Claude, а Claude Code — не может хостить DeepSeek.
Это и позволило мне зафиксировать модель в тестировании. Сравнение модели DeepSeek в Harness с Claude в Claude Code меняет сразу две переменные.
Выбор провайдера добавляет настройку учётных данных и эндпоинтов, включая точные ID моделей. Claude Code контролирует семейство моделей и большую часть поведения запросов.
Смена провайдера не гарантирует идентичного поведения. Модели могут поддерживать разные форматы инструментов, размеры контекста или режимы reasoning. Harness сохраняет доступной окружающую конфигурацию плагинов, но адаптер провайдера всё равно должен соответствовать выбранному эндпоинту.
Логи сессий и трассируемость запусков
DeepSeek Harness записывает подсказки, инъекции контекста, вызовы инструментов и решения по разрешениям в добавочный поток событий. Представление траектории показывает источник каждой записи и поддерживает продолжение, ветвление, поиск и воспроизведение.
Claude Code хранит транскрипты JSONL, поддерживает продолжение и ветвление и выдаёт трассы OpenTelemetry.
Оба предоставляют историю сессий, но DeepSeek Harness выводит больше пути рантайма в интерфейсе.
Представление траектории, реконструирующее полный запуск. Видео автора.
Среды выполнения и разрешения
DeepSeek Harness использует bubblewrap или Landlock в Linux, Seatbelt в macOS и токен с ограничениями ACL в Windows. Если песочница не может запуститься, Harness останавливает команду. Claude Code предлагает режимы разрешений плюс правила allow, ask и deny. В этом запуске песочница Windows повлияла на путь верификации и тайминг.
Метки доступа различаются, поэтому полностью сопоставить настройки не удалось.
-
Профили разрешений DeepSeek Harness включают
read-only,workspace-writeиdanger-full-access. -
Claude Code разделяет автоматические правки, ручное одобрение, планирование и доступ к командам по правилам. Также делает снимки файлов перед правками для отката без Git.
В текущих сессиях Pro, Max и Team в терминале и VS Code Auto mode — стартовый режим Claude Code по умолчанию. Классификатор проверяет действия в фоне. В тесте явно использовался acceptEdits, поэтому поведение разрешений отражает конфигурацию теста, а не текущий дефолт.
Это важно при сравнении количества одобрений.
Отличается и место выполнения. Harness в основном работает на машине, где запущен его веб‑интерфейс или headless‑процесс. Claude Code может работать локально, в управляемых облачных средах Anthropic или на собственной инфраструктуре. Remote Control добавляет браузерный интерфейс при локальном выполнении.
Практическое сравнение DeepSeek Harness и Claude Code
Чтобы понять, влияют ли различия рантайма на выполнение, я дал обоим инструментам один и тот же однострочный баг в TypeScript. Если вам нужен только замер времени — читайте этот раздел.
Настройка теста: одна и та же модель, репозиторий и подсказка
Я написал библиотеку для подсчёта «серии привычек» на TypeScript с одной ошибочной строкой. Она измеряла календарные дни, округляя прошедшие миллисекунды.
- Выполнение в 23:50, затем в 00:10 выглядело как тот же день.
- Выполнение в 08:00, затем в 20:00 на следующий день выглядело как пропуск дня.
Десять фиксированных тестов выявили три сбоя.
Каждый свежий клон имел установленные зависимости перед замером. Оба агента получили одинаковую инструкцию и использовали Claude Sonnet 5. Репозиторий и промпт были зафиксированы; инструменты, разрешения и поведение песочницы оставались специфичными для каждого продукта.
Конфигурации разрешений не были эквивалентны. DeepSeek Harness стартовал в workspace-write, но его песочница в Windows не смогла запуститься. Веб‑интерфейс запрашивал одобрение, и я трижды предоставил danger-full-access. Claude Code использовал accept-edits и мог выполнять через bash только тестовую команду.
Эта узкая задача использовала только локальный код и тесты. Агенты должны были найти и исправить одну ошибочную строку, затем запустить набор. Зависимости были установлены до замера, хотя Harness решил выполнить npm install ещё раз.
Результаты теста: идентичный патч, разные пути одобрений
Claude Code показал 55,0 секунды. Он запустил набор, нашёл баг, отредактировал один исходный файл и перезапустил тесты. Десять из десяти прошли.
В этом тесте на Windows DeepSeek Harness занял 125,4 секунды. Он нашёл тот же неиспользуемый daysBetween helper, внёс то же изменение и успешно запустил исходный набор.
Diff‑файлы совпали байт в байт:
-import { DAY_MS } from './dates.js';
+import { daysBetween } from './dates.js';
function gapInDays(earlier: number, later: number): number {
- return Math.round((later - earlier) / DAY_MS);
+ return daysBetween(earlier, later);
}
Путь одобрений и повторная работа в shell объясняют большую часть разницы во времени.
Почему DeepSeek Harness работал дольше на Windows
Песочница DeepSeek Harness workspace-write не смогла стартовать в Windows, поэтому веб‑интерфейс трижды запросил более широкий режим разрешений. После одобрения Harness запустил исходный набор, отредактировал src/streak.ts и запустил набор снова. Десять из десяти тестов прошли.
Этот результат ничего не говорит о Harness в Linux или macOS. Поскольку оба запуска использовали один и тот же ID модели, разница во времени не может объясняться семейством моделей. Однако различия в разрешениях и инструментах повлияли на каждый запуск.

Оба запуска достигли десяти пройденных тестов. Изображение автора.
Что изолирует тест с одной и той же моделью
Общий ID модели не сделал запросы идентичными. Каждый продукт предоставлял свой системный промпт, описания инструментов, контекст и правила разрешений. Любой из этих входов мог повлиять на следующий ответ модели.
Таким образом, такая настройка лучше фиксирует семейство моделей, чем сравнение «модель DeepSeek против Claude», но не изолирует все переменные.
Я также провёл только один замер на конфигурацию. Чтобы считать время и счётчики инструментов стабильными метриками производительности, нужны повторные запуски в случайном порядке.
DeepSeek Harness и Claude Code: стоимость, бенчмарки и пределы теста
Одно исследование на Windows не способно определить общую производительность или цены. Но оно показывает, почему детали бенчмарков важны.
Оговорка к бенчмаркам: DeepSeek использовал режим Minimal
Опубликованные результаты DeepSeek получены в режиме Minimal, а не в Standard, использованном в этом сравнении. Независимые тесты с другим harness показали более низкие результаты. Я их не воспроизводил. Показатели режима Minimal не подтверждают производительность в Standard и не измеряют Claude Code.
Стоимость: API против подписок Claude
За DeepSeek Harness лицензия не взимается, но остаются расходы на модели и инфраструктуру. У DeepSeek API ценники пикового и непикового времени. Claude Code включён в платные планы Claude. Смотрите страницу цен Anthropic перед бюджетированием.
Запуск Harness стоил около $0,11 по прайс‑листу API Anthropic. Claude Code отобразил $0,349 при использовании подписочных учётных данных. Поскольку эти цифры взяты из разных биллинговых систем, это не прямое ценовое сравнение.
Индивидуальные планы Claude стоят: Pro — $20 в месяц, Max — $100 или $200 в месяц, тогда как у DeepSeek Harness нет аналогичной подписки; счёт выставляет провайдер модели. Локальные модели убирают расходы на API, но используют ресурсы вашей машины.
Командам также стоит учесть хостинг песочниц и собственные вычисления, когда эти сервисы вне счета за модель. Эти расходы не отражаются в лицензии Harness.
Стабильность: предпросмотр для разработчиков против продакшн‑продукта
Во время тестирования Harness был на стадии release candidate. Командам стоит закреплять версии пакетов, поскольку обновления могут ломать профили или сохранённые сессии; Claude Code уже в продакшне.
Ограничения DeepSeek Harness и Claude Code
Ни одна из систем не покрывает все сценарии. Ограничения вытекают из разных частей их дизайна.
Ограничения DeepSeek Harness
Harness раскрывает больше частей рантайма, но это также оставляет больше настроек и тестов на пользователя:
-
Проект всё ещё в предпросмотре для разработчиков, обновления могут ломать профили или сохранённые сессии
-
Учётные данные провайдера, ID моделей и правила эндпоинтов требуют ручной настройки
-
Его песочница
workspace-writeв этом кейсе на Windows не стартовала и потребовала три одобренияdanger-full-access -
Текущий Python SDK не имеет колеса для Windows
Наблюдение о песочнице относится только к описанному запуску на Windows. Я не повторял тест на Linux или macOS.
В релиз‑нотах v0.1.0-rc.7 упоминаются исправление латентности persistent Bash и обновление node-pty для более широкой совместимости PTY. Это делает наблюдение и версионно‑, и Windows‑специфичным.
Ограничения Claude Code
Claude Code берёт на себя больше решений рантайма, но его фиксированные границы исключают некоторые эксперименты:
-
Он запускает модели Claude и не предоставляет путь для других семейств моделей
-
Встроенный цикл сессии не раскрыт как сменяемый компонент
-
Claude Code требует платного доступа или отдельно тарифицируемых API‑кредитов, оба с лимитами использования
-
Длинные сессии могут уплотнять старый контекст, поэтому постоянные правила стоит помещать в
CLAUDE.md
Эти ограничения важнее всего, когда задача требует другого провайдера модели или кастомного цикла.
DeepSeek Harness и Claude Code: что выбрать?
Отложите на минуту названия моделей. Ваша задача — дописать прикладной код или изменить рантайм, который выполняет работу?
Выбирайте DeepSeek Harness, если сам рантайм — предмет проекта. Он подходит для кросс‑провайдерных тестов, кастомных циклов или песочниц и задач, зависящих от детальных трасс выполнения. Его предрелизный статус означает также ответственность за версии и тестирование конфигураций.
Выбирайте Claude Code при работе с существующей кодовой базой, когда агент должен инспектировать файлы, редактировать код и запускать проверки проекта с меньшей настройкой рантайма. В этом тесте на Windows он запустил исходный набор без трёх одобрений полного доступа, которые потребовались Harness.
Используйте оба, если такой расклад отражает реальную работу. Команда может применять Claude Code для ежедневной разработки, а Harness — для экспериментов с промптами, инструментами или циклом агента.
Заключение
Оба инструмента умеют инспектировать репозиторий, редактировать файлы и выполнять команды. Их различает «владение» рантаймом: Harness раскрывает его части как плагины, тогда как Claude Code упаковывает встроенный цикл и позволяет расширять процесс вокруг него.
Если выбирать точку старта по результатам этого теста, я бы начал с Claude Code для рутинной прикладной работы. Я бы начал с Harness, когда задача — менять или инспектировать рантайм. Это одно исследование на Windows с предрелизным Harness, а не окончательный рейтинг.
Для смежных сравнений — наши материалы о Grok Build, Cursor, OpenCode, Codex и других альтернативах Claude Code.
DeepSeek Harness и Claude Code: ответы на частые вопросы
Может ли DeepSeek Harness переиспользовать проектные инструкции Claude Code?
Да. Harness читает CLAUDE.md и AGENTS.md, поэтому инструкции из репозитория могут переноситься. Claude Code Skills остаются отдельными.
Может ли DeepSeek Harness запускать Claude Code или Codex как субагента?
Да. Предрелизные сборки включают опциональные бандлы провайдеров субагентов для Claude Code и Codex. Зафиксируйте версию Harness, прежде чем полагаться на их конфигурацию.
Позволяет ли Claude Code подменить модель?
Нет, он запускает только Claude. Harness может хостить Claude, но Claude Code не может хостить DeepSeek.
Какие платформы сейчас поддерживают Python SDK DeepSeek Harness?
Текущее колесо поддерживает Linux на x64 или arm64 и последние релизы macOS arm64. Версии для Windows нет, а примерная композиция использует полный доступ к файловой системе.
Есть ли у Claude Code платформенные ограничения, как у Python SDK Harness?
Не совсем. У него нет нативной песочницы для Windows, поэтому для /sandbox в Windows нужен WSL2, но сам CLI работает на macOS, Linux и Windows.
Может ли режим Code в DeepSeek Harness запускать программы на Python?
Не с текущим бэкендом. Режим PTC (он же Code) распознаёт языки программирования, но документированный кодовый рантайм сейчас предоставляет бэкенд TypeScript.
Может ли DeepSeek Harness запускать локальные модели?
Да. Добавьте кастомного провайдера, который предоставляет совместимый с OpenAI эндпоинт, например локальный сервер Ollama или vLLM, затем зарегистрируйте ID модели в DeepSeek Harness.