Сколько стоит DeepSeek Harness за день, нельзя определить по числу часов: сначала посчитайте токены, кэш, повторы, занятость Mac и время инженера, а затем задайте дневной лимит с автоматической остановкой. Для короткой проверки считайте стоимость одной завершённой задачи; для повторяемого процесса — расход за день; для непрерывного Agent — бюджет, порог ошибок и условие остановки.

Эта инструкция предназначена для трёх групп:

  • независимых разработчиков, которым нужно оценить один длинный запуск;
  • руководителей AI Agent, готовящих бюджет командного пилота;
  • технических менеджеров, сравнивающих собственный Mac, краткосрочное удалённое окружение и постоянно выделенный узел.

Last updated: 18 августа 2026 года. Цены и ограничения сверены с официальными материалами DeepSeek, указанными в статье. Данные о потреблении ресурсов DeepSeek Harness и времени сопровождения должны подтверждаться собственным журналом.

01

Базовая единица расчёта — не час, а завершённая задача

Для DeepSeek Harness полезно вести четыре независимых измерения:

  • одна задача от первого запроса до принятого результата;
  • фиксированный дневной пакет задач;
  • интерактивная разработка, где инженер постоянно меняет контекст;
  • непрерывный Agent, который сам создаёт подзадачи, вызывает инструменты и повторяет шаги.

У этих режимов разная экономика. При интерактивной разработке часть токенов уходит на уточнения. В пакетной обработке важнее число объектов и доля ошибок. В непрерывном Agent основной риск — неконтролируемый цикл действий, когда «одна задача» превращается в серию дополнительных запросов.

До запуска зафиксируйте два условия:

  1. Условие завершения — например, тесты прошли, файл создан, отчёт проверен или все элементы очереди обработаны.
  2. Условие прерывания — лимит времени, лимит токенов, повторная ошибка инструмента, превышение бюджета или отсутствие прогресса.

Без этих условий показатель «работал весь день» не сравним. Один запуск мог закончить работу за десять минут, а другой — часами повторять неудачный шаг.

Минимальная формула выглядит так:

Полная стоимость дня = API + среда Mac + хранение и резервные копии + ручное сопровождение + стоимость неудачных запусков.

API нельзя свести к одной строке. Для каждой задачи отдельно сохраняйте:

  • входные токены;
  • входные токены с попаданием в кэш;
  • входные токены без попадания в кэш;
  • выходные токены;
  • число попыток;
  • число вызовов инструментов;
  • время работы окружения;
  • время инженера.

Официальная документация DeepSeek указывает, что токены являются базовой единицей расчёта, а статистика использования возвращается в поле usage. Там же доступны значения prompt_cache_hit_tokens, prompt_cache_miss_tokens, completion_tokens и total_tokens — именно их следует выгружать в журнал. Описание Token Usage в документации DeepSeek и формат поля usage в API подтверждают эту схему.

02

API-расход — вход, выход и кэш

На 18 августа 2026 года официальная страница DeepSeek указывает расчёт за 1 000 000 токенов. Для deepseek-v4-flash вход с попаданием в кэш стоит 0,0028 доллара, вход без попадания — 0,14 доллара, выход — 0,28 доллара. Для deepseek-v4-pro соответствующие значения составляют 0,003625, 0,435 и 0,87 доллара. Цены могут изменяться, поэтому перед оплатой их нужно проверить повторно. Актуальная страница моделей и цен DeepSeek.

Формула для одной модели:

API = (вход с попаданием × цена cache hit) + (вход без попадания × цена cache miss) + (выход × цена output).

Все объёмы в этой формуле выражаются в миллионах токенов.

Для дневного бюджета сложите формулы всех запросов. Не умножайте среднюю стоимость первого запроса на количество часов: у Agent меняются длина истории, состав инструментов и доля повторно используемого префикса.

Кэш помогает только тогда, когда запрос действительно повторяет сохранённый префикс. DeepSeek сообщает, что контекстное кэширование включено по умолчанию, но работает по принципу best effort и не гарантирует стопроцентное попадание. Полное совпадение с сохранённым префиксом имеет значение; небольшое изменение системной инструкции, порядка инструментов или начала сообщения может превратить ожидаемый hit в miss. Правила Context Caching в документации DeepSeek.

Практический вывод для Harness:

  • стабильную системную инструкцию держите в начале запроса;
  • неизменяемую документацию проекта располагайте до переменной части;
  • текущую задачу, вывод тестов и временные данные добавляйте после постоянного префикса;
  • не рассчитывайте на кэш для постоянно меняющегося полного лога;
  • в журнале храните hit и miss отдельно.

Официальная документация также отмечает, что построение кэша может занимать секунды, а неиспользуемые записи обычно очищаются через несколько часов или дней. Поэтому кэш нельзя использовать как постоянное хранилище состояния Agent.

03

V4 Pro и V4 Flash — цена запроса против цены результата

Выбор между DeepSeek V4 Pro и DeepSeek V4 Flash нельзя делать только по цене миллиона токенов. Сравнивать нужно минимум четыре показателя:

  • стоимость входных и выходных токенов;
  • среднюю длину ответа;
  • число повторных попыток;
  • долю задач, принятых без ручного исправления.

DeepSeek указывает для обеих моделей контекст длиной 1 000 000 токенов и максимальный объём вывода 384 000 токенов. Обе модели поддерживают вызовы инструментов и режимы thinking и non-thinking. Эти параметры не означают, что каждый запуск должен использовать такой объём: длинный контекст увеличивает потенциальный расход, а не делает его обязательным. Официальные характеристики V4 Pro и V4 Flash.

Выбирайте V4 Flash, если:

  • задачи повторяются по понятному шаблону;
  • основной объём — классификация, преобразование файлов, простые исправления и массовая обработка;
  • результат легко проверить автоматическими тестами;
  • важны большой параллелизм и короткая задержка;
  • повторная попытка не требует участия инженера.

Оставляйте V4 Pro, если:

  • Agent строит длинный план и меняет несколько частей проекта;
  • ошибка в первом решении вызывает дорогую цепочку повторов;
  • тесты не покрывают критические сценарии;
  • результат проверяется человеком;
  • переход на Flash увеличивает число неуспешных завершений.

Полезный показатель — стоимость эффективного завершения:

API-расход всех попыток ÷ число задач, принятых без ручной доработки.

Если V4 Flash дешевле на уровне запроса, но даёт больше повторов, итоговая стоимость завершённой задачи может сравняться с V4 Pro. Это нужно проверять на реальном наборе задач, а не на одном демонстрационном запросе.

04

Параллелизм и повторы — скрытая часть счёта

У DeepSeek для аккаунта указаны разные ограничения конкурентных соединений: 500 для deepseek-v4-pro и 2 500 для deepseek-v4-flash. Запрос считается занятым от отправки до полного ответа; превышение ограничения приводит к HTTP 429. Лимит рассчитывается на уровне аккаунта, а не отдельного API-ключа. Официальные ограничения параллелизма и изоляции.

Это не означает, что увеличение параллелизма пропорционально ускорит день. Очередь может упереться в:

  • ограничение аккаунта;
  • пропускную способность диска;
  • число доступных рабочих каталогов;
  • блокировки в системе контроля версий;
  • лимиты внешних инструментов;
  • последовательные этапы тестирования;
  • ручное подтверждение опасных операций.

Записывайте отдельно:

  • число созданных подзадач;
  • максимальное и среднее число одновременных запросов;
  • HTTP 429;
  • HTTP 500 и 503;
  • тайм-ауты;
  • повтор после ошибки инструмента;
  • повтор, инициированный инженером.

В документации DeepSeek указано, что 429 означает превышение темпа запросов, а 500 и 503 требуют повторной попытки после короткой паузы. Справочник кодов ошибок DeepSeek. Для бюджета это означает: повторный запрос нельзя считать «бесплатной технической деталью». Он снова расходует вход, выход и время окружения.

Одна из частых ошибок — поставить большой уровень параллелизма и считать все ответы полезной производительностью. Если половина задач ждёт блокировку, повторяется или откатывается после конфликта, фактическая цена принятого результата растёт.

05

Mac-среда — занятость, а не только аренда

Вычислительные ресурсы Mac следует считать по способу использования, а не по названию устройства. Для бюджета применяйте четыре сценария.

Собственный уже купленный Mac. Прямой платёж может быть нулевым, но остаётся альтернативная стоимость. Устройство занято процессом, не может использоваться для сборки другого проекта, а бесперебойная работа требует питания, сети, свободного диска и контроля доступа.

Краткосрочная удалённая среда. Это удобный вариант для пилота, ночного запуска или проверки совместимости. В расчёт входят время запуска, период фактической занятости, остановка после завершения и возможное повторное поднятие окружения.

Постоянно сохранённый узел. Он оправдан при стабильной ежедневной загрузке. Если Agent работает несколько часов, а окружение оплачивается весь период сохранения, простаивающее время становится отдельной статьёй.

Общий Mac для нескольких разработчиков. Здесь нужно учитывать очереди, конфликты доступа, разные версии зависимостей и стоимость ожидания. Низкая цена устройства не компенсирует потерю времени, если один процесс блокирует общий рабочий каталог.

В стоимость среды включите:

  • запуск и выключение;
  • установку зависимостей;
  • место под репозитории и артефакты;
  • журналы запросов и действий;
  • резервные копии;
  • восстановление после зависания;
  • управление SSH или удалённым рабочим столом;
  • права доступа к секретам;
  • проверку состояния после перезапуска.

Цену аренды нельзя подставлять «по рынку», если она не подтверждена страницей конкретного предложения. Внутренний шаблон должен оставаться пустым до выбора региона и режима:

  • период занятости: ___;
  • сохранение окружения: ___;
  • хранилище: ___;
  • резервная копия: ___;
  • восстановление: ___;
  • итог по Mac-среде: ___.

Если требуется удалённый Mac только для проверки, сначала сопоставьте график с вариантами оформления аренды Mac mini в MESHLAUNCH. Для сравнения регионов используйте русскую главную страницу MESHLAUNCH, но подставляйте в бюджет только условия выбранного предложения, а не среднюю цену из сторонних обсуждений.

Напоминание: DeepSeek Harness может использовать API как основной источник вычислений, но Mac остаётся рабочей средой для файлов, инструментов, тестов, журналов и восстановления. Нулевая загрузка процессора не означает нулевую стоимость окружения.

06

Ручное сопровождение — отдельный бюджет

Открытый или предварительный инструмент не равен инструменту без обслуживания. Для длительного Agent зафиксируйте время на:

  • первоначальную установку;
  • обновление Harness;
  • обновление библиотек;
  • исправление несовместимости;
  • настройку разрешений;
  • ротацию API-ключей;
  • проверку журналов;
  • ручное завершение зависшего процесса;
  • восстановление после сбоя;
  • проверку результата;
  • откат неудачного изменения.

Для каждого инцидента записывайте не только минуты исправления, но и потерянные токены. Если Agent несколько раз заново читает большой контекст после сбоя, ручной инцидент становится одновременно расходом API и расходом времени инженера.

Разделите обслуживание на две категории:

  • плановое — установка, обновления, резервные копии;
  • неплановое — зависание, неверный вызов инструмента, повреждённое окружение, ручной откат.

В период разработки и предварительного просмотра заложите отдельное окно регрессионной проверки после обновлений. Конкретное время нельзя честно назвать заранее: оно зависит от числа инструментов, тестов и разрешений в проекте. Его нужно измерить на собственном процессе.

07

Чек-лист перед первым дневным запуском

  • [ ] Определено условие завершения задачи.
  • [ ] Определено условие автоматической остановки.
  • [ ] Включена запись prompt_tokens, completion_tokens и общего расхода.
  • [ ] cache hit и cache miss записываются раздельно.
  • [ ] Каждая дочерняя задача получает собственный идентификатор.
  • [ ] Повторы после 429, 500, 503 и ошибок инструментов видны в журнале.
  • [ ] Ограничен максимальный бюджет API на день.
  • [ ] Ограничена длина истории или установлен режим сжатия контекста.
  • [ ] Mac имеет свободное место под журналы и артефакты.
  • [ ] Секреты не записываются в общий лог.
  • [ ] Есть процедура остановки и ручного восстановления.
  • [ ] После завершения проверяется не только ответ модели, но и фактический результат тестов.
08

Условия для выбора следующего шага

Используйте эти ветки после небольшого пилота на реальных задачах:

  • Если стоимость принятой задачи укладывается в лимит, доля повторов стабильна, а ручное вмешательство редко требуется, оставляйте текущую модель и увеличивайте объём постепенно.
  • Если задачи простые, контекст повторяется, а проверка автоматизирована, переносите их на V4 Flash.
  • Если после перехода на V4 Flash растёт число исправлений, повторов и ручных откатов, возвращайте V4 Pro для сложных этапов, а Flash оставляйте для подготовки данных и массовых подзадач.
  • Если дневной расход растёт из-за длинной истории, сокращайте контекст и разделяйте задачу на этапы, а не просто снижайте стоимость одного миллиона токенов.
  • Если большая часть времени уходит на ожидание или обслуживание Mac, меняйте период сохранения окружения или график запуска.
  • Если доля ручной передачи управления становится выше заранее установленного порога, приостанавливайте непрерывный режим и переводите процесс в пакетный.
  • Если повторяемая задача стабильно выполняется по расписанию, сравнивайте постоянный узел с краткосрочной арендой по фактической загрузке, а не по цене одного часа.

Для автоматической остановки задайте минимум три порога: дневной API-бюджет, максимальное число повторов одной подзадачи и максимальное время без подтверждённого прогресса. Точные значения выбираются по журналу, поскольку официальные ограничения API не описывают внутреннее поведение конкретного Harness.

09

Что считать итогом дня

В конце каждого запуска собирайте один короткий отчёт:

  • количество завершённых задач;
  • общее число входных токенов;
  • cache hit и cache miss;
  • выходные токены;
  • число запросов и повторов;
  • ошибки по кодам;
  • время занятости Mac;
  • время инженера;
  • число задач, принятых без ручной доработки;
  • полная стоимость по всем статьям.

Затем рассчитывайте не только «стоимость за день», но и:

Стоимость эффективного завершения = все расходы дня ÷ количество принятых результатов.

Именно этот показатель пригоден для решения о масштабировании. Если задач выполнено больше, но выросли повторы, ручная проверка и простой окружения, дневной результат может быть дороже.

Если текущая схема строится на постоянно включённом собственном Mac, её слабые места обычно проявляются в трёх точках: устройство занято даже во время ожидания, восстановление после зависания требует человека, а расходы на хранение и резервные копии остаются незаметными до первого сбоя. Краткосрочная аренда Mac не отменяет API-расход, но позволяет отделить экспериментальную загрузку от постоянного владения оборудованием. Поэтому после заполнения бюджета сравните фактическую загрузку с условиями удалённого Mac-окружения MESHLAUNCH: для пилота и нерегулярных запусков это может быть аккуратнее, чем держать собственный узел включённым круглосуточно. Начните с малого набора задач, зафиксируйте реальные токены и только затем выбирайте между краткосрочным запуском и постоянно сохранённой средой.