
OpenCode Go: лимиты DeepSeek V4 Flash и Pro
Да, доступ к DeepSeek V4 через OpenCode Go стал заметно уже. Но базовые потолки подписки — $12 на 5 часов, $30 в неделю и $60 в месяц — не менялись. Изменились цены токенов DeepSeek и эффективная квота конкретных моделей: у V4 Flash месячный Usage снизился с $60 до нынешних $30, а у…

Да, доступ к DeepSeek V4 через OpenCode Go стал заметно уже. Но базовые потолки подписки — $12 на 5 часов, $30 в неделю и $60 в месяц — не менялись. Изменились цены токенов DeepSeek и эффективная квота конкретных моделей: у V4 Flash месячный Usage снизился с $60 до нынешних $30, а у V4 Pro остался $15, но подорожавшие токены сократили расчётное число запросов примерно на 70%. Для умеренной работы Go всё ещё выгоден; при постоянной нагрузке стоит сравнить Zen, прямой API DeepSeek и шлюзы, а для повседневных задач — сначала попробовать другую модель внутри уже оплаченного Go.
Цифры ниже проверены 6 сентября 2026 года. Здесь важно смотреть не только на рекламные «запросы», но и на стоимость входа, чтения кэша и выхода: именно этот состав определяет, когда агент упрётся в лимит.
Что именно изменилось
16 августа DeepSeek объявил новую тарификацию семейства V4. Она начала действовать в 16:00 UTC: в будни появились дорогие пиковые интервалы 01:00–04:00 и 06:00–10:00 UTC, а остальные часы, включая выходные, стали непиковыми. В тот же момент OpenCode пересчитал таблицу Go. Это видно не по скриншоту из соцсетей, а по официальному коммиту OpenCode с точными старыми и новыми строками.
Ещё одна деталь: накануне OpenCode завершил явно помеченную временную акцию 2× для Flash. Она давала 63 300 запросов на 5 часов. Сравнивать нынешние условия с этой промоцифрой некорректно, поэтому в таблице ниже исходной точкой служит обычный уровень 31 650.
| Модель | До 16 августа: 5 ч / неделя / месяц | Сразу после пересчёта | На 6 сентября 2026 | Модельный Usage: было → стало |
|---|---|---|---|---|
| DeepSeek V4 Flash | 31 650 / 79 050 / 158 150 | 3 800 / 9 450 / 18 900 | 7 600 / 18 900 / 37 800 | $60 → $15 → $30 |
| DeepSeek V4 Pro | 3 450 / 8 550 / 17 150 | 1 050 / 2 600 / 5 200 | 1 050 / 2 600 / 5 200 | $15 → $15 |
Flash сначала потерял 75% долларовой квоты, но через 26 часов 53 минуты OpenCode сделал частичный откат: поднял Usage с $15 до $30 и удвоил оценки запросов. От обычного уровня до изменения всё равно осталось примерно на 76% меньше запросов. У Pro dollar cap не урезали: он и раньше составлял $15. Его расчётный объём упал примерно на 69,6% из-за новой цены самого инференса.
Почему $60 в рекламе не означает $60 для любой модели
В текущей таблице OpenCode Go есть два уровня ограничений:
- общие потолки тарифа: $12 на 5 часов, $30 в неделю и $60 в месяц;
- столбец Usage для каждой модели: $15, $30, $60 или другое значение.
Если у модели Usage $60, ей доступен полный набор $12/$30/$60. Для Flash с Usage $30 эффективный набор масштабируется примерно до $6/$15/$30. Для Pro с Usage $15 — до $3/$7,50/$15. Опубликованные оценки запросов точно сходятся с этой арифметикой при непиковых ставках.
Один «типичный» Flash-запрос OpenCode считает как 410 обычных входных, 71 300 кэшированных входных и 310 выходных токенов. В непиковое время такой запрос стоит около $0,000794. Поэтому $6 хватает примерно на 7 600 запросов. В пиковое время цена удваивается — при том же профиле получится около 3 800 запросов, а не 7 600.
Числа в колонке requests — ориентир, а не гарантированная пачка сообщений. Длинный вывод, неудачное кэширование, высокий reasoning effort, повторы после ошибок и большие tool results расходуют квоту быстрее.
Почему лимиты пересчитали
DeepSeek ввёл новые цены одновременно с выпуском GA-версии DeepSeek V4 Pro. Непиковые ставки Flash теперь составляют $0,007 за миллион кэшированных входных токенов, $0,22 за обычный вход и $0,66 за выход. В пик они удваиваются. Для Pro это $0,022/$0,66/$1,98 вне пика и $0,044/$1,32/$3,96 в пик. Читать полный обзор сервиса DeepSeek
Рост цены кэшированного входа особенно важен для кодинг-агента. На каждом шаге он повторно передаёт системные инструкции, карту репозитория и историю сессии. У прежнего Flash cache read стоил $0,0028 за миллион токенов; теперь даже непиковая ставка в 2,5 раза выше, а пиковая — в 5 раз.
OpenCode объясняет модельные коэффициенты стоимостью провайдера, оптовыми скидками и зарезервированной GPU-мощностью. Вероятнее всего, квоту Flash уменьшили, чтобы фиксированная подписка за $10 не несла непредсказуемые расходы после повышения апстрим-цены. Это вывод из совпавших времени и арифметики. У нас нет внутренних контрактов OpenCode с DeepSeek, поэтому утверждать точную маржу или финансовое состояние компании нельзя.
Применили ли новые условия к действующим подписчикам
Публичного правила о сохранении старой квоты до следующего платежа не найдено. OpenCode обновил общую таблицу и график Console без отдельного описания для новых и старых аккаунтов. Действующие пользователи в GitHub и Reddit писали, что увидели новые значения, но их отчёты не доказывают одинаковое поведение всех аккаунтов.
Условия OpenCode позволяют менять сервис и вводить ограничения, а страница Go прямо предупреждает, что usage limits могут меняться. Это не отвечает на вопрос, в какую минуту пересчитали конкретный уже оплаченный аккаунт и восстановили ли остаток квоты. Проверить свой случай можно только по Console и ответу поддержки.
Есть и отдельная проблема учёта. В GitHub issue пользователь показал, что проценты пятичасового, недельного и месячного окон не сходились с видимой историей расходов. Общего подтверждённого диагноза у этого отчёта нет. Если цифры расходятся, сохраните снимки всех трёх счётчиков, reset timers, строки usage history и UTC-время запросов — одного месячного процента недостаточно.
Стоит ли сначала остаться в Go
Если подписка уже оплачена, разумный первый шаг — не переносить весь стек, а прогнать собственные задачи на других моделях Go. Сейчас выгоднее всего выглядят не обязательно самые сильные модели, а те, у которых сохранён Usage $60 и дешёвое чтение кэша.
| Модель в Go | Оценка запросов: 5 ч / неделя / месяц | Usage | Input / output / cache read, $ за 1 млн | Когда пробовать |
|---|---|---|---|---|
| MiMo-V2.5 | 30 100 / 75 200 / 150 400 | $60 | 0,14 / 0,28 / 0,0028 | короткие и средние повседневные задачи с большим числом шагов |
| MiniMax M3 | 3 200 / 8 000 / 16 000 | $60 | 0,30 / 1,20 / 0,06 | мультимодальные и более сложные задачи, если расход Flash стал непредсказуемым |
| Kimi K2.7 Code | 1 350 / 3 380 / 6 750 | $60 | 0,95 / 4,00 / 0,19 | длинные многофайловые правки и агентный кодинг |
| GLM-5.3-Flash | 1 580 / 3 950 / 7 900 | $15 | 0,15 / 0,50 / 0,03 | быстрый запасной вариант; текущая акция 2× временная |
| DeepSeek V4 Flash | 7 600 / 18 900 / 37 800 | $30 | 0,22 / 0,66 / 0,007 вне пика | когда Flash уже проходит ваши тесты и основная работа идёт вне пика |
| DeepSeek V4 Pro | 1 050 / 2 600 / 5 200 | $15 | 0,66 / 1,98 / 0,022 вне пика | сложные задачи, где качество снижает число повторов и ручных исправлений |
У всех перечисленных моделей в таблице Go стоит «не используется для обучения» и retention 0 дней. Для DeepSeek это помечено звёздочкой: соглашение Zero Data Retention продлевается ежемесячно и на момент проверки действует до 30 сентября 2026 года.
Не включайте автоматический переход на более дорогую модель, пока не проверили конфигурацию агента. В GitHub есть свежий пользовательский отчёт, где fallback якобы съел около четверти квоты Go. Сам отчёт не доказывает баг OpenCode, но показывает практический риск: model ID и fallback policy должны быть явными.
Куда переходить с OpenCode Go
Универсального победителя нет. Подписка лучше поглощает редкие всплески, PAYG — лёгкую и предсказуемую нагрузку, gateway — смену провайдеров, local — требования к данным и офлайн-работе.
| Вариант | Текущая цена или лимит | Протокол | Данные и условия | Для кого подходит |
|---|---|---|---|---|
| OpenCode Zen PAYG | Flash: $0,14 input, $0,28 output, $0,028 cache read; Pro: $1,74/$3,48/$0,145 | OpenAI-compatible | модели хостятся в США; заявлены ZDR и no-training, кроме перечисленных исключений; есть spend limit и auto-reload | нужна та же интеграция без окон Go |
| DeepSeek direct | Flash: $0,22/$0,66/$0,007 вне пика, вдвое дороже в пик; Pro втрое дороже Flash | OpenAI, Anthropic, Responses | first-party checkpoint; публичная privacy policy допускает использование input для улучшения технологий и обработку в КНР | нужен прямой доступ, высокая concurrency и перенос нагрузки вне пика |
| OpenRouter | у Flash 0731 на момент проверки есть маршрут от $0,04998 input и $0,09996 output; цена зависит от endpoint | OpenAI-compatible, есть Responses и Anthropic routes | OpenRouter сам не обучается на запросах; политика апстрима различается, можно требовать ZDR и запрет data collection | нужен один ключ, fallback и контроль провайдера |
| Z.AI GLM-5.3-Flash | промо: $0,075 input, $0,25 output, $0,015 cache read | OpenAI Chat Completions-compatible | акция ограничена по времени без указанной на pricing page даты; для API действует отдельный DPA | много свежего input и нужен дешёвый быстрый кодинг |
| Kimi K2.7 Code direct | $0,95 input, $4 output, $0,19 cache hit; контекст 256K | OpenAI и Anthropic | PAYG; публичная model page не даёт обещания 0-day retention, договор надо проверять отдельно | качество Kimi оправдывает более дорогой output |
| MiniMax M2.7 direct | $0,30 input, $1,20 output, $0,06 cache read, $0,375 cache write | OpenAI/Anthropic-совместимые интеграции зависят от endpoint | PAYG; условия хранения нужно сверять для выбранного региона | нужен недорогой стабильный запасной маршрут |
| Ollama Cloud | Flash $0,22/$0,66/$0,007; Pro $0,66/$1,98/$0,022; Pro-план $20/мес включает $60 credits | Ollama API, OpenAI-compatible endpoint | prompts/responses не логируются и не идут в обучение; :cloud выполняется удалённо |
нужен привычный Ollama UX без собственного GPU |
| Локальные веса | платы за токены нет; стоимость — сервер, память, электричество и сопровождение | vLLM, SGLang и совместимые серверы | код и промпты остаются в вашей инфраструктуре | есть multi-GPU и жёсткие требования к приватности/offline |
Zen PAYG: самый простой переход
OpenCode Zen удобен тем, что сохраняет знакомый API и список моделей. Можно задать месячный лимит workspace или пользователя. Но включённый auto-reload при остатке ниже $5 способен пополнить баланс на $20, даже если расход уже близок к установленному месячному пределу. К пополнению также прибавляется комиссия карты 4,4% + $0,30. Читать полный обзор сервиса OpenCode
Zen не всегда дешевле прямого DeepSeek. У Flash в Zen обычный input и output недорогие, зато cache read по $0,028 заметно дороже прямого непикового $0,007. Для сессии с огромной повторяемой историей это меняет итог сильнее, чем цена нового входа.
Прямой DeepSeek: прозрачно, но с часовым тарифом
Прямой API даёт актуальные alias deepseek-v4-flash и deepseek-v4-pro, контекст 1 млн токенов и максимальный output 384K. Текущая таблица цен DeepSeek также публикует concurrency: 2 500 для Flash и 500 для Pro.
Главная оптимизация — расписание. В Бангкоке пиковые окна DeepSeek приходятся на 08:00–11:00 и 13:00–17:00 по будням; в Москве — на 04:00–07:00 и 09:00–13:00. Batch, ночные тесты и автономные задачи выгоднее запускать вне этих интервалов.
Для закрытого репозитория прямой путь требует отдельной проверки договора. Общая privacy policy DeepSeek говорит об обработке данных в КНР и включает пользовательский ввод в данные, которые могут использоваться для улучшения технологий. Нулевое хранение, заявленное OpenCode Go, нельзя автоматически переносить на прямой аккаунт DeepSeek.
OpenRouter: выгодный маршрут нужно зафиксировать
На странице DeepSeek V4 Flash 0731 в OpenRouter самый дешёвый отображаемый маршрут на момент проверки стоил $0,04998 за миллион input и $0,09996 за output. Это снимок динамического рынка, а не фиксированный тариф модели навсегда.
Для воспроизводимости укажите версию модели, разрешённого провайдера и предельную цену. Если важны данные, задайте data_collection: "deny" и zdr: true. Если оставить автоматический fallback без ограничений, могут измениться цена, скорость, квантизация и политика хранения.
Kimi, GLM и MiniMax: менять модель, а не только кассу
Z.AI временно продаёт GLM-5.3-Flash со скидкой 50%: $0,075 за новый input, $0,015 за cache read и $0,25 за output. Это самый дешёвый из рассмотренных прямых маршрутов для нагрузки без требования остаться на DeepSeek, но акция может закончиться.
Kimi K2.7 Code дороже: $0,95/$4/$0,19. Его имеет смысл выбирать, когда он заметно чаще завершает сложную правку с первой попытки. Модель kimi-k2.5 уже снята 31 августа 2026 года, поэтому старый ID нельзя закладывать в новую миграцию.
MiniMax M2.7 стоит $0,30 за input, $1,20 за output и $0,06 за cache read. Это спокойный бюджетный fallback. Для MiniMax M3 цена зависит от длины контекста и региона, поэтому переносить одну красивую цифру из сравнительных блогов опасно.
Ollama Cloud и настоящий локальный запуск
Запись deepseek-v4-flash:cloud в Ollama не запускает модель на вашем компьютере. Она отправляет запрос в облако Ollama. Ollama публикует те же непиковые ставки DeepSeek, но собственный пик обозначает как 12:00–18:00 UTC по будням — при миграции расписание нужно пересчитать заново.
Настоящие локальные веса доступны по MIT License. Но DeepSeek V4 Flash содержит 284 млрд параметров, из которых 13 млрд активируются на токен; Pro — 1,6 трлн и 49 млрд активных. Даже смешанный FP4+FP8 формат требует серьёзной многопроцессорной инфраструктуры. Для ноутбука Ollama Cloud реалистичнее, но это уже удалённый сервис, а не локальная приватность.
Сколько это стоит на реальной нагрузке
Рассмотрим 1 000 запросов с профилем, который OpenCode использует для оценки Flash: 0,41 млн нового input, 71,3 млн cache read и 0,31 млн output суммарно.
| Маршрут | Стоимость 1 000 типичных запросов |
|---|---|
| Go или DeepSeek direct вне пика | около $0,79 из квоты/баланса |
| Go или DeepSeek direct в пик | около $1,59 |
| Zen PAYG | около $2,14 |
| Ollama Cloud | около $0,79 вне его пика и $1,59 в пик |
Теперь другой профиль: 10 млн полностью нового input и 2 млн output без попаданий в кэш.
| Маршрут | Расчётная стоимость |
|---|---|
| OpenRouter Flash 0731, самый дешёвый видимый endpoint | около $0,70 |
| Z.AI GLM-5.3-Flash по текущей акции | $1,25 |
| Zen DeepSeek V4 Flash | $1,96 |
| DeepSeek direct вне пика | $3,52 |
| MiniMax M2.7 | $5,40 |
| DeepSeek direct в пик | $7,04 |
| Kimi K2.7 Code | $17,50 |
Эти суммы сравнивают токены, но не результат. Если дешёвая модель трижды повторяет неудачную правку, она может проиграть более дорогой модели по стоимости принятого pull request.
Как воспроизвести сравнение на своём репозитории
Не тестируйте провайдеров одним вопросом «напиши функцию». Подготовьте один commit и 20–30 задач из настоящего backlog:
- короткие исправления с готовыми тестами;
- многофайловый рефакторинг;
- задачи с длинной историей и большим контекстом;
- агентные задачи с терминалом, поиском и tool calls.
Для каждого маршрута зафиксируйте model ID, версию, reasoning effort, temperature, max output, набор инструментов и concurrency=1. Запускайте каждую задачу из чистой worktree. Первый прогон делайте с холодным кэшем, второй — с тёплым. DeepSeek повторите в peak и off-peak.
В журнал запишите:
- UTC-время, provider и model ID;
- обычные, кэшированные и выходные токены;
- цену, которую вернул провайдер;
- число retries, 429 и 5xx;
- время до завершения;
- прошедшие тесты;
- минуты ручной доработки.
Сравнивайте стоимость принятой задачи: (API-расход + стоимость времени ревью) / число принятых результатов. Для важных задач сделайте минимум три повтора — ответы моделей недетерминированы.
Вывод
OpenCode Go действительно стал менее щедрым для DeepSeek V4. У Flash актуальный месячный Usage вдвое ниже прежнего непromo-уровня, а расчётных запросов осталось примерно 24%. У Pro квота $15 не менялась, но новая цена сократила число запросов примерно на 70%. При этом общие $12/$30/$60 остались на месте, поэтому заголовок тарифа без модельного столбца Usage вводит в заблуждение.
Если вы уже платите за Go, сначала переключите часть задач на MiMo-V2.5, MiniMax M3 или Kimi K2.7 Code и отключите неожиданный fallback. Для лёгкой PAYG-нагрузки проверьте Zen и OpenRouter, для first-party checkpoint и больших параллельных задач — прямой DeepSeek вне пика. Ollama Cloud удобен, но не заменяет локальный запуск; настоящие веса V4 требуют серьёзного железа. Сравнить альтернативы для таких coding-сценариев можно в обзоре ИИ-сервисов для программирования.
Главное решение стоит принимать по собственному журналу токенов, повторов и принятых правок. После августовского пересчёта число «запросов» без профиля кэша и времени запуска почти ничего не обещает.
Автор статьи

Редактор и автор статей
Пишет экспертные материалы о цифровом маркетинге и автоматизации. Журналист с опытом в деловых медиа, отвечает за качество и достоверность публикаций.
Вопросы и ответы
Нет, эти базовые потолки сохранились. Уменьшились эффективные квоты DeepSeek: Flash сейчас имеет Usage $30, Pro — $15. Поэтому они получают только часть общего долларового потолка.
Это оценка для определённого состава токенов и непиковой цены. В пиковые часы тот же запрос стоит вдвое дороже. Длинный output, слабый cache hit rate и retries также уменьшают фактическое число.
Официальная история перед августовским пересчётом уже показывает $15 для Pro. Изменилось число запросов: примерно с 17 150 до 5 200 в месяц, потому что подорожали input, output и особенно cache read.
У прямого DeepSeek и в таблице Go пик — 01:00–04:00 и 06:00–10:00 UTC с понедельника по пятницу. Всё остальное, включая выходные, считается off-peak. У других посредников окна могут отличаться: Ollama Cloud публикует пик 12:00–18:00 UTC по будням.
Можно продолжить на бесплатных моделях. Если на Zen-балансе есть деньги и в Console включён Use balance, запросы перейдут на PAYG. Проверьте auto-reload и spend limit, чтобы переход не создал неожиданное списание.
Сравните все три счётчика и reset timers в Console с usage history. Публичного обещания сохранить старую квоту до следующего платежа нет. При расхождении сохраните UTC-время, модель и суммы и обратитесь в поддержку.
Нет. В GitHub пользователи получали ответы о V3.x и от Go, и от официального API DeepSeek. Самоидентификация модели ненадёжна. Проверяйте model ID, зафиксированный provider/version и серверные метаданные, а качество — воспроизводимым набором задач.
Теги deepseek-v4-flash:cloud и deepseek-v4-pro:cloud выполняются в облаке Ollama. Для настоящего local нужны скачанные веса и собственный inference server. V4 Flash и особенно Pro слишком велики для обычного ноутбука.
Собственный локальный inference даёт максимальный контроль. Среди облачных маршрутов выбирайте документированный Zero Data Retention и подходящий договор обработки данных. Не переносите обещание ZDR из OpenCode Go на прямой DeepSeek или случайный endpoint шлюза без отдельной проверки.
Смотрите также

Где дешевле DeepSeek V4 Flash и V4 Pro — API, подписки и альтернативы
26 сентября 2026 г.

GPT-5.3-Codex-Spark: что это за модель, где использовать и какие есть аналоги
26 сентября 2026 г.

Что такое Cursor CLI: как использовать и сравнение с конкурентами
25 сентября 2026 г.

Роутинг MCP и плагинов в ChatGPT/Codex, Claude Code, Cursor и Antigravity
25 сентября 2026 г.
Комментарии(0)
Оставьте комментарий
Войдите, чтобы присоединиться к обсуждению