WorkAI работает с моделями Anthropic, OpenAI, xAI и DeepSeek. Google Gemini есть в публичном каталоге и в прайсе ниже, но в селекторе редактора линейка не включена — платформенный биллинг Gemini не открыт. Расход списывается во внутренней валюте — WorkCoins (Ⓦ): не «за запрос» и не «за сообщение», а по фактической стоимости токенов у поставщика. В списке моделей всегда есть пункт **WorkAI Free** — открытая модель без списания Ⓦ. Эта страница отвечает на три разных вопроса, которые часто путают: 1. **Какие модели есть** и чем они отличаются. 2. **Сколько спишется с вашего баланса** — это WorkCoins. Ориентиры «N Ⓦ за типичный запрос» — на странице [моделей](/models), рублёвые тарифы и калькулятор — на [тарифах](/pricing). 3. **Какая ставка у поставщика** — публичный прайс в долларах за миллион токенов. Это те же list-price, что публикуют Cursor и GitHub Copilot. Это **не** ваш чек: в редакторе и в истории вы видите сумму в Ⓦ и долю попаданий в кэш, без счётчика токенов запроса. ## Какие модели доступны в WorkAI Каталог одинаков для всех платных тарифов: тариф задаёт только объём WorkCoins в месяц, а не набор моделей. Дорогая модель на младшем тарифе не заблокирована — она быстрее расходует баланс. Ниже — модели, для которых в документации есть отдельные карточки (ID, лимиты, для каких задач подходят), плюс DeepSeek и Gemini из публичного каталога. Полный список с ориентиром в Ⓦ за запрос — на странице [моделей](/models). Колонка «Класс» — внутренний уровень стоимости модели у этого провайдера (budget / standard / premium). Колонка «Контекст» — максимальное окно. ### Anthropic | Модель | ID | Класс | Контекст | Максимум вывода | |---|---|---|---|---| | [Sonnet 5](/docs/models/claude-sonnet-5) | `claude-sonnet-5` | standard | 1M | 128K | | [Opus 5](/docs/models/claude-opus-5) | `claude-opus-5` | premium | 1M | 128K | | [Opus 4.8](/docs/models/claude-opus-4-8) | `claude-opus-4-8` | premium | 1M | 64K | | [Fable 5](/docs/models/claude-fable-5) | `claude-fable-5` | premium | 1M | 128K | | [Haiku 4.5](/docs/models/claude-haiku-4-5) | `claude-haiku-4-5-20251001` | budget | 200K | 64K | ### OpenAI | Модель | ID | Класс | Контекст | Максимум вывода | |---|---|---|---|---| | [GPT-5.6 Sol](/docs/models/gpt-5-6-sol) | `gpt-5.6` | premium | 1M | 128K | | [GPT-5.6 Terra](/docs/models/gpt-5-6-terra) | `gpt-5.6-terra` | standard | 1M | 128K | | [GPT-5.6 Luna](/docs/models/gpt-5-6-luna) | `gpt-5.6-luna` | standard | 1M | 128K | | [GPT-5.4](/docs/models/gpt-5-4) | `gpt-5.4` | premium | 1M | 128K | | [GPT-5.3 Codex](/docs/models/gpt-5-3-codex) | `gpt-5.3-codex` | premium | 400K | 128K | | [GPT-5.4 Mini](/docs/models/gpt-5-4-mini) | `gpt-5.4-mini` | standard | 400K | 128K | | [GPT-5.4 Nano](/docs/models/gpt-5-4-nano) | `gpt-5.4-nano` | budget | 400K | 128K | | [GPT-4.1](/docs/models/gpt-4-1) | `gpt-4.1` | standard | 1M | 32K | ### xAI | Модель | ID | Класс | Контекст | Максимум вывода | |---|---|---|---|---| | [Grok 4.3](/docs/models/grok-4-3) | `grok-4.3` | standard | 1M | 32K | | [Grok 4.20 Reasoning](/docs/models/grok-4-20-reasoning) | `grok-4.20-reasoning` | standard | 1M | 32K | | [Grok 4.20 Fast](/docs/models/grok-4-20-fast) | `grok-4.20-fast` | standard | 1M | 32K | | [Grok Build 0.1](/docs/models/grok-build-0-1) | `grok-build-0.1` | budget | 256K | 32K | ### Google Gemini Отдельных карточек в `/docs/models` нет. Ориентир в Ⓦ — на странице [моделей](/models). В селекторе редактора модели Google не показываются: платформенный биллинг Gemini не включён. Ставки ниже — официальный прайс Google; по ним считается списание при работе со своим ключом. | Модель | ID | Класс | Контекст | Максимум вывода | |---|---|---|---|---| | Gemini 3.1 Pro | `gemini-3.1-pro` | premium | 2M | 64K | | Gemini 3.5 Flash | `gemini-3.5-flash` | standard | 1M | 64K | | Gemini 3 Flash | `gemini-3-flash` | budget | 1M | 64K | | Gemini 3.1 Flash Lite | `gemini-3.1-flash-lite` | budget | 1M | 64K | ### DeepSeek | Модель | ID | Класс | Контекст | |---|---|---|---| | DeepSeek V4 Pro | `deepseek-v4-pro` | standard | 1M | | DeepSeek V4 Flash | `deepseek-v4-flash` | budget | 1M | Каталог меняется: модели, которые провайдер снял с обслуживания или заменил более новой версией, убираются из списка выбора. Так уже произошло с Opus 4.6 и Opus 4.7 — их нет в выборе, но старые записи об использовании и расчёт по ним сохраняются. ## Сколько стоит запрос в WorkCoins Ваш счёт — это WorkCoins, не доллары и не «пакет запросов». Формула: **WorkCoins = стоимость запроса в долларах × курс коина**. Курс задаётся централизованно и учитывает курс рубля. Точная сумма известна только после ответа: WorkAI заранее проверяет, что баланс положительный, но ничего не резервирует. Поэтому на странице [моделей](/models) стоят **диапазоны**, а не фикс: «Sonnet 5 — 3–6 Ⓦ/запрос», «GPT-5.6 Luna — 1–3 Ⓦ/запрос», «Fable 5 — 12–25 Ⓦ/запрос». Это типичный короткий запрос, не гарантия. Длинная агентная сессия по большому репозиторию уйдёт выше, короткий вопрос — ниже. Калькулятор «сколько запросов даёт N Ⓦ» — на [тарифах](/pricing); средний запрос там ≈ 2000 токенов контекста и 800 токенов ответа. В истории использования по каждому запросу видно дату, модель, режим, **долю попаданий в кэш** и списанную сумму в Ⓦ. Счётчик входных и выходных токенов в интерфейсе не показываем: для решения «почему сегодня ушло больше» достаточно модели, кэша и суммы. Если нужно сравнить модели между собой «как в прайсе поставщика» — следующий раздел. Если нужно понять, хватит ли тарифа на месяц — [тарифы](/pricing). ## Цены моделей за миллион токенов Ниже — **публичные ставки поставщиков** в долларах США за 1 000 000 токенов. WorkAI считает себестоимость запроса по этим ставкам, затем переводит её в WorkCoins. Это не ваш чек и не цена тарифа WorkAI. Рубли за подписку и стоимость одного Ⓦ — только на [тарифах](/pricing). Ставки совпадают с официальным прайсом Anthropic, OpenAI, Google, xAI и DeepSeek; так же их показывают Cursor и GitHub Copilot в своих таблицах models-and-pricing. Цифры — стандартный тир обработки. У OpenAI есть ещё Flex (примерно 0,5×) и Priority / Fast (примерно 2×) — они описаны отдельным абзацем, чтобы не дублировать все колонки. ### Цены Claude в WorkAI Ставка записи кэша — 5-минутный TTL (1,25× входа), как в публичных таблицах Anthropic. Часовой кэш стоит 2× входа; WorkAI выбирает TTL сам, в селекторе модели этого переключателя нет. | Модель | Вход | Запись кэша (5 мин) | Чтение кэша | Вывод | |---|---|---|---|---| | [Fable 5](/docs/models/claude-fable-5) | $10.00 | $12.50 | $1.00 | $50.00 | | [Opus 5](/docs/models/claude-opus-5) | $5.00 | $6.25 | $0.50 | $25.00 | | [Opus 4.8](/docs/models/claude-opus-4-8) | $5.00 | $6.25 | $0.50 | $25.00 | | [Sonnet 5](/docs/models/claude-sonnet-5) | $2.00 | $2.50 | $0.20 | $10.00 | | [Haiku 4.5](/docs/models/claude-haiku-4-5) | $1.00 | $1.25 | $0.10 | $5.00 | У Claude нет надбавки за длинный контекст: ставка одна на всём окне, включая 1M. Режим `Context` в селекторе задаёт, когда сжимать историю, а не цену токена. ### Цены GPT в WorkAI У семейства GPT-5.6 поставщик отдельно тарифицирует запись кэша (1,25× некэшированного входа). У остальных моделей OpenAI в таблице запись кэша отсутствует — кэш-хиты идут по колонке «Чтение кэша». | Модель | Вход | Запись кэша | Чтение кэша | Вывод | Длинный контекст | |---|---|---|---|---|---| | [GPT-5.6 Sol](/docs/models/gpt-5-6-sol) | $5.00 | $6.25 | $0.50 | $30.00 | после 272K: $10.00 / $12.50 / $1.00 / $45.00 | | [GPT-5.6 Terra](/docs/models/gpt-5-6-terra) | $2.00 | $2.50 | $0.20 | $12.00 | после 272K: $4.00 / $5.00 / $0.40 / $18.00 | | [GPT-5.6 Luna](/docs/models/gpt-5-6-luna) | $0.20 | $0.25 | $0.02 | $1.20 | после 272K: $0.40 / $0.50 / $0.04 / $1.80 | | [GPT-5.4](/docs/models/gpt-5-4) | $2.50 | — | $0.25 | $15.00 | после 272K: $5.00 / — / $0.50 / $22.50 | | [GPT-5.3 Codex](/docs/models/gpt-5-3-codex) | $1.75 | — | $0.175 | $14.00 | нет: единая ставка на всё окно 400K | | [GPT-5.4 Mini](/docs/models/gpt-5-4-mini) | $0.75 | — | $0.075 | $4.50 | нет | | [GPT-5.4 Nano](/docs/models/gpt-5-4-nano) | $0.20 | — | $0.02 | $1.25 | нет | | [GPT-4.1](/docs/models/gpt-4-1) | $2.00 | — | $0.50 | $8.00 | нет | **Flex и Priority.** Processing mode в селекторе OpenAI меняет именно ставку, не только скорость. Flex ≈ половина стандартной ставки, ответ может быть дольше. Priority (у GPT-5.6 в интерфейсе — Fast) ≈ двойная ставка и быстрее. Набор пунктов зависит от модели: у Nano нет Priority, у Codex нет Flex. ### Цены Gemini в WorkAI У Gemini запись кэша в OpenAI-совместимом слое отдельно не тарифицируется: кэш создаётся автоматически, в таблице — только cache hit. | Модель | Вход | Чтение кэша | Вывод | Длинный контекст | |---|---|---|---|---| | Gemini 3.1 Pro | $2.00 | $0.50 | $12.00 | после 200K: $4.00 / $1.00 / $18.00 | | Gemini 3.5 Flash | $1.50 | $0.15 | $9.00 | нет | | Gemini 3 Flash | $0.50 | $0.05 | $3.00 | нет | | Gemini 3.1 Flash Lite | $0.25 | $0.025 | $1.50 | нет | ### Цены Grok в WorkAI У xAI кэш автоматический, отдельной платы за запись нет. | Модель | Вход | Чтение кэша | Вывод | |---|---|---|---| | [Grok 4.3](/docs/models/grok-4-3) | $1.25 | $0.20 | $2.50 | | [Grok 4.20 Reasoning](/docs/models/grok-4-20-reasoning) | $1.25 | $0.20 | $2.50 | | [Grok 4.20 Fast](/docs/models/grok-4-20-fast) | $1.25 | $0.20 | $2.50 | | [Grok Build 0.1](/docs/models/grok-build-0-1) | $1.00 | $0.20 | $2.00 | Надбавки за длинный контекст у xAI нет: миллионное окно тарифицируется по той же ставке. Grok 4.3, 4.20 Reasoning и 4.20 Fast стоят одинаково — деление между ними идёт по задаче (глубина рассуждений против скорости), а не по прайсу. ### Цены DeepSeek в WorkAI Повторное чтение кэша у DeepSeek на два порядка дешевле обычного входа — длинные агентные сессии по одному проекту здесь особенно выгодны. У DeepSeek действует peak/off-peak тарификация: часы пика (01:00–04:00 и 06:00–10:00 UTC) стоят вдвое дороже прочего времени. WorkAI пока считает по единой ставке независимо от часа — ниже указана пиковая, более высокая: так расход не занижается ни в какое время суток. | Модель | Вход | Чтение кэша | Вывод | |---|---|---|---| | DeepSeek V4 Pro | $1.32 | $0.044 | $3.96 | | DeepSeek V4 Flash | $0.44 | $0.014 | $1.32 | ## Как читать ставки входа, кэша и вывода Четыре колонки — это четыре разных счётчика у поставщика, не «цена запроса». - **Вход** — некэшированные токены промпта: системные инструкции, [правила](/docs/rules), ваше сообщение, история чата, прикреплённые файлы и результаты инструментов. - **Запись кэша** — первый раз, когда кусок промпта кладётся в кэш. У Anthropic это 1,25× или 2× входа в зависимости от TTL; у GPT-5.6 — 1,25×. - **Чтение кэша** — повтор того же куска. Обычно в 5–10 раз дешевле входа, у DeepSeek — ещё сильнее. Поэтому второй запрос по тому же проекту часто дешевле первого, даже если текст «выглядит таким же длинным». - **Вывод** — ответ модели. Токены рассуждений (reasoning / thinking) тоже вывод, даже если в чате их не видно. Более глубокий режим рассуждений не меняет ставку за токен, но увеличивает их число. Длинный контекст — отдельный порог, не «включённый режим 1M». У GPT-5.4 и всего семейства GPT-5.6 порог 272 000 входных токенов в одном запросе: вход ×2, вывод ×1,5. У Gemini 3.1 Pro порог 200 000. Само переключение Context в селекторе ничего не стоит, пока фактический запрос порог не перевалил. ## Какую модель выбрать под задачу Если не хочется разбираться — берите **Sonnet 5**: универсальный выбор для большинства задач разработки (в веб-режиме «Создатель» WorkAI работает именно на ней на любом тарифе; десктопный «Создатель» на Free идёт на GPT-5.4 Mini). Дальше двигайтесь от конкретной причины: не хватает качества — вверх, задача простая и повторяемая — вниз. Если модель не выбрана явно, запрос уходит в режим Auto (см. [Автовыбор модели](/docs/model-router)). | Задача | Разумный выбор | Почему | |---|---|---| | Повседневная работа с кодом: рефакторинг, code review, тесты, работа с API | [Sonnet 5](/docs/models/claude-sonnet-5) | Средний класс стоимости, полный набор возможностей — рассуждения, кэш, изображения и PDF, вызов инструментов | | Сложная архитектура, долгая агентная задача, разбор запутанного бага | [Opus 5](/docs/models/claude-opus-5), [Opus 4.8](/docs/models/claude-opus-4-8), [Fable 5](/docs/models/claude-fable-5), [GPT-5.6 Sol](/docs/models/gpt-5-6-sol), [GPT-5.4](/docs/models/gpt-5-4) | Премиум-класс: глубже рассуждают и дольше держат задачу, но и расход заметно выше | | Агентное написание и правка файлов | [GPT-5.3 Codex](/docs/models/gpt-5-3-codex), [Grok Build 0.1](/docs/models/grok-build-0-1) | Модели, специально обученные на задачах агентного кодирования | | Быстрые вопросы, документация, краткие пересказы | [Haiku 4.5](/docs/models/claude-haiku-4-5), [GPT-5.4 Nano](/docs/models/gpt-5-4-nano), [GPT-5.6 Luna](/docs/models/gpt-5-6-luna) | Бюджетные и быстрые; окна меньше, но для коротких задач этого хватает | | Много однотипных вызовов инструментов, где важна задержка | [Grok 4.20 Fast](/docs/models/grok-4-20-fast), [GPT-4.1](/docs/models/gpt-4-1) | Работают без режима рассуждений — отвечают быстрее и не тратят токены на размышления | | Нужно строгое следование инструкциям без «фантазии» | [Grok 4.20 Reasoning](/docs/models/grok-4-20-reasoning), [GPT-4.1](/docs/models/gpt-4-1) | Ставка на предсказуемость вывода и надёжный вызов инструментов | Два практических правила. Первое: модель можно менять посреди диалога — история сохранится, так что начинать с дешёвой и переключаться на дорогую, когда задача не поддалась, вполне рабочая тактика. Второе: если задача упирается не в интеллект модели, а в объём материала, дешевле дать агенту точный контекст (см. [Контекст](/docs/agent/context) и [Правила](/docs/rules)), чем брать модель дороже. ## Что означает класс модели Класс (budget / standard / premium) — ранжирование **внутри каталога одного провайдера**, а не общая шкала цен. Сравнивать классы между провайдерами нельзя: Sonnet 5 и GPT-5.4 Mini обе в standard, но ставка вывода у Sonnet выше — это видно в таблицах выше. То же внутри одной линейки. GPT-5.6 Luna формально в том же классе, что и GPT-5.6 Terra, но это самая дешёвая модель семейства 5.6 — по ставке рядом с GPT-5.4 Nano, не с Terra. Три Grok 4.x стоят одинаково: класс не отвечает на вопрос «сколько спишется». Класс — «лёгкая, средняя или тяжёлая модель у этого провайдера». Сколько будет стоить запрос — таблицы ставок на этой странице, ориентир в Ⓦ на [моделях](/models), рубли — на [тарифах](/pricing). ## Как считаются WorkCoins Формула одна: **WorkCoins = стоимость запроса в долларах × курс коина**. Что важно знать про сам расчёт: - **Списание идёт по факту, после ответа модели.** Перед запросом WorkAI только проверяет, что баланс положительный, но ничего не резервирует. Поэтому точная цена заранее неизвестна — она зависит от того, сколько токенов реально ушло и вернулось. - **Разные части запроса стоят по-разному.** Некэшированный вход, чтение кэша, запись в кэш и вывод считаются отдельно. Чтение кэша обычно на порядок дешевле обычного входа — длинный диалог по одному проекту стоит меньше, чем кажется по объёму контекста. - **Токены рассуждений — это вывод.** У моделей с reasoning внутренние рассуждения тарифицируются как выходные токены, даже если вы их не видите. Более глубокий режим стоит дороже при том же вопросе. - **Внутри система считает с точностью до 0.0001 Ⓦ**, а в личном кабинете суммы округляются до сотых — у совсем дешёвых запросов в истории может стоять `0,00 Ⓦ`. Во входные токены попадает не только текст вашего сообщения: туда же идут системные инструкции, ваши [правила](/docs/rules), прикреплённые файлы и изображения, вся предыдущая переписка этого чата и результаты работы инструментов — каждый прочитанный агентом файл и вывод каждой команды остаются в истории и оплачиваются в следующих запросах тоже. Поэтому длинная агентная сессия по большому проекту стоит дороже одиночного вопроса той же модели. Списывается всё это из одного баланса, но по порядку: сначала бонусные коины, затем тарифные, затем докупленные, и только последним — перерасход, если вы его включили. ## Почему один запрос стоит по-разному Основных причин четыре: 1. **Длина контекста.** Чем больше файлов и истории диалога видит модель, тем больше входных токенов. 2. **Попадание в кэш.** Повторные запросы по тому же контексту частично оплачиваются по льготной ставке чтения кэша. 3. **Глубина рассуждений.** Reasoning-режимы генерируют дополнительные токены вывода. 4. **Порог длинного контекста у части моделей.** У GPT-5.4 и у всех трёх GPT-5.6 после 272 000 токенов входа в одном запросе включается повышенная ставка: вход дорожает вдвое, вывод — в полтора раза. У Gemini 3.1 Pro порог — 200 000 токенов. У GPT-5.4 Mini, GPT-5.4 Nano, GPT-5.3 Codex, GPT-4.1, у моделей Anthropic, xAI и DeepSeek такой надбавки нет: ставка одна на всём окне. ## Настройка рассуждений и окна контекста У моделей есть переключатели прямо в панели выбора модели — они влияют и на качество, и на расход: - **Reasoning.** У моделей Anthropic с адаптивным мышлением доступны None / Low / Medium / High, а у Opus 4.8, Opus 5 и Fable 5 — дополнительно Max; по умолчанию Medium. У Haiku 4.5 выбор проще: рассуждения включены или выключены. У OpenAI набор уровней свой: у GPT-5.6, GPT-5.4 — Low / Medium / High / Extra High, у GPT-5.4 Mini и Nano — Minimal / Low / Medium / High, у GPT-5.3 Codex — Low / Medium / High без возможности выключить рассуждения совсем. У xAI глубину принимает только Grok 4.3 (None / Low / Medium / High, по умолчанию High); у остальных моделей Grok переключателя нет — они рассуждают внутри себя, но настроить это нельзя, и WorkAI намеренно не показывает выбор там, где провайдер его не поддерживает. - **Context.** Переключатель задаёт локальный лимит окна: с какого объёма WorkAI начинает сжимать историю диалога. У моделей Anthropic с окном 1M это 200K (по умолчанию) или 1M, у Haiku 4.5 — 100K или 200K (по умолчанию). У моделей OpenAI — 272K по умолчанию и 1M либо 400K вторым пунктом. - **Pro-режим.** Есть только у моделей GPT-5.6 и работает, когда рассуждения включены. Он не меняет ставку за токен, но заметно увеличивает расход Ⓦ за счёт большего числа токенов рассуждений. - **Processing mode.** Режим обработки на стороне OpenAI: Default, Flex и Priority. Здесь меняется именно ставка за токен: Flex примерно вдвое дешевле обычной обработки, но может отвечать дольше, Priority — примерно вдвое дороже и быстрее. Набор пунктов зависит от модели. У Anthropic сам переключатель Context на цену токена не влияет — наценки за длинный контекст там нет. У моделей OpenAI из списка выше выбор большого окна сам по себе тоже ничего не стоит, но если запрос реально перевалит за 272 000 токенов входа, включится повышенная ставка (см. раздел выше). ## Что такое контекстное окно Контекстное окно — это максимальный объём, который модель может держать перед глазами в одном запросе: ваше сообщение, история чата, файлы, инструкции и результаты инструментов вместе. В таблицах каталога это колонка «Контекст», и измеряется он в токенах (грубо — несколько символов текста на токен). Диалог не обрывается, когда окно заполняется. Незадолго до потолка WorkAI сжимает историю сам: - у моделей Anthropic **Opus 5, Opus 4.8 и Sonnet 5** старая часть диалога заменяется связным пересказом: что за задача, какие решения приняты, какие файлы смотрели, какой следующий шаг. Пересказ пишет сама модель; - у остальных моделей, включая Haiku 4.5, сжатие проще: из истории вычищаются рассуждения и старые вызовы инструментов (последние около десяти пар вызовов сохраняются), а если и этого мало — отбрасываются самые давние ходы диалога. Пока идёт сжатие, в чате видна строка «Контекст сжат, продолжаю ответ…», а после в переписке остаётся пометка «История диалога сжата для соблюдения лимита контекста» — её видно и когда вы вернётесь к этому чату позже. Модальных окон и остановки работы здесь нет: запрос продолжается автоматически. Сжатую память WorkAI хранит на вашей машине и после перезапуска редактора — заново платить за сжатие того же диалога не придётся. При переключении модели посреди диалога пересказ тоже сохраняется: он переводится в обычный текст, понятный любой модели. Сжать историю можно и вручную — отправьте в чат команду `/compact`. Это полезно, когда диалог уже разросся, а вы собираетесь задать большой новый вопрос и не хотите платить за перевоз всей предыдущей переписки. Что при этом теряется: подробности. Пересказ сохраняет задачу, решения и имена файлов, но точные формулировки старых сообщений из него уходят. Если для дальнейшей работы важна конкретная деталь из начала диалога — повторите её в новом сообщении или начните новый чат. Момент, с которого начинается сжатие, задаёт переключатель Context (см. раздел выше): больший лимит — реже сжатие и больше сохранённого контекста, но и больше входных токенов в каждом запросе. ## Где посмотреть списание WorkCoins Текущий баланс всегда виден в строке состояния редактора — значок с числом Ⓦ. Наведите на него, чтобы увидеть разбивку по источникам (тариф, бонус, купленные, долг по перерасходу); клик открывает раздел оплаты. Подробная история — в личном кабинете, в разделах «Обзор» и «Оплата». По каждому запросу видно дату, модель, режим, долю попаданий в кэш и списанную сумму в Ⓦ. Это же место отвечает на вопрос «почему сегодня ушло больше, чем вчера»: сравните модель и процент кэша у дорогих строк. Токены запроса в этой таблице не выводим. ## Что входит в тариф WorkAI Тарифы отличаются только объёмом WorkCoins в месяц: Free, Pro, Pro+, Business и Max. Каталог моделей, глубина рассуждений и размер контекста на всех платных тарифах одинаковы. Цены в рублях — на странице [тарифов](/pricing). Оплата идёт напрямую в рублях: банковские карты и СБП, а также Apple Pay и Google Pay. Отдельного зарубежного платёжного шлюза и оплаты в валюте нет. Неиспользованный остаток тарифного пула переносится на следующий месяц частично: при продлении подписки переносится **половина неиспользованного месячного объёма тарифа**, остальное сгорает. Дробную часть округляем вверх, в пользу пользователя. База расчёта — только сам месячный объём тарифа. Всё, что к моменту продления лежит на балансе сверх месячного лимита, — это недотраченный перенос из прошлого периода: он действует ровно один месяц и в базу нового расчёта не входит. Поэтому доля никогда не берётся с доли, и тарифный баланс не поднимается выше **полутора месячных лимитов**: 1 500 Ⓦ на Pro, 4 800 Ⓦ на Pro+ — независимо от того, сколько месяцев длится подписка. Копить тарифные Ⓦ из месяца в месяц невозможно: если платить и не тратить, баланс встанет на этом потолке со второго месяца и дальше расти не будет. На цифрах для Pro (1 000 Ⓦ/мес): остался 601 Ⓦ — перенесётся 301 Ⓦ, и новый период начнётся с 1 301 Ⓦ. Остаток 1 400 Ⓦ (там уже лежит прошлый перенос) — считаем только от 1 000, перенесётся 500 Ⓦ, новый период начнётся с 1 500 Ⓦ. Бонусные и докупленные коины в этот расчёт не входят — они лежат отдельными пулами и по правилу переноса не сгорают. Долг (уход в минус за период) переносится целиком, и перенос остатка с долгом взаимоисключающи: если баланс отрицательный, переносить нечего. ## Что даёт бесплатный аккаунт При регистрации начисляется приветственный бонус (по умолчанию 500 Ⓦ). Начисляется он после подтверждения адреса почты — если баланс новый и нулевой, скорее всего письмо ещё не подтверждено, и WorkAI прямо скажет об этом вместо предложения оплатить тариф. При регистрации начисляется приветственный бонус (по умолчанию 500 Ⓦ). Начисляется он после подтверждения адреса почты — если баланс новый и нулевой, скорее всего письмо ещё не подтверждено, и WorkAI прямо скажет об этом вместо предложения оплатить тариф. На бесплатном тарифе (как Cursor Hobby) выбираются только **WorkAI Free**, **WorkAI Auto** (GPT-5.4 Mini) и **GPT-5.4 Nano**. Welcome-бонус 500 Ⓦ и ежемесячные 100 Ⓦ **не открывают** Opus, Sonnet, GPT-5.4 и остальные frontier-модели — они остаются в списке серыми с кнопкой «Улучшить тариф». Полный каталог — с Pro. Дальше бесплатный аккаунт живёт так: - пока есть бонусный остаток, Auto и Nano списывают Ⓦ, WorkAI Free — нет; - когда бонусный остаток исчерпан, исполняется только WorkAI Free (0 Ⓦ), пока не пополнится monthly 100 Ⓦ — и эти 100 тоже только Mini/Nano, не Opus; - **WorkAI Free остаётся доступен всегда и не расходует коины вообще.** Тот же переход на Auto-only происходит, когда платная подписка закончилась и бонусный остаток израсходован. Докупленные пакеты коинов при этом не сгорают — но потратить их до продления подписки можно только в режиме Auto. ## Что такое WorkAI Free Это один пункт в списке моделей, за которым стоит открытая модель, выбранная платформой. Запросы к ней бесплатны — WorkCoins не списываются, свой ключ не нужен. Конкретная модель за этим пунктом меняется: WorkAI сам находит доступные открытые модели, проверяет их на реальных задачах и дважды в сутки пересматривает выбор, а работоспособность текущей модели проверяет чаще. Именно поэтому в списке одно стабильное название, а не десяток отдельных строк — ваш выбор не «протухает» при смене модели. Ограничения честно ниже, чем у платного каталога: работа с изображениями и режим рассуждений недоступны, ответ ограничен 16 000 токенов, зато вызов инструментов работает — агент может читать и править файлы. Это хороший способ попробовать продукт и закрывать простые задачи, но не замена платному каталогу на сложной работе. ## Когда заканчиваются WorkCoins Запросы перестают проходить, и WorkAI показывает понятное сообщение с вариантами действий. Тихой подмены выбранной модели на более дешёвую не происходит — это осознанное решение: модели различаются по цене в десятки раз, и подменять их без вашего ведома нечестно. Когда баланс достигает нуля, приходит письмо — один раз за платёжный период, а не серия предупреждений «осталось 20%». Варианты, чтобы продолжить работу: - **Докупить пак WorkCoins** — разовая покупка, коины не сгорают в конце месяца. Подробности и ограничения — на странице [Докупка WorkCoins](/docs/billing/workcoins-packs). - **Включить работу сверх лимита.** Доступно на платном тарифе с привязанной картой и только после того, как вы сами включите этот режим. Лимит перерасхода фиксированный — 2500 Ⓦ, одинаковый для всех тарифов; цена такого коина выше подписочной и зафиксирована в оферте — 1,2 ₽ за 1 Ⓦ, а долг автоматически гасится при следующем продлении. Пока долг не погашен, доступ ограничен. - **Перейти на тариф с большим лимитом.** Перерасход и автоматическая докупка паков — взаимоисключающие режимы: включение одного выключает другое, чтобы баланс не пополнялся двумя способами разом. Баланс проверяется и на стороне редактора, до отправки запроса. Если связь с сервером пропала, WorkAI работает по последнему известному состоянию баланса и останавливает запросы, когда израсходовано 90 % лимита (а по устаревшим данным — 80 %), чтобы не копить долг вслепую. ## Что не списывает WorkCoins - **Служебные генерации.** Названия чатов и имена проектов генерируются моделью, но пользователю не выставляются — расход фиксируется в истории с пометкой и не уменьшает баланс. - **Внутренние повторы при сбоях.** Если запрос пришлось повторить из-за проблемы на нашей стороне, повтор оплачиваем мы: расход по нему записывается в истории, но с баланса не снимается. - **Ответ, который до вас не дошёл.** Если связь с редактором оборвалась или вы остановили генерацию, не дождавшись конца, запрос не списывается — даже если модель успела потратить токены. Расход по нему всё равно виден в истории, но с пометкой и с нулевой суммой. - **WorkAI Free.** Любые запросы к бесплатной модели — 0 Ⓦ. Чего в этом списке нет: полученный ответ, который вам не понравился, и повторная попытка задать тот же вопрос другими словами — обычные оплачиваемые запросы, модель уже отработала. Сжатие истории диалога тоже выполняет модель, поэтому оно попадает в расход как обычные токены. ## Свой ключ провайдера Да. В WorkAI можно добавить собственный ключ провайдера, и тогда запросы через него **не списывают WorkCoins и не облагаются комиссией платформы** — вы платите провайдеру напрямую по его тарифам. Запрос всё равно попадает в историю использования (модель, режим, без списания Ⓦ). Подключить можно ключи Anthropic, OpenAI, xAI, Google Gemini, DeepSeek, OpenRouter, GigaChat, Yandex AI Studio, а также любой сервис с API, совместимым с OpenAI. Модели, подключённые своим ключом, появляются в общем списке рядом с моделями платформы — переключаться между ними можно в том же меню.