Api Vibecode Claude
CodexЧто это за сервис?
Custom API передовых моделей для программирования за 5-25% официальной стоимости.
Работает почти везде, где поддерживается кастомный API: Claude Code, Opencode, Openclaw, VS code (Roo code, Kilo code, Continue, Cline), Cursor, Antigravity.
Важно: наши сервисы стоят на серверах cloudflare (во избежании атак и абуза), поэтому вам почти всегда будет требоваться ВПН для работы. Даже для просмотра дашборда.
https://api.vibecode-claude.online/dashboard — дашборд: запросы в реальном времени с датой, временем и именем модели, баланс и расход. Время в UTC, от Москвы минус 3 часа.
Модели
Набор моделей привязан к ключу: какой продукт купили — такие модели и доступны. Настройка при этом везде одна и та же.
- Claude —
claude-opus-4.8,claude-opus-4.7,claude-opus-4.6,claude-sonnet-5,claude-sonnet-4.6,claude-sonnet-4.5,claude-haiku-4.5 - Grok —
grok-4.6,grok-4.5,grok-4.3,grok-code-fast-1 - Claude via Databricks —
claude-opus-5,claude-opus-4-8,claude-sonnet-5 - GPT (Codex) —
gpt-6-sol,gpt-6-luna,gpt-6-astra,gpt-5.6-sol,gpt-5.6-terra,gpt-5.6-luna,gpt-5.5
Чем отличаются наборы
Модели во всех наборах оригинальные, отличаются провайдер, контекст и мелкие возможности. Ниже — честно, включая ограничения.
Claude (Kiro)
Плюсы. Официальный верифицированный провайдер (AWS Bedrock), оригинальные модели. Контекст до 1 000 000 токенов у всех моделей — самый большой из наших наборов. Работает в любой среде. Кэширование учитывается внутри тарификации, поэтому долгая работа в одном проекте расходует баланс заметно медленнее.
Минусы.
- Кэш непрозрачен: провайдер не возвращает отдельное поле кэшированных токенов, и в дашборде вы не увидите его отдельной строкой. На деньги это влияет в вашу пользу — кэш уже учтён, — но статистики по нему нет.
- Мышление не приходит отдельным блоком: модель думает и качество то же, но в Claude Code вы не видите процесс. Иногда клиент рисует «подвисло», пока идёт ответ — это особенность отображения, а не ошибка.
- По отзывам части пользователей модели субъективно кажутся слабее оригинальных. Бенчмарками это не подтверждается, причина неизвестна — говорим как есть.
Тарификация. Расход считается в кредитах провайдера: 1 кредит — $0.12, одинаково для всех моделей. Число кредитов за запрос зависит от модели (Opus дороже Sonnet, Haiku дешевле всех) и уже включает кэш — отдельной скидки за кэш вы не увидите, она внутри кредита. Кредиты каждого запроса видны в дашборде, и формула сходится прямо там: кредиты × $0.12 = списание. На практике 1M токенов агентной сессии выходит около $0.73 баланса — против $5–15 за 1M у официального Anthropic.
Grok (xAI)
Плюсы. Grok 4.6 — одна из сильнейших моделей на сегодня: по публичным бенчмаркам обходит GPT-5.6 и китайские модели (Kimi K3, GLM 5.3), уступая только Fable 5 и Opus 5. Работает в любой среде. Кэширование полное и прозрачное — видно в дашборде отдельной строкой.
Минусы. Контекст до 500 000 токенов у grok-4.6 и grok-4.5 — на очень больших проектах в 2026 году этого может не хватить. У grok-4.3 окно вдвое больше, 1 000 000 токенов, и он вдвое дешевле, но слабее флагмана.
Claude via Databricks
Преемник нашего отдельного сервиса под Claude Code CLI: то же назначение и тот же набор возможностей, но на основном сервисе и дешевле. Провайдер под капотом сменился, и мы говорим об этом честно: раньше запросы шли напрямую в Anthropic, теперь — через Databricks. Модели те же.
Плюсы.
- Полноценное кэширование — учитывается и видно в дашборде.
- Всё, что было в прежнем CLI-сервисе: веб-поиск и мышление, которое отображается и настраивается по глубине.
- Цена значительно ниже, чем была раньше через официальный Anthropic: мы работаем через Databricks, и он обходится дешевле.
- Не срабатывают фильтры Anthropic на Opus 5 и Opus 4.8: запросы идут не напрямую в Anthropic, а через нашу организацию в Databricks, где этого слоя нет.
Минусы.
- Контекст до 500 000 токенов. Мы платим за собственную организацию в Databricks и арендуем там мощности — держать окно больше пока слишком дорого. Расширение рассматриваем на будущее.
- При росте нагрузки возможны временные отказы. Сейчас набор уверенно держит 10–15 параллельных сессий; упрётесь — напишите, разберёмся и компенсируем.
- Нет анализа PDF-файлов: Databricks не отдаёт эту нативную функцию Anthropic API.
- Работает ТОЛЬКО в Claude Code CLI версии 2.1.220 и выше — как и прежний сервис под тем же именем. Это требование антифрода: использование в других средах ведёт к блокировке нашей организации у провайдера, а вместе с ней и доступа для всех. Поэтому мы регулируем это на своей стороне — в другой среде ключ просто не заработает, обойти не получится.
- Модели Fable недоступны и не появятся: доступ к ним требует отдельного соглашения и верификации организации, которую мы не проходим.
GPT (OpenAI Codex)
Оригинальные модели OpenAI. Имя модели в ответе — то, которое вы запросили: подмены нет.
Плюсы.
- Чтение из кэша дешевле обычного ввода в десять раз и работает на всём диалоге — долгая работа в одном проекте расходует баланс заметно медленнее. Кэш учитывается и виден в дашборде отдельной строкой.
- Работает в любой среде: Claude Code CLI, OpenCode, VS Code-расширения, чат-клиенты.
- Базовая модель набора —
gpt-5.6-sol. Нужно дешевле — проситеgpt-5.6-luna: она в десять раз дешевле Sol и хорошо работает с инструментами. - Новое с 22.09.2026: GPT-6 Sol и GPT-6 Luna.
gpt-6-sol— по надёжности на уровне Astra и при этом дешевлеgpt-5.6-sol;gpt-6-luna— самая дешёвая модель набора, для простых и быстрых задач. OpenAI открывает их аккаунтам постепенно: если запрос попал на аккаунт без новой модели, он сам уйдёт на соседний.
Минусы.
- Контекст 272 000 токенов. Если вход запроса (новый + кэш) больше 272 000, ВЕСЬ этот запрос считается дороже: вход и кэш ×2, выход ×1.5 — это тарифная политика самого OpenAI, мы передаём её как есть, без своей наценки. Касается gpt-6-astra и всей серии 5.x (gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-5.5). На gpt-6-sol и gpt-6-luna OpenAI такой надбавки не объявлял — у нас они считаются по обычной цене при любом размере контекста.
- Мышление приходит краткой сводкой, а не полным текстом рассуждений — так отдаёт провайдер.
- Не больше шести параллельных сессий на один аккаунт. Основной агент плюс три-четыре субагента укладываются; запустите больше — лишние получат отказ 429 и повторятся сами.
gpt-6-astra— самая сильная и самая дорогая модель набора (вдвое дороже Sol) — идёт на отдельном, небольшом наборе аккаунтов. Когда он занят, приходит 429 с просьбой повторить или взять другую модель; остальные модели при этом работают штатно. Подменять её на более слабую молча мы не будем.
Цены
Сначала главное. Ставки ниже — это цены тарификации: по ним с баланса списывается расход, и они близки к официальным ставкам провайдеров, чтобы вам было с чем сравнивать. Выгода не в ставке, а в цене покупки: сам баланс вы покупаете дешевле номинала — по нашим продажам это от 5 до 18 раз, и тем выгоднее, чем крупнее пакет. Мелкий пакет за $2 даёт около $10-11 баланса, крупный за $40 — уже $640-736. Поэтому ставки ниже не нужно читать как «официальный прайс»: чтобы прикинуть свой расход, делите их на коэффициент своего пакета.
Ставки за 1M токенов (вход / чтение из кэша / выход):
- Claude (Kiro) — тарифицируется не токенами, а кредитами провайдера: 1 кредит = $0.12 для всех моделей, кэш уже внутри кредита.
- Claude via Databricks —
claude-opus-5иclaude-opus-4-8: $5 / $0.50 / $25.claude-sonnet-5: $3 / $0.30 / $15. - Grok —
grok-4.6: $2 / $0.50 / $6.grok-4.5: $2 / $0.30 / $6.grok-4.3: $1.25 / $0.20 / $2.50.grok-code-fast-1: $1 / $0.20 / $2. - GPT (Codex) —
gpt-6-sol: $2 / $0.20 / $10.gpt-6-luna: $0.10 / $0.01 / $0.50.gpt-6-astra: $10 / $1 / $50.gpt-5.6-solиgpt-5.5: $5 / $0.50 / $30.gpt-5.6-terra: $4 / $0.40 / $24.gpt-5.6-luna: $0.50 / $0.05 / $3.
Сколько выходит на практике. Замер по реальному трафику за трое суток (12.09.2026), агентная работа в одном проекте — списание баланса за 1M токенов: Grok — $0.63, Claude (Kiro) — $0.73, Claude via Databricks — $0.89, GPT (Codex) — $1.12. Доля чтения из кэша в этих замерах 90–94% — именно она и делает цену такой. Серия коротких сессий с нуля обойдётся заметно дороже.
Про кэш. Кэшированный ввод не бесплатен, но дешевле обычного: у GPT и Claude — в десять раз, у Grok — вчетверо. Кэш набирается, пока вы работаете в одном проекте подряд: каждый следующий запрос начинается с того же текста диалога, и провайдер не читает его заново. Поэтому длинная сессия расходует баланс в разы медленнее, чем та же работа, начатая с нуля несколько раз. У Claude (Kiro) кэш тоже работает, но отдельной строкой не виден — он учтён внутри кредита.
Темп запросов. Claude (Kiro) — 4 запроса за 10 секунд и 8 за 30. Grok, Claude via Databricks и GPT (Codex) — 10 за 10 секунд и 20 за 30. Превышение даёт 429, клиент повторяет сам; иные лимиты — по договорённости.
Быстрая настройка
Среда может называть поля по-разному, но параметра всегда три:
- Base URL —
https://api.vibecode-claude.online(если среда ругается — добавьте/v1) - API Key —
sk-..., вы получаете его после покупки - Model — имя из списка выше. Можно не указывать — см. ниже
Про имя модели: мы подставим её сами
У каждого набора есть модель по умолчанию: у Claude — claude-sonnet-5, у Grok — grok-4.6, у Claude via Databricks — claude-opus-5, у GPT (Codex) — gpt-5.6-sol. Любое незнакомое имя маппится на неё: прислали claude-opus-5 на Grok-ключе — отработает grok-4.6; прислали опечатку или вообще случайный набор букв — отработает та же модель по умолчанию. Несуществующих имён мы не возвращаем никогда.
Сделано, чтобы подключение работало сразу и вам не приходилось подбирать переменные. Благодаря этому Claude Code CLI заводится двумя строчками:
export ANTHROPIC_BASE_URL="https://api.vibecode-claude.online" export ANTHROPIC_API_KEY="sk-ваш-ключ"
Нужна конкретная модель — просто укажите её точное имя из списка выше.
OpenAI-совместимые среды
Работают без особенностей: в настройках провайдера выбирайте Custom Provider или OpenAI Compatible (именно Compatible, а не просто OpenAI), укажите те же три поля — и всё. Среда обязана предложить поле для URL; если такого поля нет, вы выбрали не того провайдера.
Баланс — в долларах
Вы покупаете не токены, а баланс в долларах, и расходуется он по токенам. Чтение из кэша учитывается и стоит в разы дешевле обычного ввода — поэтому долгая работа в одном проекте тратит баланс заметно медленнее, чем серия коротких сессий с нуля.
Гарантия свежести баланса — 48 часов, отсчёт с вашего первого запроса, а не с момента покупки. С 19.09.2026 протухание временно отключено: по сроку мы не отказываем, у ключа нет срока действия и возвращать просроченную часть кнопкой не нужно. Сама гарантия остаётся и означает обязательство по возврату: если сервис лежал или у вас были проблемы в пределах этих 48 часов — вернём деньги либо компенсируем; за пределами гарантии обязательства по возврату нет, но ключ продолжает работать. Отключение временное — о возврате механизма предупредим заранее.
Остался баланс на старом сервисе Claude Code CLI? Перенесите его сами: в дашборде, в форме переноса баланса между ключами, введите свой старый ключ — остаток переедет на новый ключ один к одному, а старый погасится. Переносится то, что было куплено с 5 августа 2026.
Подробнее
Claude Code CLI — установка и настройка: https://telegra.ph/Claude-Code-CLI-Setup-04-10
Частые вопросы и разбор ошибок: https://telegra.ph/VibeCode-Claude---FAQ-04-10
Последние обновления
23.09.2026 — модели набора GPT (OpenAI Codex) теперь помнят свои рассуждения между шагами агента в Claude Code и OpenCode: раньше каждый шаг начинался без плана, отсюда ощущение «через API глупее подписки». Заодно gpt-6-sol и gpt-6-luna больше не дорожают при контексте выше 272 000 — надбавку OpenAI объявляет только для gpt-6-astra и серии 5.x.
22.09.2026 — в продаже GPT-6 Sol и GPT-6 Luna (gpt-6-sol: $2 / $0.20 / $10, gpt-6-luna: $0.10 / $0.01 / $0.50 за 1M). Базовая модель набора по-прежнему gpt-5.6-sol, новые выбираются явно.
19.09.2026 — протухание баланса временно отключено: срока действия у ключа нет, гарантия 48 часов сохраняется.
12.09.2026 — на этой странице появился раздел «Цены»: ставки по всем наборам, практический расход за 1M токенов и лимиты по темпу запросов. Цена gpt-6-astra снижена вдвое. Codex CLI теперь работает с нашим ключом напрямую.
10.09.2026 — в продаже GPT (OpenAI Codex): gpt-6-astra, gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-5.5. Кэш прозрачный, работает в любой среде.
03.09.2026 15:00 и далее... - глобальные сбои по многим AI сервисам. У нас тупят киро, грок, датабрикс - все провайдеры. В инете также об этом сказано - можете сами проверить. Сейчас у вас наши модели могут не работать, причем супер нестабильно - то вообще не ответить, то долго думать, то 503 выдать. Это происхоидт только сейчас, ранее такого было и не будет - проблема НЕ НА нашей стороне. По просрокам я потом начислю компенсации вам, отписывайте в чаты.
02.09.2026 — в продаже Claude via Databricks (Opus 5, Opus 4.8, Sonnet 5) — преемник отдельного сервиса под Claude Code CLI.
31.08.2026 — в продаже Grok (4.6 / 4.5 / 4.3).
30.08.2026 — гарантия свежести баланса 48 часов, отсчёт с первого запроса.
29.08.2026 — баланс переведён в доллары, кэш учитывается.
Вся хронология — на странице обновлений.