Same models.Те же модели. Same SDK.Тот же SDK. Smaller bill.Счёт меньше.

Pay-as-you-go access to GPT, Claude, Gemini and GLM models. Swap the base URL and key, and pay 30 to 45% less per token than provider list prices.Модели GPT, Claude, Gemini и GLM с оплатой по факту. Смените base URL и ключ и платите за каждый токен на от 30 до 45% меньше прайса провайдера.

POST /v1/chat/completions
curl https://api.arcmux.net/v1/chat/completions \
  -H "Authorization: Bearer $ARCMUX_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-sol",
    "messages": [
      {"role": "user", "content": "Summarize this incident.Кратко опиши инцидент."}
    ]
  }'
ReadyГотовPress Send to push this request through the diagram below.Нажмите «Отправить» и проследите путь запроса по схеме ниже.

Your appsВаш код

  • Cursor/chat/completions
  • Claude Code/messages
  • Codex CLI/responses
  • OpenAI SDK/chat/completions
  • Hermes Agent/chat/completions
ARCMUX
  1. KeyКлюч
  2. BudgetБюджет
  3. RouteМаршрут
  4. UsageУчёт
  • Same protocolБез перевода
  • TranslatedС переводом

ProvidersПровайдеры

    Each request goes to a healthy provider and is billed on real tokens. Press Send to follow yours, or click a provider to take it offline.Каждый запрос уходит к работающему провайдеру и оплачивается по реальным токенам. Нажмите «Отправить», чтобы проследить свой, или кликните по провайдеру, чтобы его отключить.

    Models fromМодели от
    • OpenAI
    • Anthropic
    • Google Gemini
    • Z.ai GLM
    Works withРаботает с
    • Cursor
    • Claude Code
    • Codex CLI
    • OpenCode
    • Hermes Agent
    • OpenAI SDK
    • Anthropic SDK
    • Plain HTTPОбычный HTTP

    Provider list prices, minus 30 to 45%.Прайс провайдера минус от 30 до 45%.

    Each ARCMUX rate is the provider's public list price with a fixed discount taken off. Prices per 1M tokens, in USD. You pay only for the tokens the model actually used.Каждая ставка ARCMUX равна публичной цене провайдера за вычетом фиксированной скидки. Цены указаны за 1 млн токенов в долларах США. Вы платите только за токены, которые модель действительно использовала.

    Price per 1M tokens in USD, input and output, at provider list price and through ARCMUXЦена за 1 млн токенов в долларах США, ввод и вывод, по прайсу провайдера и через ARCMUX
    ModelМодельProvider list priceПрайс провайдераARCMUX
    OpenAI
    gpt-6-astra$10.00 input, / $50.00 output10,00 $ ввод, / 50,00 $ вывод$6.00 input, / $30.00 output6,00 $ ввод, / 30,00 $ вывод40% off−40%
    gpt-6-sol$2.00 input, / $10.00 output2,00 $ ввод, / 10,00 $ вывод$1.20 input, / $6.00 output1,20 $ ввод, / 6,00 $ вывод40% off−40%
    gpt-6-luna$0.10 input, / $0.50 output0,10 $ ввод, / 0,50 $ вывод$0.07 input, / $0.33 output0,07 $ ввод, / 0,33 $ вывод35% off−35%
    Anthropic
    claude-fable-5-1$10.00 input, / $50.00 output10,00 $ ввод, / 50,00 $ вывод$6.00 input, / $30.00 output6,00 $ ввод, / 30,00 $ вывод40% off−40%
    claude-opus-5-5$4.00 input, / $20.00 output4,00 $ ввод, / 20,00 $ вывод$2.20 input, / $11.00 output2,20 $ ввод, / 11,00 $ вывод45% off−45%
    claude-sonnet-5-5$2.00 input, / $10.00 output2,00 $ ввод, / 10,00 $ вывод$1.20 input, / $6.00 output1,20 $ ввод, / 6,00 $ вывод40% off−40%
    Google
    gemini-3.1-pro-preview$2.00 input, / $12.00 output2,00 $ ввод, / 12,00 $ вывод$1.20 input, / $7.20 output1,20 $ ввод, / 7,20 $ вывод40% off−40%
    gemini-3.8-flash$0.75 input, / $3.75 output0,75 $ ввод, / 3,75 $ вывод$0.49 input, / $2.44 output0,49 $ ввод, / 2,44 $ вывод35% off−35%
    gemini-3.5-flash-lite$0.30 input, / $2.50 output0,30 $ ввод, / 2,50 $ вывод$0.21 input, / $1.75 output0,21 $ ввод, / 1,75 $ вывод30% off−30%
    Z.ai
    glm-5.3$1.40 input, / $4.40 output1,40 $ ввод, / 4,40 $ вывод$0.81 input, / $2.55 output0,81 $ ввод, / 2,55 $ вывод42% off−42%
    glm-5.3-flashx$0.37 input, / $1.25 output0,37 $ ввод, / 1,25 $ вывод$0.23 input, / $0.78 output0,23 $ ввод, / 0,78 $ вывод38% off−38%
    glm-5.3-flash$0.15 input, / $0.50 output0,15 $ ввод, / 0,50 $ вывод$0.10 input, / $0.33 output0,10 $ ввод, / 0,33 $ вывод35% off−35%

    Input / output per 1M tokens. Cached and reasoning tokens are billed at the provider's rate for that token type, minus the same discount.Ввод / вывод за 1 млн токенов. Кэшированные и reasoning-токены оплачиваются по ставке провайдера для этого типа токенов с той же скидкой.

    What would you save?Сколько вы сэкономите?

    $1,0001 000 $
    You pay per monthВы платите в месяц
    $600600 $
    You save per monthЭкономия в месяц
    $400400 $

    That is Это $4,8004 800 $ a year. Assumes all spend is on this model. в год, если все расходы приходятся на эту модель.

    Get API keyПолучить API-ключ

    Spending over $5,000 a month? Тратите больше 5 000 $ в месяц? Talk to us about volume pricingОбсудим цены для больших объёмов

    Every request passes four checkpoints.Каждый запрос проходит четыре проверки.

    1. AuthenticateАутентификация

      Give every app and teammate its own key. We store only a hash of each key, never the key itself.Выдайте отдельный ключ каждому приложению и каждому коллеге. Мы храним только хеш ключа, а не сам ключ.

    2. Check the budgetПроверка бюджета

      The expected cost is reserved before anything reaches a provider. Out of balance means a 402, not a surprise invoice. Over the rate limit means a 429 with Retry-After.Ожидаемая стоимость резервируется до того, как запрос уйдёт к провайдеру. Не хватает баланса? Вернётся 402, а не неожиданный счёт. Превышен лимит? Вернётся 429 с Retry-After.

    3. RouteМаршрутизация

      Your request goes to a healthy provider for the model you asked for. If one fails before the first token, another takes over. The model is never swapped behind your back.Запрос уходит к работающему провайдеру той модели, которую вы указали. Если провайдер падает до первого токена, запрос подхватывает другой. Модель никогда не подменяется без вашего ведома.

    4. UsageУчёт

      When the response ends, the reservation is replaced by the real token count at ARCMUX rates. Every line of your bill maps to one request.Когда ответ завершён, резерв заменяется реальным числом токенов по ставкам ARCMUX. Каждая строка счёта соответствует одному запросу.

    What you get besides the discount.Что вы получаете помимо скидки.

    Call Claude with the OpenAI SDK.Вызывайте Claude через OpenAI SDK.

    Keep your SDK. ARCMUX translates Chat Completions, Responses and Messages in both directions, so one client reaches every model.Оставьте свой SDK. ARCMUX переводит Chat Completions, Responses и Messages в обе стороны, поэтому один клиент работает со всеми моделями.

    POST /v1/chat/completions
    {
      "model": "claude-sonnet-5-5",
      "messages": [
        {"role": "system", "content": "Answer briefly.Отвечай кратко."},
        {"role": "user", "content": "Is this cheaper?Так дешевле?"}
      ],
      "max_tokens": 1024
    }

    Retries that never charge twice.Повторы без двойной оплаты.

    Send an Idempotency-Key. The same request gets the stored result back instead of a second bill.Передайте Idempotency-Key. На повторный запрос вернётся сохранённый результат, а не второй счёт.

    Limits on every key.Лимиты на каждый ключ.

    Rate limits and a spend cap on each key. One runaway script cannot drain the whole balance.Ограничение частоты запросов и потолок расходов для каждого ключа. Один сбойный скрипт не опустошит весь баланс.

    Works with Codex CLI.Работает с Codex CLI.

    Streaming, the Responses API and tool calls. One short block in your Codex config.Стриминг, Responses API и вызовы инструментов. Достаточно короткого блока в конфиге Codex.

    Every token accounted for.Учтён каждый токен.

    Each request has an id and a ledger line with real input and output tokens and the price you paid. Nothing is rounded into a monthly lump.У каждого запроса есть id и строка в журнале: реальные токены ввода и вывода и цена, которую вы заплатили. Ничего не сваливается в общую сумму за месяц.

    StreamingСтриминг

    Failover before the first token. Never in the middle of a stream.Переключение до первого токена. Никогда посреди стрима.

    ARCMUX records a delivery fence before the first token reaches you. Before the fence, a failing provider is retried elsewhere. After it, you get a clean error instead of a stitched answer.ARCMUX фиксирует границу доставки до того, как первый токен дойдёт до вас. До границы упавшего провайдера заменяет другой. После неё вы получите понятную ошибку, а не склеенный из двух частей ответ.

    1. Credit heldРезерв средств

      The expected cost is set aside.Ожидаемая стоимость отложена.

    2. Provider attemptПопытка у провайдера

      Fails here? Another provider takes it.Сбой здесь? Запрос возьмёт другой провайдер.

    3. Delivery fenceГраница доставки

      Recorded before the first token is written.Фиксируется до отправки первого токена.

    4. DeliveredДоставлено

      After the bytes are written to your connection.Когда байты записаны в ваше соединение.

    5. UsageУчёт

      Real token counts land on your bill.Реальное число токенов попадает в счёт.

    Connection dropped mid-stream? The charge waits until we confirm what was delivered. You do not pay for a response you never received.Соединение оборвалось посреди стрима? Списание ждёт, пока мы не подтвердим, что именно было доставлено. Вы не платите за ответ, который не получили.

    What you can check before you pay.Что можно проверить до оплаты.

    Start in two minutes.Старт за две минуты.

    No sales call, no contract. Sign up, top up, and point your client at ARCMUX.Без созвонов с отделом продаж и без договора. Зарегистрируйтесь, пополните баланс и направьте свой клиент на ARCMUX.

    1. Create a keyСоздайте ключ

      Sign in with Discord. Your account is created on first sign-in, and you can create a key right away.Вход через Discord. Аккаунт создаётся при первом входе, ключ можно выпустить сразу.

    2. Add creditsПополните баланс

      From $5 by card. Balance and spend are visible per key.От 5 $ картой. Баланс и расходы видны по каждому ключу.

    3. Change the base URLСмените base URL

      https://api.arcmux.net/v1

      Anthropic SDK: use https://api.arcmux.net and pass your key as auth_token.Anthropic SDK: укажите https://api.arcmux.net и передайте ключ как auth_token.

    Get API keyПолучить API-ключ

    Your code stays the same.Ваш код остаётся прежним.

    ~/.codex/config.toml
    model = "gpt-6-sol"
    model_provider = "arcmux"
    
    [model_providers.arcmux]
    name = "ARCMUX"
    base_url = "https://api.arcmux.net/v1"
    env_key = "ARCMUX_KEY"
    wire_api = "responses"

    Questions before you switch.Вопросы перед переходом.

    No answer here? Read the docs or write to support@arcmux.net.Не нашли ответа? Загляните в документацию или напишите на support@arcmux.net.

    Are these the real models?Это настоящие модели?

    Yes. Your request runs on the exact model you name, and the response reports that model back. We never swap it for a cheaper one.Да. Запрос выполняется ровно на той модели, которую вы указали, и ответ возвращает её название. Мы никогда не подменяем её более дешёвой.

    How can it cost less than going direct?Почему это дешевле, чем напрямую?

    We commit to large monthly volumes, which earns us rates you would only get with an enterprise contract, and pass most of that discount on. You get the lower rate without a commitment of your own.Мы берём на себя крупные ежемесячные объёмы и получаем ставки, которые обычно доступны только по корпоративному контракту. Большую часть этой скидки мы передаём вам. Вы получаете низкую цену без собственных обязательств по объёму.

    How do I pay, and can I get a refund?Как оплатить и можно ли вернуть деньги?

    By card through Stripe, from $5. Every top-up comes with an invoice. Unused balance is refunded to your card on request within 30 days of the top-up.Картой через Stripe, от 5 $. На каждое пополнение выставляется счёт. Неизрасходованный баланс вернём на карту по запросу в течение 30 дней после пополнения.

    What are the rate limits?Какие лимиты запросов?

    New keys start at 600 requests and 2M tokens per minute. Need more? Ask support and we raise it, usually the same day.У новых ключей лимит 600 запросов и 2 млн токенов в минуту. Нужно больше? Напишите в поддержку, обычно поднимаем лимит в тот же день.

    Do you keep my prompts?Вы храните мои промпты?

    For 30 days, so an idempotent retry can return the stored result and a billing question can be checked against the real request. Then they are deleted. We never train on them or share them.30 дней. Это нужно, чтобы идемпотентный повтор вернул сохранённый результат, а вопрос по оплате можно было сверить с реальным запросом. Потом промпты удаляются. Мы не обучаем на них модели и никому их не передаём.

    How am I billed?Как считается оплата?

    You top up a prepaid balance. Each request is charged for the real input and output tokens it used, at the rates on this page. A request that fails before the response starts costs nothing.Вы пополняете предоплаченный баланс. С него списывается стоимость реальных токенов ввода и вывода каждого запроса по ставкам с этой страницы. Запрос, который упал до начала ответа, ничего не стоит.

    What happens if a provider goes down?Что будет, если провайдер упадёт?

    If it fails before the first token, the request moves to another healthy provider for the same model. If no provider can serve it, you get a 502 and are not charged.Если сбой случился до первого токена, запрос уходит к другому работающему провайдеру той же модели. Если обслужить его некому, вы получите 502 и ничего не заплатите.

    Can I cap spend per key?Можно ограничить расходы по ключу?

    Yes. Each key has its own rate limits and budget. A request that would go over the budget is refused with a 402 before any tokens are spent.Да. У каждого ключа свои лимиты и бюджет. Запрос, который превысит бюджет, отклоняется с кодом 402 до того, как будет потрачен хоть один токен.

    Pay less for the same tokens.Те же токены, только дешевле.

    Top up from $5, change the base URL, and pay less from the first request.Пополните баланс от 5 $, смените base URL и платите меньше с первого запроса.