Я проверил бесплатные AI API‑шлюзы реальными запросами: доступные модели, стартовые бонусы и ограничения RPM. Ниже — результаты тестов на момент публикации.

VyceAI

Сайт: https://vyceai.com
API: OpenAI‑compatible
Base URL: https://vyceai.com
Список моделей: GET /v1/models
Chat: POST /v1/chat/completions

После регистрации сервис начислил $40 внутреннего API‑баланса. Для доступа к моделям нужно привязать Discord.

 Баланс VyceAI после тестов
Баланс VyceAI после тестов

На Free‑аккаунте в витрине были доступны четыре текстовые модели:

Model ID

Input / 1M

Output / 1M

Лимиты

gpt-5.6-new

$2

$2

50 млн токенов/день и 60 запросов в минуту

gpt-5.6-luna

$0.20

$1.20

60 запросов в минуту

claude-sonnet-4-6

$3

$15

60 запросов в минуту

deepseek-v4-flash

$0.09

$0.18

60 запросов в минуту


Experiential Labs

Сайт: https://platform.experientiallabs.ai
API: OpenAI‑compatible
Base URL: https://api.experientiallabs.ai/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

Каталог огромный, но я отдельно проверил модели, которые реально можно использовать бесплатно без оплаты.

Модель

qwen3.8-27b

deepseek-v4-flash

gpt-5.6-luna

minimax-m2.7-free

minimax-m3-free

openrouter-free

 Важно: метка FREE в каталоге не всегда означает доступ без оплаты. Например, для части моделей Experiential просит заплатить $1 для верификации аккаунта. Поэтому в список выше я включил только те модели, которые реально удалось вызвать без платежа.
Важно: метка FREE в каталоге не всегда означает доступ без оплаты. Например, для части моделей Experiential просит заплатить $1 для верификации аккаунта. Поэтому в список выше я включил только те модели, которые реально удалось вызвать без платежа.

Лимиты

Конкретного RPM у Experiential в документации я не нашёл, поэтому отдельно проверил gpt-5.6-luna серией коротких запросов.

В первом тесте прошло 20 из 20 запросов без единого HTTP 429. Во втором прогоне отправлено ещё 30 запросов: 29 успешных, 1 ошибка, 0 ответов 429. Весь тест занял 74,02 секунды — фактическая нагрузка составила примерно 24 запроса в минуту.

Поэтому практический результат на момент проверки:

Около 24 RPM модель gpt-5.6-luna выдерживает без rate‑limit 429.


Dahl Inference

Сайт: https://inference.dahl.global/
API: OpenAI‑compatible
Base URL: https://inference.dahl.global/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
Баланс: GET /tokens/current

После регистрации сервис начислил 100 млн токенов. Изначально они лежат на балансе аккаунта, после чего их нужно вручную выделить на API‑ключ через кнопку Allocate.

Баланс в Dahl
Баланс в Dahl

На момент проверки /v1/models отдавал две модели:

Model ID

MiniMaxAI/MiniMax-M2.7

deepseek-ai/DeepSeek-V4-Flash-0731

У Dahl необычная схема биллинга: например, если запрос и ответ вместе заняли 63 токена, с баланса спишется ровно 63. В тесте MiniMax использовал 43 input + 20 output = 63 токена, и баланс уменьшился ровно на 63. DeepSeek использовал 9 + 2 = 11 токенов, и списалось ровно 11.

MiniMax M2.7 ответил примерно за 0,56 с. DeepSeek V4 Flash оказался заметно медленнее: один запрос завершился HTTP 524, повторный прошёл успешно примерно за 37 секунд.

Лимиты

Отдельный RPM в заголовках API не указывается, поэтому проверил нагрузкой MiniMax M2.7.

Результат: 60 запросов за 60,86 секунды, 60/60 успешных, списано ровно 2700 токенов

То есть на момент проверки сервис стабильно выдерживал как минимум 60 RPM.


APInex

Сайт: https://apinex.bond/
API: OpenAI‑compatible
Base URL: https://api.apinex.bond/v1
Chat: POST /v1/chat/completions

После регистрации баланс был $0.00, API дал доступ к пяти моделям из категории Free:

Model ID

free/qwen-3.8-max

free/gpt-5.6-luna

free/glm-5.3-flash

free/deepseek-v4-flash-0731

free/deepseek-v4-pro-0813

Модели APInex
Модели APInex

Лимиты

API сам отдаёт rate‑limit в заголовках:

x-ratelimit-limit: 30
x-ratelimit-remaining: ...
x-ratelimit-reset: ...

Пять последовательных запросов к разным моделям дали остаток 29 → 28 → 27 → 26 → 25 с одинаковым временем сброса. Значит, это общий лимит 30 запросов в минуту на аккаунт, а не отдельные 30 RPM на каждую модель.


ModelRouter

Сайт: https://modelrouter.io/
API: OpenAI‑compatible
Base URL: https://api.modelrouter.io/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

На Free‑плане дают 150 000 внутренних токенов в сутки. Расход зависит от модели, поэтому это не всегда равно фактическому числу input/output‑токенов. Лимит обновляется в полночь UTC, подписка не истекает. Через /v1/models у меня вернулось 59 моделей.

Из интересных моделей проверил:

Модель

Результат

claude-opus-5

работает

claude-sonnet-5

работает

kimi-k3

работает

glm-5.2

работает

gemini-3.1-pro-preview

HTTP 200, но пустой content

gemini-3.6-flash-thinking

HTTP 200, но пустой content

gpt-5.6-sol

HTTP 500

gpt-5.5

HTTP 500

Описание бесплатного тарифа
Описание бесплатного тарифа

Лимиты: 10 запросов в минуту


TokenForge

Сайт: https://tokenforge.ai.studio/
API: OpenAI‑compatible
Base URL: https://tokenforge.ai.studio/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

 Стартовые $50 + ежедневный бонус $20 в TokenForge
Стартовые $50 + ежедневный бонус $20 в TokenForge

После регистрации сервис начисляет $50, плюс можно получать $20 каждый день через Check in. После первого бонуса баланс составил $70.

/v1/models вернул только: claude-opus-5

Лимиты

Собственного RPM‑лимита обнаружить не удалось: даже при тесте на 60 запросов API не вернул ни одного HTTP 429. При этом сама модель работала нестабильно — из 60 запросов успешно прошли только 17. То есть жёсткого RPM со стороны TokenForge не видно, но стабильность модели низкая.

Вывод

Если выбирать по результатам тестов, самым щедрым по объёму выглядит Dahl с 100 млн токенов. APInex — один из самых понятных вариантов с полностью бесплатными моделями и лимитом 30 RPM, а VyceAI даёт хороший стартовый баланс и 60 RPM. ModelRouter интересен ежедневным лимитом, но его 150 000 внутренних токенов расходуются с коэффициентом, зависящим от модели. TokenForge, несмотря на большой бонус, оказался самым нестабильным: в нагрузочном тесте успешно прошли только 17 из 60 запросов.

Условия бесплатных тарифов и доступность моделей могут меняться, поэтому все цифры в статье актуальны именно на момент тестирования.

Находки по бесплатным AI‑моделям, API и инструментам я также собираю в Telegram‑канале AI Ungated: https://t.me/AIUngated

Комментарии (5)


  1. AleGen
    06.09.2026 03:21

    А вот есть ещё Gonkagate - шлюз к децентрализованной Gonka Network - там при регистрации даётся 10 баксов, и тариф ну оооочень недорогой, что было бы весьма выгодно для регулярного использования (мне хватило бы на год )) ). Под капотом на выбор DeepSeek V4 Flash или MiniMax M2.7. Но reasoning нет, и на простые запросы типа "ты кто?" отвечает нормально, а сложные дооолго думает, потом сыпет разными ошибками. Ни у кого, случайно, нет решений/рекомендаций, как можно грамотно настроить/использовать?...


    1. amatoravg
      06.09.2026 03:21

      Так приведенный в статье Dahl - это тоже один из множества интерфейсов к сети gonka...


      1. AleGen
        06.09.2026 03:21

        Ваш ответ не решает поставленный мной вопрос.


  1. Bardakan
    06.09.2026 03:21

    В первом тесте прошло 20 из 20 запросовбез единого HTTP 429. Во втором прогоне отправлено ещё 30 запросов: 29 успешных, 1 ошибка, 0 ответов 429

    Вы проверяли сами ответы? Openrouter например, в какой-то момент начинает отдавать пустые ответы со статусом «успешно»


  1. amatoravg
    06.09.2026 03:21

    APInex — один из самых понятных вариантов с полностью бесплатными моделями и лимитом 30 RPM

    Как раз наоборот, у них судя по всему очень мутная и запутанная тарификация. Не говоря уже про сомнение в честности указанных моделей. Как я понял, бесплатно у них только 1 млн токенов в день, если хочется больше - подписка нужна 1 доллар на три дня и 100 млн токенов (это все речь про модели из категории free).