Я проверил бесплатные AI API‑шлюзы реальными запросами: доступные модели, стартовые бонусы и ограничения RPM. Ниже — результаты тестов на момент публикации.
VyceAI
Сайт: https://vyceai.com
API: OpenAI‑compatible
Base URL: https://vyceai.com
Список моделей: GET /v1/models
Chat: POST /v1/chat/completions
После регистрации сервис начислил $40 внутреннего API‑баланса. Для доступа к моделям нужно привязать Discord.

На Free‑аккаунте в витрине были доступны четыре текстовые модели:
Model ID |
Input / 1M |
Output / 1M |
Лимиты |
|---|---|---|---|
|
$2 |
$2 |
50 млн токенов/день и 60 запросов в минуту |
|
$0.20 |
$1.20 |
60 запросов в минуту |
|
$3 |
$15 |
60 запросов в минуту |
|
$0.09 |
$0.18 |
60 запросов в минуту |
Experiential Labs
Сайт: https://platform.experientiallabs.ai
API: OpenAI‑compatible
Base URL: https://api.experientiallabs.ai/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
Каталог огромный, но я отдельно проверил модели, которые реально можно использовать бесплатно без оплаты.
Модель |
|---|
|
|
|
|
|
|

FREE в каталоге не всегда означает доступ без оплаты. Например, для части моделей Experiential просит заплатить $1 для верификации аккаунта. Поэтому в список выше я включил только те модели, которые реально удалось вызвать без платежа. Лимиты
Конкретного RPM у Experiential в документации я не нашёл, поэтому отдельно проверил gpt-5.6-luna серией коротких запросов.
В первом тесте прошло 20 из 20 запросов без единого HTTP 429. Во втором прогоне отправлено ещё 30 запросов: 29 успешных, 1 ошибка, 0 ответов 429. Весь тест занял 74,02 секунды — фактическая нагрузка составила примерно 24 запроса в минуту.
Поэтому практический результат на момент проверки:
Около 24 RPM модель
gpt-5.6-lunaвыдерживает без rate‑limit 429.
Dahl Inference
Сайт: https://inference.dahl.global/
API: OpenAI‑compatible
Base URL: https://inference.dahl.global/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
Баланс: GET /tokens/current
После регистрации сервис начислил 100 млн токенов. Изначально они лежат на балансе аккаунта, после чего их нужно вручную выделить на API‑ключ через кнопку Allocate.

На момент проверки /v1/models отдавал две модели:
Model ID |
|---|
|
|
У Dahl необычная схема биллинга: например, если запрос и ответ вместе заняли 63 токена, с баланса спишется ровно 63. В тесте MiniMax использовал 43 input + 20 output = 63 токена, и баланс уменьшился ровно на 63. DeepSeek использовал 9 + 2 = 11 токенов, и списалось ровно 11.
MiniMax M2.7 ответил примерно за 0,56 с. DeepSeek V4 Flash оказался заметно медленнее: один запрос завершился HTTP 524, повторный прошёл успешно примерно за 37 секунд.
Лимиты
Отдельный RPM в заголовках API не указывается, поэтому проверил нагрузкой MiniMax M2.7.
Результат: 60 запросов за 60,86 секунды, 60/60 успешных, списано ровно 2700 токенов
То есть на момент проверки сервис стабильно выдерживал как минимум 60 RPM.
APInex
Сайт: https://apinex.bond/
API: OpenAI‑compatible
Base URL: https://api.apinex.bond/v1
Chat: POST /v1/chat/completions
После регистрации баланс был $0.00, API дал доступ к пяти моделям из категории Free:
Model ID |
|---|
|
|
|
|
|

Лимиты
API сам отдаёт rate‑limit в заголовках:
x-ratelimit-limit: 30 x-ratelimit-remaining: ... x-ratelimit-reset: ...
Пять последовательных запросов к разным моделям дали остаток 29 → 28 → 27 → 26 → 25 с одинаковым временем сброса. Значит, это общий лимит 30 запросов в минуту на аккаунт, а не отдельные 30 RPM на каждую модель.
ModelRouter
Сайт: https://modelrouter.io/
API: OpenAI‑compatible
Base URL: https://api.modelrouter.io/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
На Free‑плане дают 150 000 внутренних токенов в сутки. Расход зависит от модели, поэтому это не всегда равно фактическому числу input/output‑токенов. Лимит обновляется в полночь UTC, подписка не истекает. Через /v1/models у меня вернулось 59 моделей.
Из интересных моделей проверил:
Модель |
Результат |
|---|---|
|
работает |
|
работает |
|
работает |
|
работает |
|
HTTP 200, но пустой |
|
HTTP 200, но пустой |
|
HTTP 500 |
|
HTTP 500 |

Лимиты: 10 запросов в минуту
TokenForge
Сайт: https://tokenforge.ai.studio/
API: OpenAI‑compatible
Base URL: https://tokenforge.ai.studio/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

После регистрации сервис начисляет $50, плюс можно получать $20 каждый день через Check in. После первого бонуса баланс составил $70.
/v1/models вернул только: claude-opus-5
Лимиты
Собственного RPM‑лимита обнаружить не удалось: даже при тесте на 60 запросов API не вернул ни одного HTTP 429. При этом сама модель работала нестабильно — из 60 запросов успешно прошли только 17. То есть жёсткого RPM со стороны TokenForge не видно, но стабильность модели низкая.
Вывод
Если выбирать по результатам тестов, самым щедрым по объёму выглядит Dahl с 100 млн токенов. APInex — один из самых понятных вариантов с полностью бесплатными моделями и лимитом 30 RPM, а VyceAI даёт хороший стартовый баланс и 60 RPM. ModelRouter интересен ежедневным лимитом, но его 150 000 внутренних токенов расходуются с коэффициентом, зависящим от модели. TokenForge, несмотря на большой бонус, оказался самым нестабильным: в нагрузочном тесте успешно прошли только 17 из 60 запросов.
Условия бесплатных тарифов и доступность моделей могут меняться, поэтому все цифры в статье актуальны именно на момент тестирования.
Находки по бесплатным AI‑моделям, API и инструментам я также собираю в Telegram‑канале AI Ungated: https://t.me/AIUngated
Комментарии (5)

Bardakan
06.09.2026 03:21В первом тесте прошло 20 из 20 запросовбез единого HTTP 429. Во втором прогоне отправлено ещё 30 запросов: 29 успешных, 1 ошибка, 0 ответов 429
Вы проверяли сами ответы? Openrouter например, в какой-то момент начинает отдавать пустые ответы со статусом «успешно»

amatoravg
06.09.2026 03:21APInex — один из самых понятных вариантов с полностью бесплатными моделями и лимитом 30 RPM
Как раз наоборот, у них судя по всему очень мутная и запутанная тарификация. Не говоря уже про сомнение в честности указанных моделей. Как я понял, бесплатно у них только 1 млн токенов в день, если хочется больше - подписка нужна 1 доллар на три дня и 100 млн токенов (это все речь про модели из категории free).
AleGen
А вот есть ещё Gonkagate - шлюз к децентрализованной Gonka Network - там при регистрации даётся 10 баксов, и тариф ну оооочень недорогой, что было бы весьма выгодно для регулярного использования (мне хватило бы на год )) ). Под капотом на выбор DeepSeek V4 Flash или MiniMax M2.7. Но reasoning нет, и на простые запросы типа "ты кто?" отвечает нормально, а сложные дооолго думает, потом сыпет разными ошибками. Ни у кого, случайно, нет решений/рекомендаций, как можно грамотно настроить/использовать?...
amatoravg
Так приведенный в статье Dahl - это тоже один из множества интерфейсов к сети gonka...
AleGen
Ваш ответ не решает поставленный мной вопрос.