Проверил малоизвестные LLM API с бесплатными моделями, лимитами и реальными запросами.

Вот что получилось:

Atria

Сайт: https://api.atria-asi.ai/
Документация: https://api.atria-asi.ai/docs
API: https://api.atria-asi.ai/v1

Сразу после регистрации мне начислили 100 000 000 токенов.

Новый аккаунт сразу после регистрации: 100 млн доступных токенов.
Новый аккаунт сразу после регистрации: 100 млн доступных токенов.

Доступна одна модель — Atria-Dawn-Preview. Это агентная модель Shanghai AI Lab на базе 744B MoE GLM-5.2, рассчитанная на исследовательские, инженерные и многошаговые задачи с инструментами. (Hugging Face)

Контекст — 256K, максимальный output — 65 536 токенов. Модель принимает только текст.

Atria поддерживает сразу три API, все три у меня реально заработали:

Chat Completions    HTTP 200
Responses API       HTTP 200
Anthropic Messages  HTTP 200

Responses API отдельно возвращает reasoning и финальный ответ, Anthropic Messages — блоки thinking и text, а обычный Chat Completions возвращает только текстовый ответ.

Лимиты

В документации указано 60 RPM на аккаунт, причём лимит общий для Chat Completions, Responses и Messages.

Но мой аккаунт во всех ответах стабильно получал:

x-rpm-limit: 50

Поэтому фактически для него сервер выставил 50 RPM.

Дополнительно отправил 51 запрос примерно за минуту:

HTTP 200 — 47
HTTP 429 — 0
ERR      — 4

Четыре ошибки были локально отменёнными задачами, а не ответами API. Поэтому жёсткую границу через 429 поймать не удалось, но фактический серверный заголовок показывает 50 RPM. RPD отдельно не указан.


Routeway

Сайт: https://routeway.ai/
Документация: https://docs.routeway.ai/
API: https://api.routeway.ai/v1

После регистрации баланс у меня был $0.00, но бесплатные маршруты при этом работают отдельно от баланса.

 Routeway после тестов: 12 API-запросов при балансе $0.00.
Routeway после тестов: 12 API-запросов при балансе $0.00.

/v1/models вернул 263 модели, но бесплатными в каталоге отмечены отдельные маршруты с суффиксом :free.

В моём аккаунте были доступны:

deepseek-v4-flash:free
minimax-m2.7:free
muse-glimmer-30b:free

По факту результаты получились разные.

minimax-m2.7:free работает:

HTTP 200
MODEL: minimax-m2.7:free
ANSWER: API WORKS

Модель возвращает reasoning прямо внутри ответа в блоке <think>, а затем финальный текст.

muse-glimmer-30b:free после первой ошибки заработала стабильно:

TRY 1 — HTTP 200
TRY 2 — HTTP 200
TRY 3 — HTTP 200

Во всех трёх запросах ответ был API WORKS.

А вот deepseek-v4-flash:free у меня не заработал вообще:

HTTP 502
HTTP 502
HTTP 502
HTTP 502

Поэтому в список реально работающих бесплатных моделей я его не включаю.

Лимиты

Routeway сам возвращает лимиты в заголовках:

x-ratelimit-limit-minute: 5
x-ratelimit-limit-day: 200

То есть бесплатный тариф даёт:

5 RPM
200 запросов в сутки

При этом неудачные запросы тоже учитываются в дневной квоте. После серии тестов x-ratelimit-remaining-day уменьшался даже после 502 и 429.

Один раз MiniMax M2.7 вернул:

HTTP 429
model_overloaded

Это была перегрузка самой модели, а не исчерпание лимита аккаунта — следующие запросы снова прошли с HTTP 200.


Selora

Сайт: https://selora.lol/
Документация: https://selora.lol/docs
API: https://api.selora.lol/v1

У Selora есть бесплатный тариф Nova на 14 дней. Для активации нужно привязать Telegram и вступить в канал сервиса.

После активации дают до $5 API-кредитов на каждые 4 часа, при этом общий недельный лимит — $30.

Selora после тестов: 11 API-запросов, лимит $5 на 4 часа и $30 в неделю.
Selora после тестов: 11 API-запросов, лимит $5 на 4 часа и $30 в неделю.

/v1/models вернул 10 моделей:

claude-fable-5
claude-fable-5-1
claude-haiku-4-5
claude-opus-4-8
claude-opus-5
claude-sonnet-5
gpt-5-6-luna
gpt-5-6-sol
gpt-6-astra
kimi-k3

Проверил все десять через OpenAI-совместимый /chat/completions10 из 10 получили HTTP 200 и вернули API WORKS.

В том числе нормально заработали:

claude-opus-5
claude-sonnet-5
gpt-5-6-sol
gpt-6-astra
kimi-k3

Есть и Anthropic-совместимый API через /v1/messages — его отдельно проверил на claude-opus-5, запрос также прошёл успешно.

Лимиты

API сам возвращает:

x-ratelimit-limit: 30
x-ratelimit-remaining: 29
x-ratelimit-reset: 60

То есть лимит составляет 30 RPM.

Отдельного RPD здесь нет — вместо него используется денежное окно:

до $5 / 4 часа
до $30 / неделю

На проверку всех десяти моделей ушло совсем немного:

До теста:    $5.000000
После теста: $4.999196
Расход:      $0.000804

ShareLLM

Сайт: https://sharellm.net/
API: https://sharellm.net/v1

После регистрации ShareLLM сразу даёт отдельный Free-маршрут для API.

На бесплатном тарифе сейчас доступны:

120 запросов / 5 часов
600 запросов / неделю
Бесплатный тариф ShareLLM: 120 запросов за 5 часов и 600 запросов в неделю.
Бесплатный тариф ShareLLM: 120 запросов за 5 часов и 600 запросов в неделю.

Через /v1/models бесплатный ключ вернул 39 моделей. Из них я проверил 10 наиболее интересных:

gpt-5.6-luna
grok-4.6
deepseek-v4.1-flash
glm-5.3
glm-5.3-flash
kimi-k3
qwen3.8-max
minimax-m3
gemini-3.8-flash
step-5

Все десять маршрутов дали HTTP 200.

gpt-5.6-luna         HTTP 200
grok-4.6             HTTP 200
deepseek-v4.1-flash  HTTP 200
glm-5.3              HTTP 200
glm-5.3-flash        HTTP 200
kimi-k3              HTTP 200
qwen3.8-max          HTTP 200
minimax-m3           HTTP 200
gemini-3.8-flash     HTTP 200
step-5               HTTP 200

При этом название маршрута не всегда совпадает с тем, что API возвращает в поле model:

gpt-5.6-luna  → codex-auto-review
glm-5.3       → codely-core
kimi-k3       → kimi-k3-oc
qwen3.8-max   → qwen/qwen3.8-max:free
step-5        → step-5-preview

Поэтому названия в /models здесь стоит воспринимать как названия маршрутов, а не как точное указание, какая модель реально стоит за ними.

У kimi-k3 reasoning приходит отдельно в reasoning_content, а финальный ответ — в обычном content. MiniMax M3, наоборот, возвращает рассуждение прямо внутри <think>...</think>.

По скорости разброс большой. Например, deepseek-v4.1-flash и glm-5.3-flash ответили примерно за 1.5 секунды, а маршрут glm-5.3 в одном из тестов занял больше минуты.


Vireonix

Сайт: https://vireonix.ai/
Документация: https://vireonix.ai/docs
API: https://vireonix.ai/v1

Vireonix вообще не требует регистрации и API-ключа. Достаточно отправить обычный OpenAI-совместимый запрос.

Vireonix: бесплатный API без аккаунта и без API-ключа.
Vireonix: бесплатный API без аккаунта и без API-ключа.

Через /v1/models доступен один маршрут:

auto

Он сам выбирает модель из общего пула. В описании маршрута указаны MiniMax, Nemotron, GLM, Gemma, Llama, Qwen, GPT-OSS и некоторые GPT-модели.

В тесте chat/completions с уникальной строкой вернул HTTP 200 примерно за секунду:

MODEL:  auto
ANSWER: API WORKS 22b8fc90

Конкретная модель при этом не раскрывается — API возвращает только auto.

У бесплатного маршрута довольно большая квота:

20 000 000 входных токенов / час
200 000 выходных токенов / час
контекст до 1 000 000 токенов

Лимит считается по IP и обновляется каждый час. /api/limits отдельно подтвердил, что это стандартная политика, а не временная акция: temporary: false.


OdiRouter

Сайт: https://odirouter.ai
API: https://api.odirouter.ai/v1

У OdiRouter есть отдельный пул моделей с префиксом free-*.

Список бесплатных моделей OdiRouter.
Список бесплатных моделей OdiRouter.

На моём аккаунте среди бесплатных моделей были:

free-claude-haiku-4.5
free-claude-haiku-4-5-20251001
free-gemini-2.5-flash
free-gemini-2.5-flash-lite
free-gemini-2.5-pro
free-gemini-3.1-flash-lite
free-gemini-3-flash-preview
free-gpt-5.4-mini
free-minimax-m2.5
free-minimax-m2.7
free-qwen3.5-flash
free-qwen3.5-plus
free-qwen-flash-character
free-vclaude-haiku-4.5

Не все модели были стабильны. free-gpt-5.4-mini на тесте вернул 502, free-gemini-2.5-flash-lite503, а два Gemini preview-маршрута несколько раз упирались в 504.

Ещё один нюанс с reasoning-моделями: free-qwen3.5-plus при max_tokens=256 вернул HTTP 200, но финальный content оказался пустым. После увеличения лимита до 1024 модель нормально завершила ответ. Во втором тесте из 299 completion-токенов 283 пришлись на reasoning, поэтому предыдущего лимита ей, скорее всего, просто не хватило для финального ответа.

prompt_tokens:     25
completion_tokens: 299
reasoning_tokens:  283
total_tokens:      324
finish_reason:     stop

Поэтому HTTP 200 с пустым content ещё не означает, что маршрут сломан — у reasoning-моделей стоит проверить reasoning_content, finish_reason и попробовать увеличить max_tokens.


Итог

Из этой подборки больше всего выделяются Atria, ShareLLM и OdiRouter: у первого огромная бесплатная квота, у второго много сильных моделей, у третьего — отдельный пул реально работающих free-* маршрутов.

Selora тоже очень интересна за счёт Claude Opus, GPT-5.6 Sol и Kimi K3, но бесплатный доступ там ограничен 14 днями. Routeway проще, зато работает при нулевом балансе, а Vireonix вообще не требует регистрации и API-ключа.

Если знаете другие подобные сервисы — пишите в комментариях. Находки по бесплатным AI-моделям, API и инструментам я также собираю в Telegram-канале AI Ungated: https://t.me/AIUngated

Комментарии (3)


  1. Moog_Prodigy
    22.09.2026 17:50

    Ну вот прорекламили вы свой тг канал (я не против если чо, полезно) и публикуйте в нем дальше свои находки. А то сейчас хабраэффект все ваши находки просто задудосит, тут же не только люди есть но и ботов пасется неисчислимо. Которые агрегируют вот это вот все и потом продают...

    Такое на индексируемом ресурсе (любом) лучше не публиковать, иначе они все будут сразу в тыкву превращаться.


    1. Ungated Автор
      22.09.2026 17:50

      Я не рекламирую. Если кто хочет - заходит, если нет - нет. Смысл статьи в сервисах. А что касается того, что вы называете хабрэффектом, в ТГ это происходит намного быстрее, поверьте.


  1. Ribera-sun
    22.09.2026 17:50

    А какой смысл 5 долларов для клауд 5.1 например? Сорет же за минуту и до свидания.