Проверил малоизвестные LLM API с бесплатными моделями, лимитами и реальными запросами.
Вот что получилось:
Atria
Сайт: https://api.atria-asi.ai/
Документация: https://api.atria-asi.ai/docs
API: https://api.atria-asi.ai/v1
Сразу после регистрации мне начислили 100 000 000 токенов.

Доступна одна модель — Atria-Dawn-Preview. Это агентная модель Shanghai AI Lab на базе 744B MoE GLM-5.2, рассчитанная на исследовательские, инженерные и многошаговые задачи с инструментами. (Hugging Face)
Контекст — 256K, максимальный output — 65 536 токенов. Модель принимает только текст.
Atria поддерживает сразу три API, все три у меня реально заработали:
Chat Completions HTTP 200 Responses API HTTP 200 Anthropic Messages HTTP 200
Responses API отдельно возвращает reasoning и финальный ответ, Anthropic Messages — блоки thinking и text, а обычный Chat Completions возвращает только текстовый ответ.
Лимиты
В документации указано 60 RPM на аккаунт, причём лимит общий для Chat Completions, Responses и Messages.
Но мой аккаунт во всех ответах стабильно получал:
x-rpm-limit: 50
Поэтому фактически для него сервер выставил 50 RPM.
Дополнительно отправил 51 запрос примерно за минуту:
HTTP 200 — 47 HTTP 429 — 0 ERR — 4
Четыре ошибки были локально отменёнными задачами, а не ответами API. Поэтому жёсткую границу через 429 поймать не удалось, но фактический серверный заголовок показывает 50 RPM. RPD отдельно не указан.
Routeway
Сайт: https://routeway.ai/
Документация: https://docs.routeway.ai/
API: https://api.routeway.ai/v1
После регистрации баланс у меня был $0.00, но бесплатные маршруты при этом работают отдельно от баланса.

/v1/models вернул 263 модели, но бесплатными в каталоге отмечены отдельные маршруты с суффиксом :free.
В моём аккаунте были доступны:
deepseek-v4-flash:free minimax-m2.7:free muse-glimmer-30b:free
По факту результаты получились разные.
minimax-m2.7:free работает:
HTTP 200 MODEL: minimax-m2.7:free ANSWER: API WORKS
Модель возвращает reasoning прямо внутри ответа в блоке <think>, а затем финальный текст.
muse-glimmer-30b:free после первой ошибки заработала стабильно:
TRY 1 — HTTP 200 TRY 2 — HTTP 200 TRY 3 — HTTP 200
Во всех трёх запросах ответ был API WORKS.
А вот deepseek-v4-flash:free у меня не заработал вообще:
HTTP 502 HTTP 502 HTTP 502 HTTP 502
Поэтому в список реально работающих бесплатных моделей я его не включаю.
Лимиты
Routeway сам возвращает лимиты в заголовках:
x-ratelimit-limit-minute: 5 x-ratelimit-limit-day: 200
То есть бесплатный тариф даёт:
5 RPM 200 запросов в сутки
При этом неудачные запросы тоже учитываются в дневной квоте. После серии тестов x-ratelimit-remaining-day уменьшался даже после 502 и 429.
Один раз MiniMax M2.7 вернул:
HTTP 429 model_overloaded
Это была перегрузка самой модели, а не исчерпание лимита аккаунта — следующие запросы снова прошли с HTTP 200.
Selora
Сайт: https://selora.lol/
Документация: https://selora.lol/docs
API: https://api.selora.lol/v1
У Selora есть бесплатный тариф Nova на 14 дней. Для активации нужно привязать Telegram и вступить в канал сервиса.
После активации дают до $5 API-кредитов на каждые 4 часа, при этом общий недельный лимит — $30.

/v1/models вернул 10 моделей:
claude-fable-5 claude-fable-5-1 claude-haiku-4-5 claude-opus-4-8 claude-opus-5 claude-sonnet-5 gpt-5-6-luna gpt-5-6-sol gpt-6-astra kimi-k3
Проверил все десять через OpenAI-совместимый /chat/completions — 10 из 10 получили HTTP 200 и вернули API WORKS.
В том числе нормально заработали:
claude-opus-5 claude-sonnet-5 gpt-5-6-sol gpt-6-astra kimi-k3
Есть и Anthropic-совместимый API через /v1/messages — его отдельно проверил на claude-opus-5, запрос также прошёл успешно.
Лимиты
API сам возвращает:
x-ratelimit-limit: 30 x-ratelimit-remaining: 29 x-ratelimit-reset: 60
То есть лимит составляет 30 RPM.
Отдельного RPD здесь нет — вместо него используется денежное окно:
до $5 / 4 часа до $30 / неделю
На проверку всех десяти моделей ушло совсем немного:
До теста: $5.000000 После теста: $4.999196 Расход: $0.000804
ShareLLM
Сайт: https://sharellm.net/
API: https://sharellm.net/v1
После регистрации ShareLLM сразу даёт отдельный Free-маршрут для API.
На бесплатном тарифе сейчас доступны:
120 запросов / 5 часов 600 запросов / неделю

Через /v1/models бесплатный ключ вернул 39 моделей. Из них я проверил 10 наиболее интересных:
gpt-5.6-luna grok-4.6 deepseek-v4.1-flash glm-5.3 glm-5.3-flash kimi-k3 qwen3.8-max minimax-m3 gemini-3.8-flash step-5
Все десять маршрутов дали HTTP 200.
gpt-5.6-luna HTTP 200 grok-4.6 HTTP 200 deepseek-v4.1-flash HTTP 200 glm-5.3 HTTP 200 glm-5.3-flash HTTP 200 kimi-k3 HTTP 200 qwen3.8-max HTTP 200 minimax-m3 HTTP 200 gemini-3.8-flash HTTP 200 step-5 HTTP 200
При этом название маршрута не всегда совпадает с тем, что API возвращает в поле model:
gpt-5.6-luna → codex-auto-review glm-5.3 → codely-core kimi-k3 → kimi-k3-oc qwen3.8-max → qwen/qwen3.8-max:free step-5 → step-5-preview
Поэтому названия в /models здесь стоит воспринимать как названия маршрутов, а не как точное указание, какая модель реально стоит за ними.
У kimi-k3 reasoning приходит отдельно в reasoning_content, а финальный ответ — в обычном content. MiniMax M3, наоборот, возвращает рассуждение прямо внутри <think>...</think>.
По скорости разброс большой. Например, deepseek-v4.1-flash и glm-5.3-flash ответили примерно за 1.5 секунды, а маршрут glm-5.3 в одном из тестов занял больше минуты.
Vireonix
Сайт: https://vireonix.ai/
Документация: https://vireonix.ai/docs
API: https://vireonix.ai/v1
Vireonix вообще не требует регистрации и API-ключа. Достаточно отправить обычный OpenAI-совместимый запрос.

Через /v1/models доступен один маршрут:
auto
Он сам выбирает модель из общего пула. В описании маршрута указаны MiniMax, Nemotron, GLM, Gemma, Llama, Qwen, GPT-OSS и некоторые GPT-модели.
В тесте chat/completions с уникальной строкой вернул HTTP 200 примерно за секунду:
MODEL: auto ANSWER: API WORKS 22b8fc90
Конкретная модель при этом не раскрывается — API возвращает только auto.
У бесплатного маршрута довольно большая квота:
20 000 000 входных токенов / час 200 000 выходных токенов / час контекст до 1 000 000 токенов
Лимит считается по IP и обновляется каждый час. /api/limits отдельно подтвердил, что это стандартная политика, а не временная акция: temporary: false.
OdiRouter
Сайт: https://odirouter.ai
API: https://api.odirouter.ai/v1
У OdiRouter есть отдельный пул моделей с префиксом free-*.

На моём аккаунте среди бесплатных моделей были:
free-claude-haiku-4.5 free-claude-haiku-4-5-20251001 free-gemini-2.5-flash free-gemini-2.5-flash-lite free-gemini-2.5-pro free-gemini-3.1-flash-lite free-gemini-3-flash-preview free-gpt-5.4-mini free-minimax-m2.5 free-minimax-m2.7 free-qwen3.5-flash free-qwen3.5-plus free-qwen-flash-character free-vclaude-haiku-4.5
Не все модели были стабильны. free-gpt-5.4-mini на тесте вернул 502, free-gemini-2.5-flash-lite — 503, а два Gemini preview-маршрута несколько раз упирались в 504.
Ещё один нюанс с reasoning-моделями: free-qwen3.5-plus при max_tokens=256 вернул HTTP 200, но финальный content оказался пустым. После увеличения лимита до 1024 модель нормально завершила ответ. Во втором тесте из 299 completion-токенов 283 пришлись на reasoning, поэтому предыдущего лимита ей, скорее всего, просто не хватило для финального ответа.
prompt_tokens: 25 completion_tokens: 299 reasoning_tokens: 283 total_tokens: 324 finish_reason: stop
Поэтому HTTP 200 с пустым content ещё не означает, что маршрут сломан — у reasoning-моделей стоит проверить reasoning_content, finish_reason и попробовать увеличить max_tokens.
Итог
Из этой подборки больше всего выделяются Atria, ShareLLM и OdiRouter: у первого огромная бесплатная квота, у второго много сильных моделей, у третьего — отдельный пул реально работающих free-* маршрутов.
Selora тоже очень интересна за счёт Claude Opus, GPT-5.6 Sol и Kimi K3, но бесплатный доступ там ограничен 14 днями. Routeway проще, зато работает при нулевом балансе, а Vireonix вообще не требует регистрации и API-ключа.
Если знаете другие подобные сервисы — пишите в комментариях. Находки по бесплатным AI-моделям, API и инструментам я также собираю в Telegram-канале AI Ungated: https://t.me/AIUngated
Комментарии (3)

Ribera-sun
22.09.2026 17:50А какой смысл 5 долларов для клауд 5.1 например? Сорет же за минуту и до свидания.
Moog_Prodigy
Ну вот прорекламили вы свой тг канал (я не против если чо, полезно) и публикуйте в нем дальше свои находки. А то сейчас хабраэффект все ваши находки просто задудосит, тут же не только люди есть но и ботов пасется неисчислимо. Которые агрегируют вот это вот все и потом продают...
Такое на индексируемом ресурсе (любом) лучше не публиковать, иначе они все будут сразу в тыкву превращаться.
Ungated Автор
Я не рекламирую. Если кто хочет - заходит, если нет - нет. Смысл статьи в сервисах. А что касается того, что вы называете хабрэффектом, в ТГ это происходит намного быстрее, поверьте.