Провёл исследование способов оплаты AI подписок для компаний в РФ, поскольку столкнулся с такой необходимостью для своей команды. Да и вообще тема довольно актуальная, часто по чатикам видел этот запрос.
Почему важно оплачивать AI подписки своим сотрудникам
Пока компания ничего не делает, подписки оплачивают сами сотрудники со своих карт. Человек выбирает тариф по своему кошельку, а не по задаче. Claude Pro за $20 вместо Max за $200 — лимиты кончаются в середине рабочего дня.
Поскольку AI инструменты могут кратно повышать производительность сотрудника, в интересах компании делать так, чтобы они их использовали по-максимуму. Относительно месячной зарплаты сотрудника AI подписка — совсем небольшой расход, он определённо того стоит.
Во что обходится каждый способ
Заплатить напрямую российская компания по понятным причинам не может. Компания обычно выбирает из четырёх вариантов.
Ничего не делать. Сотрудник платит сам по своей инициативе. Для компании вообще никакого гемора, но у этого есть существенный недостаток, который мы обсудили чуть выше.
Неформально доплатить. Практика небольших команд. Минимум усилий, никакой бумажной волокиты, но несёт в себе риски при налоговой проверке.
Оформить компенсацию через зарплату. Единственный вариант, который бухгалтерия видит целиком: авансовый отчёт, чек, приказ. И самый дорогой — разбор ниже.
Платёжный агент-посредник — самый юридически чистый и, при выборе хорошего партнёра, финансово выгодный вариант
Сколько стоит подписка в рознице
Сотрудник, который платит сам, почти никогда не платит по курсу. По разбору на «Клерке» с реальными чеками, ChatGPT Plus за $20 обходится в 1 600–1 700 ₽ через виртуальные карты (подразумеваемый курс 80–85 ₽ за доллар — почти рыночный, но карту надо сначала получить, а у некоторых сервисов выпуск стоит 19 990 ₽) и в 2 500–3 200 ₽ через Ozon Банк и маркетплейсы, то есть с переплатой 20–40%. На серых площадках подписка за $20 стоит 1 500–3 200 ₽ и может прожить один день.
Возьмём для расчёта 20% розничной наценки — середину этого диапазона.
Расчёт на одного сотрудника: Claude Max $200 в месяц
Ставки 2026 года: НДФЛ 13% при доходе до 2,4 млн ₽ в год, страховые взносы 30% до предельной базы 2 979 000 ₽, налог на прибыль 25%.
Сотрудник платит сам, компания добавляет к зарплате |
Оплата с расчётного счёта через выгодного агента |
|
|---|---|---|
Цена подписки |
20 853 ₽ (розница +20%) |
19 984 ₽ (курс ЦБ +15%) |
Начислить, чтобы на руки вышла эта сумма |
23 968 ₽ |
— |
НДФЛ 13% |
3 116 ₽ |
нет |
Страховые взносы 30% |
7 191 ₽ |
нет |
Расход компании |
31 160 ₽ |
19 984 ₽ |
Минус налог на прибыль (до 25%) |
−7 790 ₽ |
−4 996 ₽ |
Чистая стоимость |
23 370 ₽ |
14 988 ₽ |
Разница — 8 382 ₽ в месяц на одного человека, 56%. На команде из тридцати разработчиков — 251 тысяча рублей в месяц.
Итак, переходим к моему небольшому исследованию
Три подписки Claude Max по $200 — это $600. Я попросил посчитать этот заказ пять сервисов, которые проводят такие платежи для российских юрлиц: Raketa Pay, Global Payments, «Оплата Гуру», «Плати Легко» и БизнесПэй.
Получил пять цен: 59 952, 69 108, 74 028, 75 902 и 89 100 рублей. Товар один и тот же, разница между крайними — 29 148 ₽ в месяц, 350 тысяч за год. Ставка комиссии эту разницу не объясняет — она варьируется от 15 до 30% в зависимости от сервиса.
Условия собраны 3 и 4 сентября 2026 года в переписке с менеджерами сервисов по одному и тому же запросу от лица юридического лица. Курс ЦБ на 4 сентября — 86,8872 ₽ за доллар, продажа доллара в ВТБ — 88,6 ₽, наличная продажа в Райффайзене — 100 ₽; все три проверены в тот же день.
Raketa Pay: курс ВТБ плюс 30%
Юрлицо узбекское: ООО «ROCKET SMART», Ташкент, резидент IT Park Uzbekistan. При этом состоят на налоговом учёте в России — ИФНС № 9 по Москве, ИНН 9909763341, в РФ работают как ООО «РОСКЕТ СМАРТ». Рубли принимают на счёт в филиале «Центральный» банка ВТБ. Схема агентская: агент действует от своего имени и за счёт принципала.
Теперь про цену, и здесь интересное. В июне 2026 года Raketa Pay публикует на «Клерке» собственную статью, где агентская комиссия за оплату AI-сервисов — 2% по курсу ЦБ. 3 сентября на прямой вопрос о цене отвечают одной строкой: «Курс Втб+30% наша комиссия».
Курс ВТБ, 4 сентября банк продаёт доллар по 88,6 ₽ при курсе ЦБ 86,8872. Плюс 30% — это 115,18 ₽ за доллар, то есть три Claude Max обойдутся в 69 108 ₽ против 52 132 ₽ по курсу ЦБ. Переплата 32,6%, а не 2%.
В отчёте агента, который они прислали в качестве примера, по компании-клиенту четыре годовые подписки на 239 542,28 ₽, и все четыре позиции пересчитаны по одному курсу — 103,97 ₽ за доллар. Порядок тот же.
Документы: договор, счёт, акт, отчёт агента. На возражения по отчёту — 5 рабочих дней, дальше он считается принятым.
Итог по заказу: 69 108 ₽, +32,6% к курсу ЦБ.
Global Payments
Здесь комиссии нет вообще — ни в переписке, ни на сайте. Есть рублёвая цена: ChatGPT Plus 3 500 ₽, Claude Max 20x 27 000 ₽. Для юрлица к этому добавляется 10%.
Разложим обратно. 29 700 ₽ за подписку в $200 — это курс 148,5 ₽ за доллар при курсе ЦБ 86,89. Даже базовый прайс без наценки за юрлицо даёт 135 ₽. Ни одна из этих цифр нигде не названа процентом, и в этом весь приём: клиент сравнивает 27 000 ₽ с 29 700 ₽, а не 86,89 со 148,5.
Схема по умолчанию — оплата на существующий аккаунт клиента. Есть альтернатива: «Либо можем предоставить вам карту для самостоятельной оплаты, это указывается вами при заполнении заявки на сайте, кнопка "Предоставить карту", добавляет +20% к цене услуги». Складываются эти 20% с наценкой за юрлицо или заменяют её, из ответа не понять.
Договор не заключается — работают по счёту и публичной оферте.
Документы: акт выполненных работ или УПД по ЭДО.
Итог по заказу: 89 100 ₽, +70,9% к курсу ЦБ. Самое дорогое предложение из пяти.
«Оплата Гуру»: комиссия 20%, переплата 45%
Двадцать процентов звучат нормально ровно до момента, когда смотришь, от чего считается процент. База у них — курс Райффайзена в разделе «В офисах» → «Купить». Это наличный курс, по которому банк продаёт валюту в отделении: 4 сентября — 100 ₽ за доллар при курсе ЦБ 86,89. Банк ставит такой курс не потому, что доллар столько стоит, а потому что не хочет продавать наличные.
Их собственные цифры это подтверждают: 72 288 ₽ за три подписки, делим на 3 и на $240 — получаем 100,4 ₽ за доллар. Про источник курса они не соврали. Но заявленные 20% на такой базе превращаются в +38,7% к курсу ЦБ, а с их НДС 5% — в +45,6%.
Отдельно стоит понять, что именно покупаешь. Дословно: «Мы выдаем Вам иностранные карты и ВЫ производите оплату своих сервисов». Они не платят за клиента — платит клиент картой, которую ему дали. Для бухгалтерии это другой предмет услуги: в УПД поедет предоставление карты, а не оплата подписки, и вопрос «кто налоговый агент по НДС» решается не так, как в агентской схеме. В отзывах на partnerkin при этом жалуются, что карты постоянно блокируют, а срок исполнения они не назвали.
Документы: договор со спецификацией и счётом на каждую оплату либо разовый счёт-оферта; закрывающие — УПД через ЭДО.
Итог по заказу: 72 288 ₽, с НДС — 75 902 ₽, +45,6% к курсу ЦБ.
«Плати Легко»
Юрлицо — ООО «ПЛАТФОРМА», работают по агентскому договору;
Комиссия ступенчатая: до $1 000 — 20%, от $1 000 до $3 000 — 18%, свыше $3 000 — 16%. Дальше начинается то, чего нет у остальных: НДС 22% от суммы платежа. Не с комиссии — со всей суммы. Минимальный заказ для юрлиц и ИП — 20 000 ₽.
Курс не назвали. Расчёт ниже сделан по курсу ЦБ, то есть по нижней границе; если курс у них банковский, как продажа в ВТБ, добавьте ещё около 2%.
Документы: агентская схема, комплект не детализировали.
Итог по заказу: 74 028–76 322 ₽, +42,0…46,4% к курсу ЦБ.
БизнесПэй: курс ЦБ плюс 15%, но не меньше 1 500 ₽ за аккаунт
Единственные, кто считает от курса ЦБ, а не от банковского. Плюс 15%, и заявлено, что это финальная сумма.
Ловушка здесь в минимальной комиссии. 1 500 ₽ равны 15% ровно на 10 000 ₽, то есть на $115,09. Выше этой отметки работает процент, ниже — фикс, и чем дешевле подписка, тем хуже условия.
Тариф |
15% от базы |
Комиссия по факту |
Цена клиенту |
Эффективная комиссия |
|---|---|---|---|---|
$20 (ChatGPT Plus, Cursor Pro, Claude Pro) |
261 ₽ |
1 500 ₽ |
3 238 ₽ |
86,3% |
$50 |
652 ₽ |
1 500 ₽ |
5 844 ₽ |
34,5% |
$100 |
1 303 ₽ |
1 500 ₽ |
10 189 ₽ |
17,3% |
$115,09 |
1 500 ₽ |
1 500 ₽ |
11 500 ₽ |
15,0% |
$200 (Claude Max 20x) |
2 607 ₽ |
2 607 ₽ |
19 984 ₽ |
15,0% |
На подписке за $20 их комиссия — 86%. На Claude Max — ровно 15%.
Документы: отчёт агента и УПД через ЭДО.
Итог по заказу: 59 952 ₽, +15,0% к курсу ЦБ.
Итого
Заказ один и тот же: три подписки Claude Max по $200. Курс ЦБ 86,8872 ₽ на 04.09.2026, база — 52 132 ₽.
Место |
Сервис |
Цена заказа |
К курсу ЦБ |
Из чего складывается |
|---|---|---|---|---|
1 |
59 952 ₽ |
+15,0% |
курс ЦБ + 15% |
|
2 |
69 108 ₽ |
+32,6% |
курс ВТБ 88,6 ₽ + 30% |
|
3 |
74 028 – 76 322 ₽ |
+42,0…46,4% |
20% + НДС 22%, курс не назван |
|
4 |
75 902 ₽ |
+45,6% |
наличный курс Райффайзена 100 ₽ + 20% + НДС 5% |
|
5 |
89 100 ₽ |
+70,9% |
рублёвый прайс + 10% за юрлицо |
Между первым и последним местом — 29 148 ₽ в месяц. На дистанции в год это 350 тысяч рублей за три подписки. В общем, проводить исследования перед принятием решения о выборе партнёра бывает крайне выгодно.
Рад, если помог сэкономить вам время на самостоятельном ресёрче.
ToxaBes
(со вздохом и смотря вверх): Триста тридцать пять (с) ДМБ
Сейчас есть 2 тренда:
Цены на подписки растут и будут расти, т.к. Antropic до сих пор не показывает прибыль.
Китайские модели с открытыми весами не только становятся компактнее, но и уверено сокращают дистанцию до фронтирных моделей по качеству.
Исходя из этого рассмотрим вариант self-hosted решения для компании с командой из тридцати разработчиков, которые используют модели от Antropic.
Возьмем для примера свежую модель Qwen3.8-27B, которая обучалась с уклоном в нужную нам сферу.
Qwen3.8-27B превосходит Claude Opus 4.6 Max на 16 из 24 бенчмарков, сильнее всего в агентном кодинге (SWE-bench Pro: 61.7 против 53.4), следовании инструкциям (IFBench: 79.5 против 62.5) и работе с компьютером (OSWorld-Verified: 84.3 против 72.7).
При этом она проигрывает на задачах, завязанных на чистые знания, например, Humanity’s Last Exam (30.8 против 40.0), но как раз это нам не важно.
Независимая проверка LLM Stats показывает, что модели идут почти вровень (45.2 у Opus против 45.4 у Qwen). Т.е. по синтетике модели сопоставимы по качеству. Уровень Opus 4.6 Max более чем достаточен для ежедневной разработки.
Квантование FP8 (~28 ГБ весов) является эталоном для использования, с учетом необходимости KV-кеша (Q8_0) и максимального контекста (262К) нам понадобятся карты уровня NVIDIA RTX PRO 5000 Blackwell 48GB.
Общая формула расчета количества карт для комфортной работы разработчиков:
(кол-во разработчиков) / 10 + 1 => 30/10 + 1 = 4 карты
С учетом кеша и батчинга, а также неравномерности нагрузки от разных разработчиков этого будет достаточно.
Одна такая карта сейчас стоит 1 133 100 руб/шт. Я взял первую ссылку в гугле, уверен, что можно найти дешевле, но сейчас считаем максимально “неудачный” по средствам вариант.
4шт RTX PRO 5000 Blackwell (1 133 100 руб/шт) 4 532 400 руб
Сервер (2U/4U, CPU, ОЗУ, БП, охлаждение под 4 карты) ≈ 1 500 000 руб
Внедрение: развёртывание inference-стека (vLLM/TensorRT), интеграция с IDE, тестирование ≈ 700 000 руб
CAPEX итого ≈ 6 730 000 руб
Веса самой модели открыты и бесплатны для использования.
Электричество (4шт 300 Вт GPU + сервер, ~1,7 кВт, почти круглосуточно) ≈ 10 000 руб
Администрирование (0,3-0,5 ставки ML/DevOps-инженера на поддержку, мониторинг, обновление модели) ≈ 100 000 руб
OPEX итого ≈ 110 000 руб/мес
На человека/мес
Счёт от лучшего агента (БизнесПэй, курс ЦБ +15%) = 19 984 руб
То же с учётом экономии на налоге на прибыль = 14 988 руб
На 30 человек/мес
Счёт от лучшего агента (БизнесПэй, курс ЦБ +15%) = 599 520 руб
То же с учётом экономии на налоге на прибыль = 449 640 руб
На 30 человек/год
Счёт от лучшего агента (БизнесПэй, курс ЦБ +15%) = 7 194 240 руб
То же с учётом экономии на налоге на прибыль = 5 395 680 руб
Для сравнения: если бы платили через худшего агента (Global Payments из статьи), было бы дороже ещё на ~70%.
Экономия в месяц = (стоимость подписок, которую перестали платить) − (OPEX своего железа):
По валовому счёту агента (599 520 руб) ≈ 489 520 руб ≈ 14 месяцев
По чистой стоимости после налога на прибыль (449 640 руб) ≈ 339 640 руб ≈ 20 месяцев
То есть окупаемость около 1,5 лет, что вполне достойно.
Своя инфраструктура (CAPEX + OPEX) ≈ 10,7 млн руб
Подписки через лучшего агента (чистая стоимость) ≈ 16,2 млн руб
Подписки через лучшего агента (валовая) ≈ 21,6 млн руб
И это при условии что стоимость подписок не вырастет со временем.
Делайте сами.
juravlptica Автор
Вау, спасибо за такой детальный расчёт
Согласен, что большую часть бытовых задач уже можно решать опенсорсными моделями
Тем не менее, фронтирные модели вроде Fable или Astra, вокруг которой в последние пару дней столько шума, гораздо лучше будут справляться со сложными задачами
Предполагаю, что крупные команды действительно, с большой вероятностью, будут разворачивать локальные модельки, чтобы решать с их помощью большую часть задач, но какой-никакой расход на доступ к SOTA сохранится
ToxaBes
Я не вижу в потоковой разработке таких сложных задач, для которых нужны эти модели. Их просто нет. Исключение разве что в написании низкоуровневых драйверов. А уж веб-разработку локальные модели перекрывают с запасом.
Даже код параллельных вычислений на NVIDIA CUDA (вот где геморрой с правильным пиннингом памяти и расчетом грида) локальные модели уже достойно пишут.
Безусловно, он сохранится в R&D задачах, правда они редки в массе своей и будет достаточно одной-двух подписок. Через год-полтора и эту часть будут полностью покрывать локальные модели.
Уже сейчас правильно построенный harness для R&D задач показывает уровень Fable (на части задач даже опережает Fable! Mythos по понятным причинам не тестил).
Я не знаю что Антропики будут со всем этим делать. Бизнес в массе своей (да и многие разработчики) пока не знают о том что Антропики практически потеряли лидерство, а китайцы догоняют их семимильными шагами. Одно дело маркетинг и синтетические бенчмарки и совсем другое практические тесты на реальных задачах.
stikhonchuk
Илья, спасибо за тесты платежных систем, часто информация на сайтах скромно умалчивает все комиссии, и пока не проведешь платеж - не знаешь сколько это будет стоить!
Антон, пара уточняющих вопросов. Тоже думал над своим железом, но
иметь единственный сервер - достаточно большой риск, нужен второй на время переустановки моделей и на случай неисправностей первого, а это 1,5 - 2 раза увеличивает затраты
закладываться на 2-3 года вперед, когда модельки выходят чуть ли каждый месяц - по мне тоже рискованно, так популярные недавно H100 уже не слишком подходят для последних моделек, B200/B300 тоже могут через пару лет стать анахронизмом. Как вариант железо можно арендовать - это дороже чем купить свое, но решает вопрос со сменой конфигурации и бэкапом.
у меня не только задачи кодинга, но работа с текстами, и база знаний по проекту разрастается достаточно быстро, с окном 128к работать сложно - надо часто перегружать сессии, а это и время и токены. Окно 1М значительно комфортнее и быстрее. Я подозреваю что для больших проектов, где уже много кода и документации, также окно в 1М необходимо по крайней мере для написания ТЗ. А окно в 1М еще в 1,5 - 2 раза дороже.
Для себя сделал вывод, что свой/арендованный сервак нужен только тогда, когда никак нельзя делиться своим кодом, а в остальных случаях проще подписка через свое зарубежное ИП или платежные системы.
ToxaBes
Не встречал такого резервирования. Общий подход к LLM-серверу ничем не отличается подхода к серверу БД или, например, 1С. Вы же не делаете полное дублирование сервера для бухгалтерии, вместо этого используете бекапы. Тут тоже самое, те же бекапы и стандартное обслуживание ОС.
Сама модель это несколько файлов на диске с весами и конфигами и время ее разворачивания примерно равно времени пока эти файлы скопируются на диск в нужную папку.
С одной стороны вы правы, но тут есть нюанс. Производители железа (видеокарт) пекут новые карты как горячие пирожки и заинтересованы в несовместимости форматов. Но это формат, те, например, выходит модель в новом MXFP4 формате, который поддерживают карты начиная с Blackwell семейства, а остальные просто используют ненативную поддержку те либо модель работает чуть медленнее, либо будет занимать чуть больше места в памяти, но будет работать.
Все эти новые форматы пытаются уменьшить размер и вычисления пытаясь представить веса модели меньшим количество чисел до и после запятой. И они уже уперлись в предел. Подробнее об этой гонке я писал здесь.
Помимо этого, сами разработчики моделей теперь стремятся сделать модели одновременно меньше и быстрее за счет инновации в архитектуре моделей, а не в ее квантовании. Поэтому на современных картах ближайшие 6-8 лет проблем с запуском не будет.
Для примера, все модели вышедшие до сегодняшнего дня и помещающиеся на мою карту запускаются без проблем, а она была произведена в декабре 2020 года, т.е. почти 6 лет назад.
Вы не совсем правильно строите свою систему. Попытка положить вообще все в контекст это тупиковый путь. Вам необходима RAG-система с контекстуальным чанкингом. Я работаю с моделями на 262К контекста и его полностью хватает.
Почитайте о RAG-системах, думаю вы поймете как использовать их в своей работе. Я целые юридические отделы на них перевожу и ИИ-ассистент выдает информацию со точным ссылками на конкретные законы/акты и нормативные документы.
Тоже самое с внутрикорпоративными порталами, могу показать простой демо пример на обезличенных данных.
Помимо такой организации базы знаний по проекту полезно заставить харнесс написать скиллы по конкретной кодовой базе проекта и использовать их. Тогда и контекста хватает и качество отличное.
stikhonchuk
Да у меня тоже есть чат-боты с RAG, но использовать RAG внутри харнесс я не догадался, посмотрел действительно mcp-local-rag должен значительно снизить аппетит агента. Спасибо за идею!