Я прогнал топ VRAM-калькуляторов для LLM — все ошибаются в одном и том же +5 08.09.2026 09:26 Isk4R1oT 0 Python Rust Искусственный интеллект Машинное обучение Высоконагруженные системы
3 бита вместо 16: разбираем TurboQuant и когда его реально стоит включать +21 15.08.2026 08:01 ab429 3 Блог компании Selectel Искусственный интеллект IT-инфраструктура Open source
Инференс LLM: от KV-кэша до продакшен-деплоя +10 27.07.2026 05:30 a_ryzhov 4 Блог компании hh.ru Блог компании Конференции Олега Бунина (Онтико) Машинное обучение Высоконагруженные системы Искусственный интеллект
Архитектура AI-сервисов: почему монолит убивает latency и GPU 21.05.2026 06:51 sproshchaev 3 Блог компании OTUS Карьера в IT-индустрии Data Engineering Искусственный интеллект
Как запустить свою LLM для инференса. Руководство по запуску: Ollama, vLLM, Triton, LM Studio, llama.cpp, SGLang +24 20.09.2025 19:31 maksimov_m 0 Machine Learning Машинное обучение Python DevOps