Инференс LLM: от KV-кэша до продакшен-деплоя +10 27.07.2026 05:30 a_ryzhov 4 Блог компании hh.ru Блог компании Конференции Олега Бунина (Онтико) Машинное обучение Высоконагруженные системы Искусственный интеллект
Архитектура AI-сервисов: почему монолит убивает latency и GPU 21.05.2026 06:51 sproshchaev 3 Блог компании OTUS Карьера в IT-индустрии Data Engineering Искусственный интеллект
Как запустить свою LLM для инференса. Руководство по запуску: Ollama, vLLM, Triton, LM Studio, llama.cpp, SGLang +24 20.09.2025 19:31 maksimov_m 0 Machine Learning Машинное обучение Python DevOps