Как деградирует продовый LLM-инференс: KV-cache, OOM и хвост p99 +11 04.08.2026 10:19 GRADDATA 0 Блог компании VK Tech Блог компании VK Машинное обучение Искусственный интеллект Высоконагруженные системы
Как деградирует продовый LLM-инференс: KV-cache, OOM и хвост p99 +11 04.08.2026 10:19 GRADDATA 0 Блог компании VK Tech Блог компании VK Машинное обучение Искусственный интеллект Высоконагруженные системы
Архитектура AI-сервисов: почему монолит убивает latency и GPU 21.05.2026 06:51 sproshchaev 3 Блог компании OTUS Карьера в IT-индустрии Data Engineering Искусственный интеллект