Букмарклет вычисляющий скорость gguf модели в llama.cpp на hf 30.08.2026 09:25 Weron2 0 Искусственный интеллект
Qwen3.8. MTP и тензорный параллелизм в llama.cpp: 75 ток/сек на двух RTX 3090 +10 29.08.2026 09:15 kotafey 26 Искусственный интеллект Настройка Linux Компьютерное железо
753B на одной видеокарте: разбор FreeToken +9 23.08.2026 17:59 danyathewriter 20 Машинное обучение Искусственный интеллект Высоконагруженные системы Компьютерное железо
Чем Go полезен при разработке AI‑агентов +26 19.08.2026 13:20 nezorflame 2 Блог компании AvitoTech Go Читальный зал Отладка Искусственный интеллект
А все-таки Qwen3.8-27B — думает меньше и быстрее чем 3.6 +75 19.08.2026 00:21 rtrgdfb 141 Искусственный интеллект
3 бита вместо 16: разбираем TurboQuant и когда его реально стоит включать +21 15.08.2026 08:01 ab429 3 Блог компании Selectel Искусственный интеллект IT-инфраструктура Open source
MoE на 5090 недобирает полтора раза, и дело не в маршрутизации +4 12.08.2026 08:45 Artem_Burei 4 Искусственный интеллект Компьютерное железо Исследования и прогнозы в IT Анализ и проектирование систем
Всё, что вы хотели знать о локальном ИИ, но стеснялись спросить +68 11.08.2026 17:16 danyathewriter 77 Машинное обучение Искусственный интеллект
Как я смог запустить 32b модель и сделать ее умнее в два раза на 3050 +6 29.07.2026 06:52 SimpleTitled 24 Математика C++ Ненормальное программирование Искусственный интеллект
Как я ужал русский эмбеддер до 24 млн параметров — и чуть не испортил его одной цифрой +7 28.07.2026 16:50 AGmind 9 Машинное обучение Искусственный интеллект Open source
Дообучил pretrain ruGPT3 XL 1.3B до уровня LLM (~2020 год, ChatGPT выйдет через 2 года). Сравнение с Gemma3 1B 2025 года +21 23.07.2026 06:20 Shannon 12 Машинное обучение Искусственный интеллект
Как мы запустили Ornith‑35B на ноутбуке с 8 ГБ VRAM и разогнали её до 99 ток/с на AMD Strix Halo +4 19.07.2026 23:10 PetrUfa 11 Машинное обучение Open source Видеокарты Linux Windows
Мини‑ПК на Strix Halo под параллельной нагрузкой: 236 tok/s на 32 одновременных запросах и три ошибки +10 18.07.2026 19:52 AGmind 13 Компьютерное железо Машинное обучение Искусственный интеллект Natural Language Processing Open source
Qwen 3.6 27b на 8-12gb vram в llama.cpp до 256к контекста +20 16.07.2026 10:04 jarkevithwlad 22 C++ C Настольные компьютеры Ненормальное программирование Программирование