Шесть миллиардов прогонов ради одной галочки: как устроено ревью научного софта на GitHub +15 29.08.2026 11:59 Delnor 1 Open source Тестирование IT-систем Программирование GitHub Научно-популярное
Шесть LLM‑судей из четырёх лабораторий несут 1,9 независимого голоса из 6 +6 18.08.2026 16:35 itsjustmarsel 0 Машинное обучение Искусственный интеллект
Train и eval в ARC-AGI-2 — это разные распределения +2 18.08.2026 13:29 xodarev 0 Машинное обучение Искусственный интеллект Математика Научно-популярное Python
Я хотел просто спросить нейросети, где искать квартиру. В итоге собрал исследовательский пайплайн с 1197 тестами +4 13.08.2026 14:17 berdinskikh 2 Python Ненормальное программирование
Ваш бэктест нейронки врёт на ±10 процентных пунктов +7 12.08.2026 09:13 svtoroi 7 Машинное обучение Финансы в IT Искусственный интеллект Python
2160 раундов симуляции без кнопки «стоп». Исследование MiroFish, часть 3 +3 10.08.2026 11:56 Artboss 0 Искусственный интеллект Машинное обучение Анализ и проектирование систем Программирование
Жители Валдории живут 147 лет, а страна граничит с Германией и Японией одновременно. Исследование MiroFish. Часть 2 +3 07.08.2026 15:39 Artboss 17 Искусственный интеллект Машинное обучение Natural Language Processing Data Engineering
Что будет если загрузить в «симулятор общества» чистый lorem ipsum? Большое исследование MiroFish, часть 1 +3 05.08.2026 08:46 Artboss 0 Искусственный интеллект Машинное обучение Тестирование IT-систем Open source
«Скопируй промпт дважды и получишь +76%». Я решил проверить +13 03.08.2026 08:27 luka911a 10 Машинное обучение Natural Language Processing Искусственный интеллект
Внешний бенчмарк причинного recall: проверяем память ИИ-ассистента на YDB Яндекса +3 30.07.2026 21:56 ideavi 0 Искусственный интеллект Машинное обучение Natural Language Processing Открытые данные GitHub
Мы провели 35 контролируемых экспериментов с «экзотическими алгебрами» в нейросетях +6 27.07.2026 12:46 Exactor 2 Машинное обучение Математика Искусственный интеллект Научно-популярное
Пять проектов, где ИИ-агент проверяет сам себя — итоги хакатона Built with Claude +2 18.07.2026 07:17 stas-clear 0 Искусственный интеллект Машинное обучение Биотехнологии Хакатоны Open source
Я устал писать одноразовые скрипты для бенчмарков LLM и собрал харнесс, который сам считает Pareto-front +8 27.06.2026 16:21 Happynood 1 Машинное обучение Python Open source Высоконагруженные системы DevOps
MLE-bench: золото взято, а доказательства остались в /tmp +9 22.06.2026 13:32 dmagog 0 Машинное обучение Искусственный интеллект Python
Я попробовал считать нейросетевой слой в конечном поле Галуа GF(137): 4x по памяти, ARM NEON и честные ограничения +6 05.06.2026 15:10 ankro 6 C++ Машинное обучение Алгоритмы Open source Математика