Генеалогия AI safety: как рождаются направления и как они умирают (2005-2026) -1 14.07.2026 07:55 MrsWallbreaker 0 Искусственный интеллект
Куда податься на финансирование по AI safety летом-осенью 2026: карта грантов, фондов и программ -2 05.07.2026 08:50 MrsWallbreaker 0 Искусственный интеллект Машинное обучение Научно-популярное Карьера в IT-индустрии IT-эмиграция
Один суффикс, чтобы взломать их всех +3 13.06.2026 05:01 MrsWallbreaker 4 Искусственный интеллект Natural Language Processing Машинное обучение
Poisoned Data — отравление данных для LLM и создание «Спящего Агента» 20.08.2024 06:00 MrsWallbreaker 0 Машинное обучение Искусственный интеллект Natural Language Processing
Стеганография в LLM и защита от нее 13.08.2024 06:00 MrsWallbreaker 0 Машинное обучение Искусственный интеллект Natural Language Processing
RLHF. История становления идеи — 4. HHH: helpful, honest, harmless, Instruct LLM, Constitutional AI 10.08.2024 06:00 MrsWallbreaker 0 Машинное обучение Искусственный интеллект Natural Language Processing
Не любой In-context learning одинаково полезен 06.08.2024 06:00 MrsWallbreaker 0 Машинное обучение Искусственный интеллект Natural Language Processing
RLHF. История становления идеи — 3. Supervised finetune, Протокольный сбор обратной связи, Batch RL 03.08.2024 06:00 MrsWallbreaker 0 Машинное обучение Искусственный интеллект Natural Language Processing
RLHF. История становления идеи — 2 26.07.2024 06:00 MrsWallbreaker 0 Машинное обучение Искусственный интеллект Natural Language Processing
Обучение с подкреплением на основе обратной связи от человека (RLHF). История становления идеи 19.07.2024 20:11 MrsWallbreaker 0 Машинное обучение Искусственный интеллект Natural Language Processing