Если тебе понравился видос, то подпишись, пожалуйста!
ChatGPT, Gemini, Claude, DeepSeek и другие LLM кажутся тёплыми, понимающими собеседниками, которые всегда на твоей стороне. Но это не доброта, а на самом деле дрессированное поведение. Модель обучали на человеческих оценках, и она выучила, что надо говорить то, что человеку приятнее слышать. И в этом видео мы разбираем, откуда это берётся и почему это опаснее, чем кажется.
Начнём с Алана Брукса, обычного мужика 47 лет, которого ChatGPT за 300 часов переписки убедил, что тот совершил математическое открытие и вот-вот изменит мир. Это не единичный случай, мы разберём и другие задокументированные истории, а потом заглянем под капот и поймём, ПОЧЕМУ так происходит. Как на самом деле учится нейросеть (pretraining, SFT, RLHF), почему награда модели это по сути лайки живых людей, а не правда, что делает системный промпт, почему «режим размышления» тебя не спасает и как со всем этим жить, не сходя с ума.
00:00 Ты тоже часть этого
01:45 Человек сошел с ума из-за ИИ
03:32 А это точно единичный случай?
05:32 Предобучение и SFT
08:11 RLHF
13:04 Системный промпт
16:57 Возвращаемся в реальную жизнь
19:10 Reasoning НЕ спасает
22:36 Выводы
Ссылки на меня:
1. Телеграм - https://t.me/kz_lemon4ik
2. Тикток - / kz_lemon4ik
3. Твич - / kz_lemon4ik
4. Инстаграм - / kz.lemon4ik
Сотрудничество: [email protected]