Андрей Карпаты | Введение в LLM | Большие Языковые Модели | Часовая Лекция
Это часовая вводная лекция о больших языковых моделях (LLM), рассчитанная на широкую аудиторию. Большие языковые модели — ключевой технический компонент таких систем, как ChatGPT, Claude и Bard. Мы разберём, что они собой представляют, куда движется эта технология, проведём параллели с современными операционными системами и поговорим о некоторых проблемах безопасности, возникающих в рамках этой новой вычислительной парадигмы. Это видео основано на слайдах недавней лекции Андрея Карпаты на AI Safety Summit. Галлюцинации и «сны» LLM не устраняются с помощью дообучения. Дообучение лишь направляет эти «сны», превращая их в «сны полезного ассистента». Всегда осторожно относитесь к тому, что говорит вам LLM, особенно если модель отвечает исключительно по памяти. При этом, как и в случае с человеком, если LLM воспользовалась поиском или системой извлечения информации и необходимые сведения попали в «рабочую память» — контекстное окно модели, — ей можно немного больше доверять при обработке этой информации и формировании итогового ответа. Но если совсем коротко: на данный момент не стоит безоговорочно доверять тому, что говорят или делают LLM. Например, при использовании инструментов всегда рекомендуется перепроверять математические расчёты и код, созданные моделью. Как LLM использует такой инструмент, как браузер? Она генерирует специальные токены, например |BROWSER|. Когда программный код, управляющий работой LLM, обнаруживает эти токены, он перехватывает последующий вывод модели, отправляет его соответствующему инструменту, получает результат и после этого продолжает генерацию. Откуда LLM знает, когда нужно генерировать такие специальные токены? Это поведение формируется на этапе дообучения: в обучающих данных модели на примерах показывают, как и когда необходимо обращаться к браузеру. Кроме того, инструкции по использованию инструментов могут автоматически помещаться в контекстное окно модели — например, в «системное сообщение». Также к лекции прилагается более полноценная, примерно 1000-строчная версия файла run.c из проекта llama2.c. - github.com/karpathy/llama2.c/blob/master/run.c Ссылка на источник с оригиналом: https://www.youtube.com/watch?v=zjkBMFhNj_g&list=TLPQMjEwODIwMjaHOy47VoDEHA&index=20 Я делаю эти переводы в первую очередь потому, что сам хочу слушать на русском людей, которые прямо сейчас создают ИИ-индустрию и определяют её будущее. А раз перевожу для себя — почему бы не выкладывать и для вас. Без пересказов и чужих интерпретаций: просто первоисточник на русском. Если вам такое интересно — подписывайтесь на канал. Больше про ИИ и новые модели: https://t.me/+OXkP1y5UPqNiMDI6 Мой авторский канал в Тг: https://t.me/+L6tbv8Puhug0OGVi Мой Instagram - https://instagram.com/kos.ibragimov #КосИбрагимов #нейросети #ии #андрейкарпаты #andrejkarpathy 00:00:00 — Введение: лекция о больших языковых моделях (LLM) 00:00:20 — Инференс LLM: как модель генерирует ответы 00:04:17 — Обучение больших языковых моделей 00:08:58 — «Сны» и галлюцинации LLM 00:11:22 — Как работают большие языковые модели? 00:14:14 — Дообучение модели и превращение её в ассистента 00:17:52 — Подводим промежуточные итоги 00:21:05 — Дополнение: сравнения, инструкции для разметчиков, RLHF, синтетические данные и рейтинги моделей 00:25:43 — Законы масштабирования LLM 00:27:43 — Использование инструментов: браузер, калькулятор, интерпретатор и DALL·E 00:33:32 — Мультимодальность: зрение и аудио 00:35:00 — Мышление: Система 1 и Система 2 00:38:02 — Самосовершенствование моделей и «AlphaGo для LLM» 00:40:45 — Персонализация LLM и магазин GPT 00:42:15 — LLM как операционная система 00:45:43 — Введение в безопасность LLM 00:46:14 — Джейлбрейки (Jailbreaks) 00:51:30 — Промпт-инъекции (Prompt Injection) 00:56:23 — Отравление данных (Data Poisoning) 00:58:37 — Итоги: безопасность LLM 00:59:23 — Заключение Ссылка на МОЙ канал - https://youtube.com/@kos.ibragimov?si=PKDQFQx57oMu0Gv7 Ссылка на ЭТО видео - https://youtu.be/WdOTixW8wbY Подписывайтесь на канал и ставьте лайк — так YouTube поймёт, что такие видео стоит показывать чаще. А я пойму, что стоит делать их дальше. Автор видео публично дал право свободно использовать это видео в образовательных целях и для внутреннего обучения. Преподаватели, студенты, школы, университеты, некоммерческие организации, компании и отдельные учащиеся могут бесплатно использовать этот материал на занятиях, в учебных курсах, программах внутреннего обучения и других образовательных активностях. Видео переведено и опубликован с целью свободного распространения на русскоязычную аудиторию, и не преследует цели коммерческой перепродажи, распространения, внешнего коммерческого использования, а также изменение материала ни коим образом не искажает его первоначальный смысл.
Название:
Андрей Карпаты | Введение в LLM | Большие Языковые Модели | Часовая Лекция
Категория:
Разное