Стивен Вольфрам - Как устроен ChatGPT? Полное погружение в принципы работы и спектр возможностей самой известной нейросети в мире

Как устроен ChatGPT? Полное погружение в принципы работы и спектр возможностей самой известной нейросети в мире
Название: Как устроен ChatGPT? Полное погружение в принципы работы и спектр возможностей самой известной нейросети в мире
Автор:
Жанры: Программы | Интернет | Зарубежная компьютерная литература | Научпоп: прочее
Серия: Цифровые технологии
ISBN: Нет данных
Год: 2024
Другие книги серии "Цифровые технологии"
О чем книга "Как устроен ChatGPT? Полное погружение в принципы работы и спектр возможностей самой известной нейросети в мире"

Никто этого не ожидал – даже его создатели: ChatGPT ворвался в наш мир как искусственный интеллект, способный создавать тексты, словно человек. Но как именно он работает? Что происходит внутри его «ИИ-разума»?

В этой книге выдающийся ученый и пионер вычислительной техники Стивен Вольфрам предлагает понятное и увлекательное объяснение устройства нейросети, основываясь на своем многолетнем научном опыте.

Узнайте, как ChatGPT, объединяя новейшие технологии нейронных сетей с фундаментальными знаниями о языке и человеческом мышлении, делает будущее настоящим.

Для кого книга

Если вы хотите не просто пользоваться нейросетями, а понимать, на что они способны и как именно работают, эта книга для вас.

Бесплатно читать онлайн Как устроен ChatGPT? Полное погружение в принципы работы и спектр возможностей самой известной нейросети в мире


Научный редактор Здоров Антон


На русском языке публикуется впервые


Все права защищены.

Никакая часть данной книги не может быть воспроизведена в какой бы то ни было форме без письменного разрешения владельцев авторских прав.


What Is ChatGPT Doing … and Why Does It Work?

© 2023 Stephen Wolfram.

Original English language edition published by Wolfram Media 100 Trade Center Dr. 6th Floor, Champaign Illinois 61820, USA.

Arranged via Licensor's Agent: DropCap Inc. and Igor Korzhenevskiy of Alexander Korzhenevski Agency (Russia). All rights reserved

© Издание на русском языке, перевод, оформление. ООО «Манн, Иванов и Фербер», 2024

* * *

Предисловие

Эта небольшая книга представляет собой попытку объяснить, как работает ChatGPT. В некотором смысле это история о технологиях. Но еще и разговор о науке и философии. И для того, чтобы рассказать эту историю, нам придется собрать воедино огромный спектр идей и открытий, сделанных на протяжении многих столетий.

Я сам с большим интересом и волнением наблюдаю, как вещи, которые так долго меня интересовали, объединяются в результате такого прогресса. Сложное поведение простых программ, погружение в суть языка и смыслообразования, а также практические возможности больших компьютерных систем – все это является частью истории ChatGPT.

ChatGPT основан на концепции нейронных сетей, составленной в 1940-х годах в качестве модели работы головного мозга. Я сам впервые спрограммировал нейронную сеть в 1983 году, но тогда ничего интересного из нее не вышло. Однако 40 лет спустя, когда у нас есть компьютеры, считающие в миллион раз быстрее, миллиарды страниц текста в интернете и целый ряд инженерных инноваций, ситуация совершенно иная. И, ко всеобщему удивлению, современная нейронная сеть, которая в миллиард раз больше созданной мной в 1983 году, способна делать то, что раньше считалось под силу только человеку, – генерировать осмысленный текст.

Эта книга, написанная вскоре после дебюта ChatGPT, состоит из двух частей. В первой объясняется, что такое ChatGPT и как ему удается выполнять сугубо человеческую работу по генерированию текста. Вторая посвящена вычислительным инструментам ChatGPT (выходящим за рамки человеческих возможностей) и сверхспособностям нашей системы Wolfram|Alpha в области вычисляемых знаний.

На момент написания книги прошло всего три месяца с запуска ChatGPT, и мы только начинаем понимать последствия этого события – как практические, так и интеллектуальные. Но пока ChatGPT служит напоминанием о том, что, несмотря на множество уже сделанных изобретений и открытий, сюрпризы всё еще возможны.

Стивен Вольфрам, 28 февраля 2023 года

Что делает ChatGPT и почему это работает?

Он просто добавляет по одному слову за раз

Тот факт, что ChatGPT может автоматически генерировать текст, который выглядит так, словно написан человеком, поражает наше воображение. Большинство людей недоумевают, как чат-бот выполняет интеллектуальную работу, которая прежде считалась доступной исключительно человеку. Как он это делает? Моя цель – дать вам хотя бы общее представление о том, что происходит внутри ChatGPT, а затем исследовать, как ему удается так хорошо создавать то, что выглядит как осмысленный текст. Хочу сразу сказать, что я собираюсь сосредоточиться на общих принципах работы ChatGPT и, хотя буду упоминать некоторые технические детали, не стану в них углубляться. (Все, о чем я буду говорить, применимо и к другим большим языковым моделям, подобным ChatGPT.)

Первое, что нужно объяснить, – ChatGPT всегда пытается создать «разумное продолжение» любого текста, который у него есть на данный момент. Под словами «разумное продолжение» мы подразумеваем «то, что можно ожидать, исходя из того, что люди уже написали на миллиардах веб-страниц».

Итак, давайте предположим, что у нас есть предложение «Самое лучшее в ИИ – это его способность…». Представьте, что вы прочитываете миллиарды страниц текста, написанных людьми (скажем, веб-страницы в интернете и оцифрованные книги), и находите все аналогичные предложения, а затем смотрите, какое слово чаще всего встречается в них на месте многоточия. ChatGPT делает что-то подобное, за исключением того, что (как я объясню позже) он не просматривает тексты буквально – он ищет фрагменты, которые «совпадают по смыслу». Результатом его работы является список слов, которые логически могут следовать за основным словом, ранжированных по степени вероятности их присутствия в этом предложении:

Самое лучшее в ИИ – это его способность…

(англ. The best thing about AI is its ability to…)

…учиться (англ. learn) – 4,5 %

…предсказывать (англ. predict) – 3,5 %

…создавать (англ. make) – 3,2 %

…понимать (англ. understand) – 3,1 %

…делать (англ. do) – 2,9 %

Примечательно, что, когда ChatGPT пытается написать эссе, по сути он просто снова и снова спрашивает: «Учитывая текст на данный момент, каким должно быть следующее слово?» – и каждый раз добавляет это новое слово. (Точнее, он добавляет так называемый токен, который может быть и частью слова; именно поэтому ChatGPT иногда может «составлять новые слова». Но об этом позже.)

Итак, на каждом этапе ChatGPT создает список слов с указанием вероятности их присутствия на данном месте. Но какое из них нужно выбрать, например, для эссе? Можно предположить, что это должно быть слово с самым высоким рейтингом (то есть то, для которого определена самая высокая вероятность). Однако именно здесь ChatGPT начинает проявлять свои вуду-способности. Потому что по какой-то причине (возможно, однажды мы ее даже узнаем), если всегда будем выбирать слово с самым высоким рейтингом, мы получим очень гладенькое эссе без малейшего признака креативности (и которое будет слово в слово повторять множество других текстов). Но если мы наугад выбираем слова с более низким рейтингом, то эссе получается «более интересное».

Здесь действует фактор случайности, а это значит, что, даже используя каждый раз один и тот же промпт[1], мы, скорее всего, получим разные эссе. И, как мы уже упоминали, у ChatGPT есть своя вуду-идея, то есть у него существует так называемый температурный параметр, который определяет, как будут использоваться слова с более низким рейтингом, и для создания эссе, оказывается, лучше всего подходит температура, равная 0,8. (Нужно подчеркнуть, что это никакая не теория – это просто вывод из того, что работает на практике. И например, понятие «температура» применяется потому, что здесь используются экспоненциальные распределения, знакомые нам из статистической физики, но нет никакой физической связи – по крайней мере насколько нам известно.)

Прежде чем мы продолжим, я должен объяснить, что ради простоты изложения не стану рассматривать всю систему, лежащую в основе ChatGPT. Вместо этого буду работать с более простой системой – GPT-2, которую можно запустить на обычном персональном компьютере. И поэтому практически для всего, что вам здесь покажу, я включу код на языке Wolfram, который вы сможете немедленно запустить на своем компьютере.


С этой книгой читают
9 правил, чтобы преуспеть в эпоху искусственного интеллекта и автоматизации.Машины уже здесь. Искусственный интеллект вышел далеко за пределы научных лабораторий и Кремниевой долины. Алгоритмы влияют на все вокруг, и пока мы обсуждаем, уничтожит ли автоматизация рабочие места, более важный вопрос остается за кадром: что значит быть человеком в мире, который все больше формируется машинами и для машин?Технологический колумнист New York Times Кевин
Ведущий мировой футуролог Боб Йохансен на основе исследований Института будущего показывает, как новый образ мышления позволит руководителям видеть и использовать возможности для развития бизнеса.Мышление полного спектра – это способность искать закономерности, выходя за рамки стереотипов. Мир быстро меняется, а в течение следующих 10 лет действительность изменится еще сильнее.Основные тенденции заключаются в том, что:– от экономики продукта мы п
Данная книга – своеобразная «скорая помощь» для новичков, которым нужно быстро разобраться с возможностями новой версии текстового процессора Mirosoft Word 2007. Кроме того, это полезное пособие для более опытных пользователей – с его помощью они смогут быстрее освоить новый интерфейс программы. В книге нет слишком подробных описаний, не рассматриваются экзотические возможности приложения. Ее основная цель – помочь вам за несколько минут найти от
Не секрет, что любая безупречно оформленная письменная работа всегда претендует на более высокую оценку. Если вы хотите научиться быстро и качественно оформлять рефераты и курсовые работы, эта книга станет для вас незаменимым помощником. Поиск нужной информации в Интернете, быстрый набор, сканирование и форматирование текстов, создание сложных математических формул и качественных иллюстраций больше не будут казаться чем-то чрезвычайно сложным и н
Когда-нибудь на любом компьютере неизбежно накапливается большое количество информации. Прочитав эту книгу, вы научитесь переносить ваши данные на компакт-диски или DVD, узнаете, как создавать диски с данными, музыкальные диски, DVD со всеми атрибутами. Если у вас скопилось большое количество аудио– и видеокассет со старыми записями, эта книга расскажет, как перенести их на цифровой носитель. Вы научитесь создавать этикетки для дисков, работать с
Современный бухгалтер немыслим без компьютера и бухгалтерских компьютерных программ, помогающих оформить платежные документы, приходные и расходные кассовые ордера, вести учет поступления и движения товаров, выписывать счета-фактуры и многое, многое другое. В книге подробно рассматриваются специализированные бухгалтерские программы «1С: Предприятие», 7.7 и 8.0, а также редактор электронных таблиц Microsoft Excel, приводятся конкретные примеры их
15 лет назад убили брата Осокина. Обидчики избежали наказания. И никаких доказательств, улик, только липовые показания несуществующих свидетелей. Наркоман, что не имеет никакого отношения к этому делу, но почему-то отсидел за убийство. И как связаны труп девушки, что обнаружили в коттедже бизнесмена Федоркова, записка о самоубийстве, рок-концерт в клубе «Факел», загаженная карета «скорой помощи» и смерть Максима Осокина.Лейтенант Данил Осокин и к
Главные чеховские мифотворцы, братья Александр и Михаил Чеховы, постарались на славу. Но, несмотря на то, что их рассказы отдают явным душком вранья, биографы писателя охотно тиражировали эти воспоминания, умалчивая об изнанке мифов.
Виорела не помнит ни своего имени, ни откуда она пришла. Чтобы выжить в новом мире, ей необходимо довериться. Вот только кому? Тому, кто пришел убить, но отчего-то пощадил? Или тому, кто ищет её, чтобы сделать своей женой? У каждого из мужчин своя тайна и своя выгода. Но на кону не только любовь и жизнь девушки, но и судьба трёх миров.Вира обязательно сделает правильный выбор и станет счастливой. Если Демиурги не слишком сильно будут вмешиваться
Знаете ли вы, что каждый текст в этой энциклопедии начинается с вопроса "Did you know that…" (Знаете ли вы, что…)? Это увлекательное пособие раскрывает массу интересных фактов, расширяя ваш кругозор и словарный запас одновременно.Удобный словарь после каждого текста помогает изучать новые слова и выражения, а вопросы идеально подходят для обсуждения.