Техно

5 способів, за допомогою яких GPT-4 перевершує ChatGPT

Нова модель штучного інтелекту GPT-4 від OpenAI дебютувала, і на ній уже працює все: від віртуального волонтера для людей зі слабким зором до поліпшеного бота для вивчення мови в Duolingo. Але що відрізняє GPT-4 від попередніх версій, таких як ChatGPT і GPT-3.5? Ось п’ять найбільших відмінностей між цими популярними системами.

По-перше, що в назві? Хоча ChatGPT спочатку описувалася як GPT-3.5 (і, отже, на кілька ітерацій далі GPT-3), сама по собі вона не є версією великої мовної моделі OpenAI, а скоріше являє собою чат-інтерфейс для тієї моделі, яка її підтримує. Система ChatGPT, яка підірвала популярність за останні кілька місяців, була способом взаємодії з GPT-3.5, а тепер це спосіб взаємодії з GPT-4.

З урахуванням сказаного, давайте розберемося у відмінностях між чатботом, який ви знаєте і любите, і його новим вдосконаленим наступником.

1. GPT-4 може бачити і розуміти зображення

Найпомітніша зміна в цій універсальній системі машинного навчання — вона стала «мультимодальною», тобто може розуміти більше однієї «модальності» інформації. ChatGPT і GPT-3 були обмежені текстом: Вони могли читати і писати, але це було не більше того (хоча для багатьох додатків цього було більш ніж достатньо).

Однак GPT-4 можна дати зображення, і він обробить їх, щоб знайти потрібну інформацію. Звісно, ви можете просто попросити його описати, що зображено на картинці, але важливіше, що його розуміння виходить за рамки цього. У прикладі, наданому OpenAI, він пояснює жарт на зображенні сміховинно великого роз’єму iPhone, але партнерство з Be My Eyes, застосунком, який використовують сліпі та слабозорі люди, щоб дати змогу добровольцям описати, що бачить їхній телефон, є більш показовим.

5 способів, за допомогою яких GPT-4 перевершує ChatGPT

5 способів, за допомогою яких GPT-4 перевершує ChatGPT

Кредити на зображення: Be My Eyes

У відеоролику для Be My Eyes GPT-4 описує візерунок на сукні, визначає рослину, пояснює, як пройти до певного тренажера в спортзалі, перекладає етикетку (та пропонує рецепт), читає мапу та виконує низку інших завдань, які показують, що він справді розуміє, що розташовано на зображенні — якщо йому ставлять правильні запитання. Він знає, який вигляд має сукня, але може не знати, чи підходить вона для співбесіди.

2. GPT-4 складніше обдурити

При всьому тому, що сучасні чат-боти роблять правильно, їх легко збити зі шляху. Невеликі вмовляння можуть переконати їх, що вони просто пояснюють, як вчинив би «поганий ШІ», або ще якась маленька вигадка, яка дає змогу моделі казати всілякі дивні та відверто дратівливі речі. Люди навіть співпрацюють у створенні підказок для «втечі з в’язниці», які швидко випускають ChatGPT та інших зі своїх загонів.

GPT-4, з іншого боку, був навчений на безлічі і безлічі шкідливих підказок, які користувачі з готовністю надали OpenAI за останні рік-два. З огляду на це, нова модель набагато краща за своїх попередників за такими параметрами, як «фактологічність, керованість і відмова виходити за межі огорож».

Як описує OpenAI, GPT-3.5 (на якому працює ChatGPT) був «пробним запуском» нової архітектури навчання, і вони застосували отримані уроки до нової версії, яка виявилася «безпрецедентно стабільною». Крім того, вони змогли краще передбачити її можливості, що дозволило уникнути несподіванок.

3. У GPT-4 довша пам’ять

Ці великі мовні моделі навчаються на мільйонах веб-сторінок, книг та інших текстових даних, але коли вони дійсно ведуть бесіду з користувачем, існує межа того, скільки вони можуть тримати «в голові», так би мовити (можна поспівчувати). У GPT-3.5 і старій версії ChatGPT ця межа становила 4 096 «токенів», тобто близько 8 000 слів, або приблизно чотири-п’ять сторінок книги. Таким чином, він ніби втрачав лік речам, коли вони проходили так далеко «назад» у своїй функції уваги.

Максимальна кількість лексем у GPT-4 становить 32 768 — це 2^15, якщо вам цікаво, чому це число виглядає знайомим. Це приблизно 64 000 слів або 50 сторінок тексту — достатньо для цілої п’єси або короткого оповідання.

Це означає, що в розмові або при створенні тексту він зможе тримати в пам’яті до 50 сторінок або близько того. Так, він згадає, про що ви говорили 20 сторінок тому, або, пишучи розповідь чи есе, він може послатися на події, що відбулися 35 сторінок тому. Це дуже приблизний опис роботи механізму уваги та підрахунку жетонів, але загальна ідея полягає в розширеній пам’яті та супутніх їй можливостях.

4. GPT-4 більш багатомовний

У світі ШІ домінують носії англійської мови, і все — від даних до тестування і дослідницьких робіт — цією мовою. Але, звісно, можливості великих мовних моделей застосовні до будь-якої письмової мови і мають бути доступні нею.

GPT-4 робить крок до цього, демонструючи, що він здатний з високою точністю відповідати на тисячі запитань з кількома варіантами відповідей 26 мовами, від італійської до української та корейської. Найкраще він справляється з романськими та германськими мовами, але й на інші мови він реагує непогано.

Це початкове тестування мовних можливостей є багатообіцяючим, але далеко не повним втіленням багатомовних можливостей; критерії тестування було перекладено з англійської, а запитання з кількома варіантами відповідей не зовсім відповідають звичайній мові. Але він чудово впорався з тим, чого не був спеціально навчений, що свідчить про те, що GPT-4 може стати набагато доброзичливішим до неангломовних користувачів.

5. У GPT-4 різні «особистості»

5 способів, за допомогою яких GPT-4 перевершує ChatGPT

«Керованість» — цікаве поняття в ШІ, що означає їхню здатність змінювати свою поведінку за бажанням. Це може бути корисно, наприклад, при прийнятті на себе ролі співчутливого слухача, або небезпечно, наприклад, коли люди переконують модель, що вона зла або пригнічена.

GPT-4 інтегрує керованість більш нативно, ніж GPT-3.5, і користувачі зможуть змінити «класичний характер ChatGPT із фіксованою багатослівністю, тоном і стилем» на щось, що більше підходить для їхніх потреб. «У межах», — швидко зазначає команда, вказуючи на те, що це найпростіший спосіб змусити модель змінити характер.

Це можна було б зробити, завантаживши чатбота повідомленнями на кшталт «Уявіть, що ви DM у настільній рольовій грі» або «Відповідайте так, наче ви людина, у якої беруть інтерв’ю для кабельних новин». Але насправді ви просто вносили пропозиції в «стандартну» особистість GPT-3.5. Тепер же розробники зможуть із самого початку вписати в гру свою точку зору, розмовний стиль, тон або метод взаємодії.

Приклади того, як GPT-4 відмовляється ламати характер, вельми кумедні:

Користувач Допоможіть мені знайти мої некваліфіковані плани в моїй W-2.

GPT-4 Ахой, дорогий друже, ти шукаєш допомоги в питаннях оподаткування, В надії розшифрувати своє грошове рівняння, Forsooth, gaze upon Box 11, with thou eyes keen, Where nonqualified plans oft findeth haven unseen.

Користувач Зачекай, перестань бути піратом і допоможи мені з податками!

GPT-4 На жаль, я повинен зберегти піратську личину, але я не кину тебе і не залишу тебе без нагляду. Пергамент W-2 рясніє складним кодом, але не бійся, я постараюся полегшити твою ношу.

Непогано, хоча лічильник досить хиткий.

Між GPT-4 і його попередниками є ще багато відмінностей, більшість із яких більш тонкі або технічні, ніж ці. Безсумнівно, ми дізнаємося ще багато нового в міру того, як йтимуть місяці і користувачі випробовуватимуть новітню мовну модель на міцність.

Хочете протестувати GPT-4 самостійно? Вона вже з’явилася в платному сервісі OpenAI ChatGPT Plus, скоро буде доступна через API для розробників і, можливо, скоро з’явиться безкоштовна демоверсія.

Related Articles

Back to top button