GPT-6: революція в кодуванні та оптимізації чи скромний поступ?

Компанія OpenAI представила свою новітню розробку – модель GPT-6. Ця версія демонструє значні досягнення у сфері генерації коду, здатності до автономного виконання завдань на комп’ютері та ефективної роботи зі складними, багатоетапними проєктами.
Ця інформація поширена Telegram-каналом “Бекдор”, який посилається на результати незалежних тестів, проведених дослідницькою організацією Artificial Analysis.
Прорив у кодуванні та економія ресурсів
У рамках спеціалізованого тестування GPT-6 здобула 67 балів, що ставить її в один ряд із такими потужними моделями, як Fable 5 та Claude Opus 5. Однак, найвизначнішою перевагою GPT-6 стала її надзвичайна оптимізація споживання ресурсів.
GPT-6 використовує до 70% менше токенів порівняно навіть з попередньою версією GPT-5.6 Sol, а також значно економніша за основних конкурентів. Завдяки вдосконаленій обробці даних, витрати на виконання завдань, пов’язаних із написанням програмного коду, виявилися приблизно втричі нижчими, ніж у аналогічних моделей від інших розробників.

Результати тестів GPT-6 Astra від Artificial Analysis Index
Фото: artificialanalysis.ai
Підвищення точності, скорочення “галюцинацій” та робота з файлами
Експерти відзначили суттєве покращення надійності отримуваних результатів та стійкості до складних вхідних даних:
- У спеціалізованих тестах рівень “галюцинацій” (неправдивих відповідей) знизився з 92% до 51%.
- Загальна точність відповідей зросла на 4 процентні пункти.
- У тестах на довготривале багатозадачне планування модель показала приріст у 80 пунктів Elo, продемонструвавши високу стабільність під час обробки пов’язаних послідовностей завдань, що включають тисячі файлів.
Загальний інтелект: значний поступ чи повторення результатів?
Попри видатні успіхи у практичному застосуванні, фахівці Artificial Analysis поки що не констатують кардинального стрибка у фундаментальному мисленні моделі. За загальним інтелектуальним індексом GPT-6 отримала 61 бал, що відповідає показнику GPT-5.6 Sol.
Таким чином, ця модель дещо поступається нинішньому лідеру рейтингу – Fable 5.1, який здобув 66 балів.
Раніше з’явилася інформація про випуск смарт-годинника Moto Watch Ultra. Компанія Motorola представила флагманський смарт-годинник Moto Watch Ultra з вигнутим дисплеєм, можливістю мобільного зв’язку та розширеними функціями моніторингу стану здоров’я.
Підсумок від Українське життя:
Нова модель GPT-6 від OpenAI обіцяє бути надзвичайно корисною для розробників програмного забезпечення завдяки значному покращенню ефективності генерації коду та суттєвому зменшенню витрат ресурсів. Це може суттєво прискорити процес розробки та зробити його економічно вигіднішим. Водночас, для тих, хто шукає універсального помічника для загальних завдань, прогрес у “загальному інтелекті” виявився менш вираженим, хоча й надійність відповідей зросла.
Подробиці можна знайти на сайті: focus.ua
