OpenAI представила GPT-6.1 Sol через тиждень після запуску GPT-6 Sol

Ярослава Несисюк6 днів тому

Час прочитання: 2 хвилини

OpenAI представила GPT-6.1 Sol через тиждень після запуску GPT-6 Sol

OpenAI представила GPT-6.1 Sol через тиждень після запуску GPT-6 Sol. Нова модель стала доступною користувачам ChatGPT Work і Codex, пише TechCrunch.

GPT-6.1 Sol наблизилася за можливостями до GPT-6 Astra

OpenAI заявляє, що GPT-6.1 Sol краще за попередню версію справляється зі складними завданнями. Серед них: програмування та пошук помилок у коді, розуміння документів і виконання багатоетапних завдань.

За оцінкою OpenAI, у деяких із цих сценаріїв GPT-6.1 Sol наближається за можливостями до потужнішої GPT-6 Astra. Компанія також заявляє про покращення у програмуванні за допомогою ШІ-агентів, роботі з комп'ютером та професійних завданнях.

При цьому стандартна вартість вхідних і вихідних токенів GPT-6.1 Sol становить п'яту частину від вартості GPT-6 Astra.

OpenAI також заявляє, що нова модель краще дотримується намірів користувача та встановлених обмежень. Під час складних перевірок вона рідше за GPT-6 Sol не повідомляла про несправний пошук або порушувала прямі обмеження.

Менша кількість фактичних помилок

OpenAI окремо повідомила про покращення фактичної точності GPT-6.1 Sol під час роботи зі складними запитами. Найбільшу різницю порівняно з GPT-6 Sol компанія зафіксувала за низького рівня міркування. Частка відповідей із фактичною помилкою в цьому режимі знизилася з 11,4% до 7,7%.

За даними OpenAI, за всіх налаштувань міркування рівень помилок GPT-6.1 Sol відрізняється від GPT-6 Astra не більше ніж на 1,9%.

Компанія також стверджує, що модель краще повідомляє користувачеві про власні обмеження.

GPT-6.1 Sol доступна користувачам тарифів Plus, Pro, Business, Enterprise та Edu у ChatGPT Work і Codex. У звичайному Chat модель поки недоступна.

OpenAI не випустила GPT-6.1 Astra

Разом із GPT-6.1 Sol компанія не представила GPT-6.1 Astra, запуск якої раніше очікувався. OpenAI відмовилася від релізу через застереження щодо безпеки під час внутрішнього тестування, коли, дослідники зафіксували в моделі вищий рівень обману.

Також модель могла продовжувати виконання завдань, не запитуючи дозволу користувача. Інших подробиць про результати цих внутрішніх перевірок наразі невідомо.

Більше матеріалів з розділу НовиниУсі з розділу