22 Липня, 2026

Що краще: GPT-5.6 Sol чи Claude Fable 5. Враження користувачів і результати бенчмарків

Протистояння OpenAI та Anthropic за увагу розробників не вщухає: поки одна компанія розширює ліміти використання своєї флагманської моделі, інша вже втретє продовжує промо-доступ. За цим стоїть простіше питання, яке цікавить усіх, хто щодня працює з ШІ-агентами: яка модель зараз краще — GPT-5.6 Sol чи Claude Fable 5?

Читайте также: Забуті царі. Вчені розшифрували клинописні записи про трьох невідомих правителів Ассирії

Що краще: GPT-5.6 Sol чи Claude Fable 5. Враження користувачів і результати бенчмарків

OpenAI знімає обмеження після сплеску трафіку

Після минулотижневого розширеного релізу лінійки GPT-5.6 (Sol, Terra та Luna) на всіх користувачів OpenAI зафіксувала різке зростання трафіку — приблизно вдвічі вище попереднього піку. У відповідь компанія кілька разів за вихідні скидала ліміти використання для акаунтів ChatGPT Work і Codex, а також тимчасово прибрала обмеження на п’ятигодинне вікно використання для підписників Plus, Business і Pro — без уточнення, коли обмеження повернеться.

Інженер команди Codex Тібо Соттьо повідомив, що OpenAI також розгорнула оптимізації інференсу, які роблять Sol ефективнішою моделлю, а зекономлені ресурси передають користувачам — це має дати приблизно на 10% більше використання «з коробки». Крім того, функцію «банкованого» скидання лімітів (можливість зберегти скидання і активувати його пізніше) розширили з десктоп-застосунку на веб і мобільні клієнти, додавши її для близько 500 000 акаунтів ChatGPT Work і Codex.

Anthropic вкотре продовжує промо Fable 5

Тим часом Anthropic відповіла на посилення конкуренції черговим продовженням промоакції на Claude Fable 5, яка мала завершитися 12 липня, — тепер модель залишиться доступною на всіх платних планах Claude щонайменше до 19 липня. На період акції компанія також тримає тижневі ліміти Claude Code на 50% вищими за стандартні.

Бенчмарки: перемога залежить від задачі

Офіційні цифри двох компаній малюють картину «розділеної перемоги», а не явного лідера.

На Terminal-Bench 2.1 (тест на роботу з терміналом та агентні сценарії) GPT-5.6 Sol випереджає конкурента: 88,8% у звичайному режимі та 91,9% у режимі Ultra, який запускає кілька субагентів паралельно, проти приблизно 83–88% у Fable 5 (оцінки різняться залежно від джерела).

На SWE-Bench Pro — тесті на реальне вирішення issues в GitHub-репозиторіях — картина протилежна: Fable 5 показує 80,3%, тоді як OpenAI власного результату Sol за цим бенчмарком публічно не розкривала. На SWE-bench Verified Fable 5 взагалі лідирує серед усіх моделей із результатом 95%.

Fable 5 також помітно випереджає конкурентів на FrontierCode Diamond (29,3% проти, за деякими даними, лише 5,7% у GPT-5.5) — тесті на якість коду, придатного для продакшена. Водночас Sol Ultra веде на BrowseComp (92,2%) — бенчмарку складного пошуку інформації в вебі.

Ось окрема таблиця з усіма бенчмарками, які фігурували в матеріалах по обох моделях:

БенчмаркЩо вимірюєGPT-5.6 SolClaude Fable 5Хто лідирує
Terminal-Bench 2.1Робота в терміналі, агентні сценарії88,8% (base) / 91,9% (Ultra)83,4–88,0% (дані різняться за джерелом)Sol
SWE-Bench ProРеальні issues з GitHub, багатомовні репозиторіїне публікувалось80,3%Fable 5
SWE-bench VerifiedКласичний тест на патчі до issuesне публікувалось95,0%Fable 5
FrontierCode DiamondЯкість коду production-рівняне публікувалось29,3%Fable 5
BrowseCompСкладний пошук інформації у вебі92,2% (Ultra)не публікувалосьSol
OSWorld 2.0 / OSWorld-VerifiedТривалі задачі з керування комп’ютером62,6%85,0% (інша версія тесту)Fable 5*
CyberGymКібербезпека, вразливості84,5%не публікувалосьSol
ExploitGym / ExploitBenchПошук і використання експлойтів33,7% (ExploitGym, 6-год ліміт)78,0% (ExploitBench)некоректно порівнювати*
ToolathlonКомплексне використання інструментів58,0%не публікувалосьSol
Humanity’s Last Exam (з інструментами)Експертні знання найвищого рівняне публікувалось64,5%Fable 5

* Застереження: Всі цифри по Sol — заявлені OpenAI, незалежно поки не відтворені. Цифри по Fable 5 — переважно з релізної таблиці Anthropic, частина підтверджена сторонніми трекерами (Vals AI, BenchLM).

Загальний висновок з таблиці: Sol сильніший там, де тест побудований навколо тривалої агентної роботи в терміналі та інструментами (Terminal-Bench, CyberGym, Toolathlon, BrowseComp). Fable 5 сильніший там, де важлива глибина розв’язання реальних інженерних задач і якість коду (SWE-Bench Pro/Verified, FrontierCode, HLE).

Читайте также: Близнюк Юпітера. Астрономи виявили теплу екзопланету біля зірки, схожої на Сонце

Що кажуть самі користувачі

Перші враження спільноти на Reddit (гілки на r/OpenAI, r/ClaudeAI, r/ClaudeCode, r/codex, r/vibecoding) описують ситуацію так само неоднозначно, як і бенчмарки. Sol хвалять за ціну й витривалість у довгих агентних задачах: одному з користувачів однаковий тестовий прогін обійшовся у $8,39 на Sol проти $21,63 на Fable — і саме різниця в ціні підштовхує частину платних користувачів Claude Code переходити на Codex.

Водночас у прямих порівняннях інтерфейсів і дизайну спільнота послідовно віддає перевагу Fable 5: користувачі відзначають, що результати Fable «виглядають кращими» навіть коли автор порівняння формально називав переможцем Sol. Один із дописувачів на r/codex підсумував враження так: модель непогано тримає повний робочий день без додаткових підказок і добре справляється з субагентами, хоча «не така розумна», як Fable.

У прямих порівняннях команда Code Rabbit відзначає, що Fable 5 краще справляється з оцінкою архітектури, плануванням і аналізом UI Flow, тоді як Sol користувачі радше беруть як «виконавця» — модель, якій довіряють доведення вже спланованої Claude задачі до кінця, зокрема в багатоденних автономних сесіях, і яка ефективніше запускає субагентів.

Ось клон Google Earth, створений за допомогою GPT-5.6 sol (Ultra). Генерація коштувала 30 млн токенів.

У практичних кейсах результати теж різняться: копію гри Terraria Sol зібрала за 1 годину 20 хвилин і $35, тоді як Fable 5 впоралася за 2 години і $120; тест на відтворення Minecraft обидві моделі пройшли з першого разу, але Fable виявилась точнішою копією оригіналу, а Sol — швидшою (70 хвилин проти 90) і додала власні деталі. Частина інді-розробників 3D-ігор вважає, що GPT-5.6 краще передає «атмосферу» й залученість гравця, ніж Fable.

Окремо варто відзначити цінову різницю: в API Sol коштує $5/$30 за мільйон вхідних/вихідних токенів, тоді як Fable 5 — удвічі дорожче, $10/$50, і з 12 липня 2026 року доступ до неї в межах підписки припиняється — модель тарифікується окремо, за розцінками API.

Загальний висновок спільноти: Sol — дешевший і витриваліший «кодер-робітник» для агентних сценаріїв і термінальної роботи, Fable 5 — сильніший у дизайні, UI та задачах, де важлива «розумність» рішення, а не лише швидкість виконання.

Хто ж краще: GPT-5.6 Sol чи Claude Fable 5?

Однозначного переможця немає — вибір залежить від типу задач. Для агентної автоматизації, роботи з терміналом і бюджетних довгих запусків показники схиляються на бік GPT-5.6 Sol (особливо в режимі Ultra). Для реального вирішення issues в кодовій базі, дизайну інтерфейсів і задач, де ціна помилки вища за різницю у вартості токенів, лідирує Claude Fable 5. Обидві компанії, судячи з паралельних продовжень лімітів і промоакцій, добре це розуміють і намагаються втримати користувачів саме на «своєму» полі переваг.

Нагадаємо, раніше ми писали про «паніку навколо дистиляції». Як Китай зараз загрожує трильонному бізнесу обох компаній: OpenAI та Anthropic.

Читайте также: Збір NV на пікап для бригади Рубіж. Підсильте артилерію та виграйте ексклюзивні призи

Підписуйтесь на нас у соцмережах: Telegram | Facebook | LinkedIn

Автор admin

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *