Протистояння OpenAI та Anthropic за увагу розробників не вщухає: поки одна компанія розширює ліміти використання своєї флагманської моделі, інша вже втретє продовжує промо-доступ. За цим стоїть простіше питання, яке цікавить усіх, хто щодня працює з ШІ-агентами: яка модель зараз краще — GPT-5.6 Sol чи Claude Fable 5?
Читайте также: Забуті царі. Вчені розшифрували клинописні записи про трьох невідомих правителів Ассирії

OpenAI знімає обмеження після сплеску трафіку
Після минулотижневого розширеного релізу лінійки GPT-5.6 (Sol, Terra та Luna) на всіх користувачів OpenAI зафіксувала різке зростання трафіку — приблизно вдвічі вище попереднього піку. У відповідь компанія кілька разів за вихідні скидала ліміти використання для акаунтів ChatGPT Work і Codex, а також тимчасово прибрала обмеження на п’ятигодинне вікно використання для підписників Plus, Business і Pro — без уточнення, коли обмеження повернеться.
Інженер команди Codex Тібо Соттьо повідомив, що OpenAI також розгорнула оптимізації інференсу, які роблять Sol ефективнішою моделлю, а зекономлені ресурси передають користувачам — це має дати приблизно на 10% більше використання «з коробки». Крім того, функцію «банкованого» скидання лімітів (можливість зберегти скидання і активувати його пізніше) розширили з десктоп-застосунку на веб і мобільні клієнти, додавши її для близько 500 000 акаунтів ChatGPT Work і Codex.
Anthropic вкотре продовжує промо Fable 5
Тим часом Anthropic відповіла на посилення конкуренції черговим продовженням промоакції на Claude Fable 5, яка мала завершитися 12 липня, — тепер модель залишиться доступною на всіх платних планах Claude щонайменше до 19 липня. На період акції компанія також тримає тижневі ліміти Claude Code на 50% вищими за стандартні.
Бенчмарки: перемога залежить від задачі
Офіційні цифри двох компаній малюють картину «розділеної перемоги», а не явного лідера.
На Terminal-Bench 2.1 (тест на роботу з терміналом та агентні сценарії) GPT-5.6 Sol випереджає конкурента: 88,8% у звичайному режимі та 91,9% у режимі Ultra, який запускає кілька субагентів паралельно, проти приблизно 83–88% у Fable 5 (оцінки різняться залежно від джерела).
На SWE-Bench Pro — тесті на реальне вирішення issues в GitHub-репозиторіях — картина протилежна: Fable 5 показує 80,3%, тоді як OpenAI власного результату Sol за цим бенчмарком публічно не розкривала. На SWE-bench Verified Fable 5 взагалі лідирує серед усіх моделей із результатом 95%.
Fable 5 також помітно випереджає конкурентів на FrontierCode Diamond (29,3% проти, за деякими даними, лише 5,7% у GPT-5.5) — тесті на якість коду, придатного для продакшена. Водночас Sol Ultra веде на BrowseComp (92,2%) — бенчмарку складного пошуку інформації в вебі.
Ось окрема таблиця з усіма бенчмарками, які фігурували в матеріалах по обох моделях:
| Бенчмарк | Що вимірює | GPT-5.6 Sol | Claude Fable 5 | Хто лідирує |
|---|---|---|---|---|
| Terminal-Bench 2.1 | Робота в терміналі, агентні сценарії | 88,8% (base) / 91,9% (Ultra) | 83,4–88,0% (дані різняться за джерелом) | Sol |
| SWE-Bench Pro | Реальні issues з GitHub, багатомовні репозиторії | не публікувалось | 80,3% | Fable 5 |
| SWE-bench Verified | Класичний тест на патчі до issues | не публікувалось | 95,0% | Fable 5 |
| FrontierCode Diamond | Якість коду production-рівня | не публікувалось | 29,3% | Fable 5 |
| BrowseComp | Складний пошук інформації у вебі | 92,2% (Ultra) | не публікувалось | Sol |
| OSWorld 2.0 / OSWorld-Verified | Тривалі задачі з керування комп’ютером | 62,6% | 85,0% (інша версія тесту) | Fable 5* |
| CyberGym | Кібербезпека, вразливості | 84,5% | не публікувалось | Sol |
| ExploitGym / ExploitBench | Пошук і використання експлойтів | 33,7% (ExploitGym, 6-год ліміт) | 78,0% (ExploitBench) | некоректно порівнювати* |
| Toolathlon | Комплексне використання інструментів | 58,0% | не публікувалось | Sol |
| Humanity’s Last Exam (з інструментами) | Експертні знання найвищого рівня | не публікувалось | 64,5% | Fable 5 |
* Застереження: Всі цифри по Sol — заявлені OpenAI, незалежно поки не відтворені. Цифри по Fable 5 — переважно з релізної таблиці Anthropic, частина підтверджена сторонніми трекерами (Vals AI, BenchLM).
Загальний висновок з таблиці: Sol сильніший там, де тест побудований навколо тривалої агентної роботи в терміналі та інструментами (Terminal-Bench, CyberGym, Toolathlon, BrowseComp). Fable 5 сильніший там, де важлива глибина розв’язання реальних інженерних задач і якість коду (SWE-Bench Pro/Verified, FrontierCode, HLE).
Читайте также: Близнюк Юпітера. Астрономи виявили теплу екзопланету біля зірки, схожої на Сонце
Що кажуть самі користувачі
Перші враження спільноти на Reddit (гілки на r/OpenAI, r/ClaudeAI, r/ClaudeCode, r/codex, r/vibecoding) описують ситуацію так само неоднозначно, як і бенчмарки. Sol хвалять за ціну й витривалість у довгих агентних задачах: одному з користувачів однаковий тестовий прогін обійшовся у $8,39 на Sol проти $21,63 на Fable — і саме різниця в ціні підштовхує частину платних користувачів Claude Code переходити на Codex.
Водночас у прямих порівняннях інтерфейсів і дизайну спільнота послідовно віддає перевагу Fable 5: користувачі відзначають, що результати Fable «виглядають кращими» навіть коли автор порівняння формально називав переможцем Sol. Один із дописувачів на r/codex підсумував враження так: модель непогано тримає повний робочий день без додаткових підказок і добре справляється з субагентами, хоча «не така розумна», як Fable.
У прямих порівняннях команда Code Rabbit відзначає, що Fable 5 краще справляється з оцінкою архітектури, плануванням і аналізом UI Flow, тоді як Sol користувачі радше беруть як «виконавця» — модель, якій довіряють доведення вже спланованої Claude задачі до кінця, зокрема в багатоденних автономних сесіях, і яка ефективніше запускає субагентів.
Ось клон Google Earth, створений за допомогою GPT-5.6 sol (Ultra). Генерація коштувала 30 млн токенів.
У практичних кейсах результати теж різняться: копію гри Terraria Sol зібрала за 1 годину 20 хвилин і $35, тоді як Fable 5 впоралася за 2 години і $120; тест на відтворення Minecraft обидві моделі пройшли з першого разу, але Fable виявилась точнішою копією оригіналу, а Sol — швидшою (70 хвилин проти 90) і додала власні деталі. Частина інді-розробників 3D-ігор вважає, що GPT-5.6 краще передає «атмосферу» й залученість гравця, ніж Fable.
Окремо варто відзначити цінову різницю: в API Sol коштує $5/$30 за мільйон вхідних/вихідних токенів, тоді як Fable 5 — удвічі дорожче, $10/$50, і з 12 липня 2026 року доступ до неї в межах підписки припиняється — модель тарифікується окремо, за розцінками API.
Загальний висновок спільноти: Sol — дешевший і витриваліший «кодер-робітник» для агентних сценаріїв і термінальної роботи, Fable 5 — сильніший у дизайні, UI та задачах, де важлива «розумність» рішення, а не лише швидкість виконання.
Хто ж краще: GPT-5.6 Sol чи Claude Fable 5?
Однозначного переможця немає — вибір залежить від типу задач. Для агентної автоматизації, роботи з терміналом і бюджетних довгих запусків показники схиляються на бік GPT-5.6 Sol (особливо в режимі Ultra). Для реального вирішення issues в кодовій базі, дизайну інтерфейсів і задач, де ціна помилки вища за різницю у вартості токенів, лідирує Claude Fable 5. Обидві компанії, судячи з паралельних продовжень лімітів і промоакцій, добре це розуміють і намагаються втримати користувачів саме на «своєму» полі переваг.
Нагадаємо, раніше ми писали про «паніку навколо дистиляції». Як Китай зараз загрожує трильонному бізнесу обох компаній: OpenAI та Anthropic.
Читайте также: Збір NV на пікап для бригади Рубіж. Підсильте артилерію та виграйте ексклюзивні призи
Підписуйтесь на нас у соцмережах: Telegram | Facebook | LinkedIn
