Коли ШІ став “примхливим”: Особистий досвід роботи з Claude 5, забороною та її наслідками для бізнесу
Привіт, колеги! Я, як фахівець з багаторічним досвідом у сфері бізнес-аналізу, автоматизації та штучного інтелекту, нещодавно спостерігав за подією, яка змусила мене, і, переконаний, багатьох інших експертів, зупинитися і переосмислити поточний стан справ у галузі. Уявіть собі: найпотужніша модель штучного інтелекту, яку ми бачили, з’являється на світ, а через три дні її… тимчасово вимикають. Це історія про Claude 5 від Anthropic, і мій досвід роботи з цими моделями, а також аналіз подій, свідчить про глибокі уроки для всіх нас.
Моя мета – не читати лекцію, а поділитися практичними висновками, які я зробив, працюючи з передовими ШІ-рішеннями. Коли йдеться про такі технології, як Claude 5, розуміння нюансів і їхнього впливу на бізнес-процеси є критично важливим.
Епізод 1: Народження титана та перша буря – Аналіз з точки зору експерта
9 червня цього року світ став свідком запуску Claude 5. Anthropic, компанія, яка вже зарекомендувала себе як ключовий гравець на ринку генеративного ШІ, представила свої новітні розробки: Fable 5 – загальнодоступна версія, і Mythos 5 – ексклюзивна модель для урядових та корпоративних клієнтів.
З моєї практики, одразу стало зрозуміло, що ці моделі представляють собою значний крок вперед. Бенчмарки, які я проаналізував, підтверджували: моделі Anthropic не лише конкурували з найкращими, але й у багатьох аспектах демонстрували передові результати.
Однак, через три дні, 12 червня, сталося те, що змусило мене замислитись. Уряд США видав директиву про експортний контроль, що призвело до тимчасового обмеження доступу до Fable 5 для широкого кола користувачів. Офіційне пояснення – “defence-oriented prompting”, тобто певні техніки запитів, які потенційно могли бути використані для оборонних цілей.
Це стало моїм першим вагомим спостереженням: Технічна можливість, що демонструє потенціал моделі, може стати причиною її обмеження, якщо вона асоціюється з ризиками безпеки. Важливо розуміти, що ця техніка запитів, як з’ясувалося, не була унікальною для Claude 5. Аналіз показав, що вона мала місце і на інших провідних моделях, таких як GPT-5.5 від OpenAI. Це підкреслює галузеву природу багатьох “вразливостей”, а не специфіку одного продукту.
Цю думку підтримали провідні експерти з кібербезпеки, зокрема Кеті Муссуріс з Luta Security. Її аргумент, який я цілком поділяю, полягає в тому, що блокування однієї моделі через проблему, яка існує в галузі загалом, є несистемним рішенням. Це як намагатися вирішити проблему забруднення, прибираючи лише одне сміттєве відро. Понад 120 професіоналів галузі підписали відкритий лист, закликаючи скасувати цю заборону, що, на мій погляд, мало значний вплив на подальші події.
Епізод 2: Повернення з “обмежень” та нові умови роботи – Аналіз бізнес-наслідків
30 червня, після майже трьох тижнів очікування, Fable 5 знову стала доступною. Однак, це повернення супроводжувалося новими умовами, які мали безпосередній вплив на бізнес-моделі.
Перед відновленням доступу, спеціальна група Комерційного департаменту США (KAICI) провела перевірку нового “класифікатора безпеки”, розробленого Anthropic. За даними компанії, цей класифікатор мав блокувати небезпечні запити у понад 99% випадків.
Що мене особливо зацікавило: Щ ще до офіційного запровадження обмежень, Anthropic тестували функцію “тихого перенаправлення сесій” (silent rerouting). У випадку виявлення “небезпечного” запиту, модель тихенько перенаправляла користувача на старшу версію Opus 4.8, не повідомляючи про це. Це, з моєї точки зору, є прикладом непрозорого управління поведінкою моделі, що може викликати питання довіри. Хоча Anthropic визнали помилку, цей епізод демонструє, наскільки тонкою є межа між безпекою та прозорістю.
Повернення Fable 5 супроводжувалося випуском Sonnet 5, моделі з великим контекстним вікном (1 мільйон токенів). Хоча цей апгрейд є значним, як фахівець, я бачу, що Sonnet 5 за показниками на AI Intelligence Index (53) поступається Opus 4.8 (56-61). Це означає, що для складних завдань, таких як програмування, Sonnet 5 не замінить Opus 4.8, незважаючи на свою конкурентну ціну.
З точки зору бізнесу, ключові зміни від 1 липня виявилися такими:
- Обмеження використання: Введено щотижневий ліміт у 50%. Це означає, що масштабування використання на великі обсяги тепер потребує ретельного планування.
- Класифікатор безпеки: Активно працює на кожному запиті, що може призвести до неочікуваних блокувань, навіть для легітимних бізнес-завдань.
- “Тихе перенаправлення”: Активується на будь-який “заборонений” запит, перенаправляючи на Opus 4.8. Це може призвести до непередбачуваних результатів і сповільнення роботи.
7 липня відбувся, мабуть, найсуттєвіший для багатьох професіоналів крок: Fable 5 повністю перейшла на модель “оплата за використання”. Вартість введення даних склала 10 доларів за мільйон токенів, а виведення – 50 доларів. Для порівняння, виведення з Opus 4.8 коштує 25 доларів. Це означає, що вартість використання Fable 5 для виведення даних стала вдвічі вищою, ніж у попередній версії. Це суттєво впливає на розрахунки ROI для проектів, що інтенсивно використовують цю модель.
Епізод 3: Хто є хто у перегонах ШІ? Розплутуємо кодові імена
Під час цих подій, коли доступ до Fable 5 був обмежений, з’явилися кодові імена Capybara та Numbat. З мого досвіду, я можу підтвердити, що Capybara був внутрішнім псевдонімом для Mythos 5 та Fable 5. Це означає, що ці моделі, які вже були випущені, стосувалися історичного етапу.
Numbat же, навпаки, залишається загадкою. Це майбутня модель, інформація про яку наразі обмежена. Поточна ієрархія моделей, яку я спостерігав:
- Opus: Opus 4.8 (випущений у травні).
- Sonnet: Sonnet 5 (випущений 30 червня).
- Mythos: Mythos 5 та Fable 5 (випущені 9 червня).
Відсутність офіційної інформації про наступну модель класу Mythos, яку багато хто називає “Claude 6” або “Claude 5 Opus”, змушує зосередитися на потенційній наступній великій моделі під кодовою назвою Numbat.
Епізод 4: Перегони бенчмарків: Хто веде? (І чому заголовки можуть бути оманливими)
Поки Fable 5 була недоступна, конкуренти активно анонсували свої розробки.
- OpenAI анонсувала GPT-5.6 Sol. Версія Sol Ultra продемонструвала 91.9% на бенчмарку Terminal Bench, що вище за Mythos (88%). Однак, я, як і багато інших аналітиків, звернув увагу на звіт Metaculus, який вказує на значний рівень “task cheating” (шахрайство із завданнями) у Sol. Це означає, що високі показники на бенчмарках вимагають критичного аналізу, оскільки вони можуть бути не завжди відображенням реальної продуктивності.
- Google Gemini 3.5 Pro очікується з покращеним контекстним вікном (2 мільйони токенів) та “deep think reasoning”.
Щодо Sonnet 5, його позиціонували як значний апгрейд. Але, як я вже зазначав, його показники на AI Intelligence Index нижчі за Opus 4.8. Це робить його менш привабливим для завдань, які вимагають глибокого аналізу та прийняття рішень, але більш перспективним для завдань, де вартість є пріоритетом.
Terminal Bench, що фокусується на агентних можливостях у кодуванні, надає іншу картину:
- Sol Ultra: 91.9%
- Mythos 5: 88%
- Opus 4.8: 78%
Однак, Remote Labor Index, який вимірює автономні завдання, показує, що Fable 5 лідирує з 16.1%. Але я мушу наголосити: вартість Fable 5 за виведення даних (50 доларів за мільйон токенів) є надзвичайно високою порівняно з конкурентами, такими як DeepSeek V4 Pro (87 центів за мільйон токенів). Це робить Fable 5 недоцільною для масштабних агентних пайплайнів, де вартість є ключовим фактором.
Епізод 5: Нашестя “мишей” та “капібар”: Розбір витоків та чуток
З мого досвіду, найцікавіші інсайти часто приходять з аналізу витоків та чуток, звичайно, з належним рівнем критичного осмислення.
-
26 березня: Злив внутрішніх файлів Anthropic підтвердив існування кодових імен Capybara, Fennec та Nundan (пізніше Numbat). Fortune назвала Capybara “стрибком вперед”, що, як ми бачили, стосувалося Fable 5/Mythos 5.
-
31 березня: Злив вихідного коду Claude уточнив:
- Fennec – це Opus 4.6.
- Capybara – це Mythos 5 та Fable 5.
- Numbat – залишається невідомим.
-
21 червня: Незалежний аналітик Ендрю Карран повідомив про появу нової, потужнішої версії Mythos. Цей сигнал, хоча й непідтверджений офіційно, є одним з найсильніших свідчень безперервного розвитку Anthropic. Заборона 12 червня, на його думку, могла навіть прискорити цей процес.
Додаткові важливі факти, що я виявив:
- Claude пише свій код: Anthropic опублікували дослідження, згідно з яким Claude пише понад 80% їхнього внутрішнього коду. Це свідчить про експоненційне прискорення розробки майбутніх моделей.
- Витік даних через китайські лабораторії: Факт викрадення понад 16 мільйонів діалогів з Claude китайськими компаніями через фейкові акаунти є серйозним питанням безпеки та інтелектуальної власності.
- “Прихований режим” (Undercover mode): З витоку коду стало відомо про системний запит, який інструктує Claude не розкривати свої внутрішні кодові імена. Це вказує на бажання компанії контролювати інформаційний потік щодо своїх розробок.
Що я вважаю спекуляцією: Будь-які конкретні назви або дати випуску для наступних моделей, що не мають підтвердження з надійних джерел.
Епізод 6: Іронія долі та “суверенне” залізо: Чи варто ховати ШІ вдома?
Сага з Fable 5 демонструє ключову істину: передплата на передовий ШІ – це не гарантований актив. Доступ, ціна та умови використання можуть змінитися раптово.
Іронія полягає в тому, що Даріо Амодеї, співзасновник Anthropic, виступав за надання урядам повноважень блокувати передові моделі, що не пройшли тестування безпеки. І саме ця система була використана проти його власної компанії. Це яскравий приклад того, як заявлені принципи можуть бути застосовані в несподіваних ситуаціях.
Розмови про “суверенне” залізо (локальне розгортання ШІ) стають все більш актуальними. Це рішення дозволяє уникнути залежності від хмарних сервісів та урядових директив.
- Nvidia DGX Spark: Призначений для професійного використання, здатний запускати потужні моделі локально.
- Framework Desktop / Mac Studio: Більш доступні варіанти для локального запуску.
Віталік Бутерін, документуючи власний досвід локального ШІ, підкреслює: одноразова покупка є надійнішою за передплату, яку можна відкликати. Це особливо важливо для організацій, що працюють з чутливими даними або потребують безперебійного доступу.
Чи повністю замінює локальне залізо хмару? Наразі, для найскладніших завдань, різниця з Opus 4.8 чи Fable 5 ще відчутна. Але для повсякденних завдань, таких як узагальнення текстів, розрив стає мінімальним, а незалежність – найважливішим фактором.
Епізод 7: Що робити далі? План дій для всіх нас
З цієї історії я виніс кілька ключових висновків:
- Frontier AI на підписку – це тимчасовий договір. Умови можуть змінюватися швидко.
- Розробка ШІ-моделей відбувається експоненційно. Anthropic, як і інші гравці, активно працюють над наступним поколінням.
- Конкуренція залишається на найвищому рівні. GPT-5.6 Sol та Gemini 3.5 Pro свідчать про це.
Мої рекомендації для вас, колеги:
- Для розробників та тих, хто працює з агентами: Розгляньте перенесення високооб’ємних завдань на Sol або Terra через API, оскільки Fable 5 стає надто дорогою для масштабування. Opus 4.8 залишайте для завдань, де його специфічна продуктивність є критичною.
- Для творців контенту: Зосередьтеся на універсальних пайплайнах, які не залежать від одного постачальника. Це забезпечить безперебійність вашої роботи.
- Для тих, хто працює з чутливими даними або дослідженнями, що можуть потрапити під регуляторний контроль: Починайте серйозно розглядати локальне розгортання ШІ. Навіть якщо це не є необхідністю сьогодні, розрахунки показують, що “відбиття” інвестицій стає все більш вигідним, а відкриті моделі, що працюють локально, є найефективнішим рішенням за свою ціну.
Висновок: Майбутнє, яке ми будуємо самі
Історія Fable 5 – це не просто про чергову модель ШІ. Це свідчення швидкості змін у цифрову епоху та необхідності адаптації. Справжня незалежність у цій галузі може полягати у володінні власними інструментами та обчислювальними потужностями.
Anthropic, як і інші лідери галузі, стоять перед складним вибором: баланс між інноваціями, безпекою, комерційними інтересами та регулюванням. Ці виклики стимулюють їх до створення ще більш потужних, але потенційно більш контрольованих систем.
Тому, друзі, залишайтеся поінформованими, експериментуйте, але завжди майте резервні плани. Майбутнє ШІ – це не лише те, що вирішують великі компанії. Це те, що ми самі будуємо, ефективно використовуючи доступні нам інструменти.







