Компанія Anthropic презентувала свою найновішу та найпотужнішу модель штучного інтелекту під назвою Claude Fable 5. Цей реліз став визначною подією у сфері технологій, оскільки розробники застосували нетиповий підхід до розповсюдження. Одну й ту саму базову модель було розділено на два окремі продукти, що різняться не технічними можливостями, а рівнем вбудованої безпеки та наявністю спеціальних класифікаторів.

Для широкого загалу розробники підготували версію Claude Fable 5, яка містить усі стандартні заходи кібербезпеки та обмеження. Водночас її повний аналог під назвою Claude Mythos 5 постачається без заздалегідь активованих обмежень кібербезпеки. Ця "розблокована" версія залишається доступною виключно для обмеженого кола перевірених фахівців у сфері інформаційної безпеки та дослідників, які займаються аналізом загроз.

Такий крок підкреслює нову тенденцію у розробці великих мовних моделей, коли безпекові фільтри накладаються окремим шаром поверх ядра штучного інтелекту. Це дозволяє спеціалістам з кібербезпеки тестувати модель у сценаріях пошуку вразливостей або аналізу шкідливого коду без постійних блокувань з боку стандартних алгоритмів захисту. З іншого боку, це суттєво мінімізує ризики того, що зловмисники зможуть використати передові можливості штучного інтелекту для автоматизації кібератак.

Організаціям, які інтегрують штучний інтелект у свої бізнес-процеси, варто звернути увагу на цю гібридну модель безпеки. Розробникам програмного забезпечення та спеціалістам із захисту інформації рекомендується ретельно оцінювати ризики застосування подібних інструментів. Новий підхід Anthropic демонструє, що майбутнє регулювання штучного інтелекту, ймовірно, базуватиметься на жорсткому розмежуванні доступу до технологій подвійного призначення залежно від кваліфікації та надійності користувача.