Нові лідери в програмуванні та науці: Anthropic представила Claude Fable 5.1 і Mythos 5.1

Нові лідери в програмуванні та науці: Anthropic представила Claude Fable 5.1 і Mythos 5.1 © Getty Images
Компанія знизила вартість використання Fable 5.1 для клієнтів.

Після запуску нового браузера зі штучним інтелектом для застосунку Claude компанія Anthropic представила дві нові моделі ШІ — Claude Fable 5.1 та Claude Mythos 5.1. Розробник називає їх своїми найпотужнішими рішеннями для програмування, інтелектуальної роботи та наукових досліджень. Fable 5.1 уже доступна всім користувачам, тоді як Mythos 5.1 відкрили лише для перевірених фахівців у сферах кібербезпеки та науки.

За даними Anthropic, Fable 5.1 і Mythos 5.1 є технічно однаковою моделлю, але вони відрізняються рівнем захисних механізмів. Fable призначена для широкого використання, а Mythos отримала менш жорсткі обмеження для професійної роботи з кібербезпекою та біологічними дослідженнями. Нові можливості з'явилися разом зі змінами, яких вимагали корпоративні клієнти: нижчою вартістю, конфіденційністю даних і точнішими системами захисту.

Результати тестувань

У внутрішніх тестах Fable 5.1 значно перевершила Fable 5 і випередила GPT-5.6 Sol від OpenAI та Opus 5 у кількох ключових бенчмарках. Найпомітніше зростання компанія зафіксувала у дослідницьких агентних завданнях — 52,6% проти 24,7% у Fable 5 та автоматизації бізнесових процесів — 31,4% проти 17,1%. У програмуванні Mythos 5.1 набрала 60,9% у Terminal-Bench 4.0 — найкращий результат серед моделей Anthropic.

Anthropic

Окремо компанія навела приклад з тестування моделей інвестиційною фірмою Millennium. Fable 5.1 знайшла причину рідкісного збою у внутрішній системі, який інженери не могли пояснити протягом кількох років.

Наукові експерименти

Anthropic заявляє, що нові моделі вже продемонстрували практичні результати у наукових дослідженнях. Зокрема, Mythos 5.1 створила білкові сполуки з афінністю, яка для трьох мішеней виявилася у 10 разів вищою за найкращі результати конкурсів Adaptyv Bio.

У галузі астрономії Fable 5.1 створила нову високоточну карту рельєфу Венери на основі даних місії NASA Magellan. Нова модель підвищила деталізацію карти до 2–3 кілометрів замість 10–20 км і збільшила точність визначення висоти рельєфу на 25%.

У сфері обчислювальної біології Mythos 5.1 оптимізувала сім моделей глибокого навчання для графічних процесорів, прискоривши їхню роботу до 2,5 раза. За оцінкою компанії, це може скоротити витрати на GPU на 30–60%.

Нові корпоративні функції

Разом із моделями Anthropic представила систему Enterprise Frontier Safeguards (EFS), яка дозволяє корпоративним клієнтам використовувати Claude без зберігання даних у хмарній інфраструктурі компанії. Система працюватиме у хмарному середовищі користувача та стане доступною восени для Claude Enterprise, Claude Code, Amazon Bedrock, Google Cloud і Microsoft Azure.

Захист став точнішим

Anthropic повідомляє, що суттєво скоротила кількість помилкових блокувань безпечних запитів. У кібербезпеці таких спрацьовувань стало на 60% менше, а в біологічній сфері — на 85% менше для базових медичних і біологічних запитів. Водночас Fable 5.1 тепер дозволяє використовувати модель для пошуку вразливостей у програмному забезпеченні, але не для створення експлойтів чи виконання наступальних завдань.

Нижча вартість

Компанія переглянула ціноутворення для роботи через API. Вартість читання кешованого контексту знизили на 75% — до $0,25 за мільйон токенів. Завдяки цьому загальна вартість типових робочих навантажень стала приблизно на 25% нижчою, ніж у Fable 5, а для агентних завдань економія може досягати 45%. Базові тарифи залишилися незмінними — $10 за мільйон вхідних токенів і $50 за мільйон вихідних.

Нові вимоги ЄС

Anthropic також повідомила, що в межах виконання норм Закону ЄС про штучний інтелект почала маркувати відповіді нових моделей Claude невидимими числовими водяними знаками та відкрила обмежений доступ до спеціального API для їхнього виявлення. Індикатор визначає ймовірність генерації тексту нейромережею, але не впливає на якість матеріалів і не збирає дані про користувачів чи історію діалогів. Наразі скористатися інструментом перевірки в закритому режимі можуть регулятори, фактчекери, медіа та представники бізнесу, які зобов'язані підтверджувати походження контенту, проте згодом компанія планує розширити доступ.

Помітили помилку?

Будь ласка, виділіть її мишкою та натисніть Ctrl+Enter або Надіслати помилку

Додати коментар
Всього коментарів: 0
Текст містить неприпустимі символи
Залишилось символів: 2000
Будь ласка, виберіть один або кілька пунктів (до 3 шт.), які на Вашу думку визначає цей коментар.
Будь ласка, виберіть один або більше пунктів
Нецензурна лексика, лайка Флуд Порушення дійсного законодвства України Образа учасників дискусії Реклама Розпалювання ворожнечі Ознаки троллінгу й провокації Інша причина Відміна Надіслати скаргу ОК
Залишайтесь в курсі останніх подій!
Підписуйтесь на наш канал у Telegram
Стежити у Телеграмі