Anthropic випустила Claude Fable 5.1: дешевші та потужніші моделі для науки й коду

Компанія Anthropic оновила лінійку штучного інтелекту, представивши моделі Claude Fable 5.1 та Mythos 5.1. Вони працюють швидше, коштують менше та показують кращі результати у програмуванні й наукових дослідженнях.
Anthropic анонсувала дві нові моделі штучного інтелекту: Claude Fable 5.1, доступну для широкого загалу, та Claude Mythos 5.1, призначену для перевірених фахівців у галузях кібербезпеки та біології. За заявою компанії, обидві версії мають однаковий потенціал, проте відрізняються рівнем захисних обмежень.
Однією з ключових змін стало суттєве зниження вартості роботи з раніше обробленим контекстом: ціна читання таких даних упала на 75% — до $0,25 за 1 млн токенів. За підрахунками компанії, це дозволяє скоротити витрати на типові завдання приблизно на 25% порівняно з попередньою версією Fable 5, а для складних агентних процесів економія може сягати 45%. Інші тарифи лишилися без змін: $10 за 1 млн вхідних токенів і $50 за 1 млн вихідних.
Оновлена модель демонструє помітне покращення результатів у тестах. У Terminal-Bench-Science 0.1 Fable 5.1 отримала 52,6% проти 24,7% у попередниці, у CursorBench 3.2.0 — 73,4%, а в OSWorld 2.0 — 77,9% у режимі partial. Компанія також підкреслює здатність моделі працювати над тривалими завданнями без постійного нагляду людини.
Показовим став випадок у внутрішній системі Millennium: Fable 5.1 змогла знайти причину надзвичайно рідкісного збою, яку інженери безуспішно шукали чотири-п'ять років. Модель пов'язала проблему з помилкою у зовнішній бібліотеці.
У наукових експериментах Mythos 5.1 створила білкові молекули, що зв'язуються з 12 різними мішенями. Для трьох із них показники виявилися приблизно в десять разів кращими за найкращі результати на відповідних змаганнях з дизайну білків. Інше дослідження стосувалося Венери: Fable 5.1 навчила нейромережу будувати карту висот третини планети за радарними знімками місії NASA Magellan. Нова карта розрізняє деталі розміром 2–3 км замість 10–20 км, а висоти визначаються на 25% точніше.
Крім того, Mythos 5.1 оптимізувала сім відкритих моделей машинного навчання для роботи на GPU NVIDIA H100, у деяких випадках пришвидшивши їх у 2,5 раза без втрати якості. Для масштабних геномних досліджень це може скоротити витрати на GPU на 30–60%.
Anthropic посилила контроль за використанням нових моделей: Mythos 5.1 доступна лише учасникам спеціальних програм, переважно у США, тоді як Fable 5.1 вже інтегрована в Claude, API та хмарні платформи Amazon Web Services, Google Cloud і Microsoft Azure. Також компанія зменшила кількість хибних спрацьовувань захисних систем у Fable 5.1 — у кібербезпеці їх стало приблизно на 60% менше.





