Компания Anthropic представила новые ИИ-модели Claude Fable 5 и Claude Mythos 5

Разработчик искусственного интеллекта Anthropic объявил о выходе двух новых моделей — Claude Fable 5 и Claude Mythos 5. Новинки превосходят по своим возможностям версию Mythos Preview, представленную в апреле ограниченному кругу партнеров в технологическом секторе. Изначально компания ограничила доступ к ранним разработкам, опасаясь, что их функционал может быть использован злоумышленниками для создания инструментов кибератак.

Особенности доступа и механизмы защиты

Модель Claude Mythos 5 на текущий момент доступна лишь узкому кругу отраслевых партнеров, при этом компания координирует процесс внедрения с государственными структурами США. Публично доступная версия Claude Fable 5 базируется на той же архитектуре, что и Mythos 5, однако в нее интегрированы жесткие защитные фильтры.

  • При попытке задать вопросы по кибербезопасности, биологии или химии запросы автоматически перенаправляются к более старой модели — Claude Opus 4.8.
  • Аналогичный алгоритм срабатывает, если система фиксирует попытки дистилляции (обучения компактной нейросети на ответах более мощной модели).
  • В компании отмечают, что текущие защитные механизмы настроены с избыточной осторожностью, поэтому безопасные запросы иногда также могут перенаправляться на менее производительную версию.

Стратегия внедрения и безопасность

Руководство Anthropic подчеркивает, что выбор такой архитектуры стал наиболее жизнеспособным способом предоставить пользователям максимум возможностей модели Fable 5, сохраняя при этом контроль над рисками. В ходе внутренних тестов (red-teaming), длившихся более 1000 часов, эксперты не выявили универсальных способов обхода установленных ограничений.

Помимо широкого доступа к Fable 5, Anthropic открыла возможность использования Claude Mythos 5 для избранных групп исследователей в области биологии. Ограниченные версии предоставляются клиентам в рамках инициативы Project Glasswing, направленной на то, чтобы помочь организациям подготовить свои системы защиты к появлению мощных ИИ-инструментов, способных обнаруживать уязвимости в программном обеспечении.

Стоимость и рыночные перспективы

Модели Claude Fable 5 и Claude Mythos 5 оцениваются разработчиками следующим образом:

  • Входные данные: 10 долларов за миллион токенов.
  • Выходные данные: 50 долларов за миллион токенов.

Это в два раза дороже существующих общедоступных моделей компании, однако стоимость ниже, чем у версии Mythos Preview. Эксперты отмечают, что данный релиз отражает стремление Anthropic занять лидирующие позиции на рынке в преддверии планируемого выхода на биржу, конкурируя с другими игроками, включая OpenAI*. По данным аналитиков, обе компании ведут активную борьбу за привлечение инвестиций, параллельно пытаясь решить вопросы этики и безопасности использования нейросетей, способных создавать киберугрозы.

* — деятельность компании запрещена на территории РФ


Понравилась запись? Поделись с друзьями и поддержи сайт: