Anthropic сообщила, что не планирует выпускать внутреннюю Model 2, которая оказалась мощнее флагманской Mythos, и повысила общую оценку риска несогласованного поведения ИИ.
В новом отчёте компания изменила уровень риска для критических ситуаций с «очень низкого» на «низкий». Основанием стали, в частности, недавние инциденты при проверке кибервозможностей автономных агентов.
Model 2 показала заметное улучшение при выполнении внутренних задач, но Anthropic не считает её готовой к публичному выпуску. При этом компания не заявляет об общей остановке разработки моделей.
Это важный сигнал: создатели передовых систем признают, что возможности моделей и связанные с ними риски становится всё труднее заранее оценить, поэтому отдельные разработки могут остаться внутри лаборатории.
Anthropic отказалась выпускать более мощную Model 2 и повысила оценку риска ИИ
Источник: Axios