Материал подготовлен автоматически по первоисточникам: ссылки на них — в конце статьи.
Anthropic опубликовала свой самый подробный отчёт об угрозах, связанных с Claude. Компания утверждает, что выявила и пресекла все описанные в нём операции, а затем усилила защитные механизмы.
В отчёт вошли попытки применять Claude для кибератак, операций влияния, слежки, работ в области биологии и создания оружия. В отдельных случаях Anthropic передавала сведения властям и другим разработчикам ИИ.
Компания подчёркивает, что это не типичные обращения к Claude, а наиболее сложные случаи злоупотребления. Она публикует их, чтобы другие платформы могли распознавать похожую активность.
Для команд, которые строят продукты на Claude, практическое изменение пока одно: поставщик обновляет защиту по итогам реальных инцидентов и может подключать внешние организации. По самому посту нельзя определить, какие именно проверки или ограничения изменились и затронут ли они работу через API.
Источники
Похоже на вашу задачу?
Расскажите, что собираете. За полчаса разложим на этапы и назовём сроки — это бесплатно и ни к чему не обязывает.



