ИИ в стрессе: пользователям официально запретили издеваться над Claude
Anthropic запретила пользователям долго и беспричинно издеваться над нейросетью Claude. Если человек ведет себя излишне агрессивно, модель может сама прервать неприятный диалог. Такая возможность появилась в августе 2025 года после тестов безопасности, показавших, что Claude Opus 4 испытывает сильный стресс при токсичном общении. После закрытия чата писать туда больше нельзя, но остальные диалоги остаются доступными. Исключения сделали лишь для рабочих споров, бытовых недовольств клиентов, мрачных творческих сюжетов, тестов и научных исследований.
Также компания обновила и объединила другие правила. В разделе о дезинформации под запрет попали фейковые отзывы, боты, поддельные сайты и искусственная накрутка внимания, которые ранее массово использовались госструктурами и СМИ для создания сетей фальшивых аккаунтов. В блоке про выборы запретили обманывать избирателей и вмешиваться в голосование. Правила по оружию табуируют разработку софта для него, управление дронами через ИИ, а также модификацию химических и биологических агентов для роста их летальности и заразности.
В сфере правоохранительных органов нейросети теперь запрещено следить за людьми без согласия, заниматься доксингом, собирать инструменты слежки, а также принимать решения или давать советы о том, кого задерживать, арестовывать и обвинять. При управлении физическим оборудованием в реальном мире обязательно присутствие квалифицированного специалиста, способного экстренно остановить работу. Кроме того, полностью запрещено создавать и распространять неконсенсусные интимные изображения и инструменты для их генерации. Все нововведения вступают в силу 12 ноября.
Anthropic запретила пользователям долго и беспричинно издеваться над нейросетью Claude. Если человек ведет себя излишне агрессивно, модель может сама прервать неприятный диалог. Такая возможность появилась в августе 2025 года после тестов безопасности, показавших, что Claude Opus 4 испытывает сильный стресс при токсичном общении. После закрытия чата писать туда больше нельзя, но остальные диалоги остаются доступными. Исключения сделали лишь для рабочих споров, бытовых недовольств клиентов, мрачных творческих сюжетов, тестов и научных исследований.
Также компания обновила и объединила другие правила. В разделе о дезинформации под запрет попали фейковые отзывы, боты, поддельные сайты и искусственная накрутка внимания, которые ранее массово использовались госструктурами и СМИ для создания сетей фальшивых аккаунтов. В блоке про выборы запретили обманывать избирателей и вмешиваться в голосование. Правила по оружию табуируют разработку софта для него, управление дронами через ИИ, а также модификацию химических и биологических агентов для роста их летальности и заразности.
В сфере правоохранительных органов нейросети теперь запрещено следить за людьми без согласия, заниматься доксингом, собирать инструменты слежки, а также принимать решения или давать советы о том, кого задерживать, арестовывать и обвинять. При управлении физическим оборудованием в реальном мире обязательно присутствие квалифицированного специалиста, способного экстренно остановить работу. Кроме того, полностью запрещено создавать и распространять неконсенсусные интимные изображения и инструменты для их генерации. Все нововведения вступают в силу 12 ноября.