И опять таки, про объединение старых и новых приёмов:
вот здесь
+ Умеет ли Jev быть guard‑моделью для LLM?
https://habr.com/ru/companies/raft/articles/1085414/ экономичный вероятностный подход используется в сочетании с противодействием набору уже известных на данный момент атак на модели для защиты BlueTeam
а здесь
+ Стартап Abliteration.ai начал продавать через API доступ к нейросети GLM-5.3 с ослабленными системами защиты
https://habr.com/ru/news/1079652/ , казалось бы, просто про снятие ограничений, но и это может использовать для тестирования на проникновение RedTeam
вместе веселее 😉
вот здесь
+ Умеет ли Jev быть guard‑моделью для LLM?
https://habr.com/ru/companies/raft/articles/1085414/ экономичный вероятностный подход используется в сочетании с противодействием набору уже известных на данный момент атак на модели для защиты BlueTeam
а здесь
+ Стартап Abliteration.ai начал продавать через API доступ к нейросети GLM-5.3 с ослабленными системами защиты
https://habr.com/ru/news/1079652/ , казалось бы, просто про снятие ограничений, но и это может использовать для тестирования на проникновение RedTeam
вместе веселее 😉
Умеет ли Jev быть guard‑моделью для LLM?
картинка на подумать или посмеяться Введение Guard модели становятся все более и более интересными. Еще 2 года назад лучшее, что мог дать опенсорс, был Wildguard —...
Хабр