В AI Safety, о котором уже писали раньше, есть уже известная (если не известная то тут неплохо написано) тема про LLM Guardrails, но, как всегда, просто добавление guardrails только первый шаг, нужно учесть нюансы
+ Как не сломать LLM, пока защищаешь данные: под капотом Guardrails Filter
https://habr.com/ru/companies/cloud_ru/articles/1068710/
+ GuardRate: как мы построили независимую арену для guardrail-моделей (часть 1)
https://habr.com/ru/companies/raft/articles/1067854/
+ Теперь вы можете защититься от утечки данных при работе с любыми языковыми моделями
https://habr.com/ru/companies/cloud_ru/articles/1061546/
+ Как не сломать LLM, пока защищаешь данные: под капотом Guardrails Filter
https://habr.com/ru/companies/cloud_ru/articles/1068710/
+ GuardRate: как мы построили независимую арену для guardrail-моделей (часть 1)
https://habr.com/ru/companies/raft/articles/1067854/
+ Теперь вы можете защититься от утечки данных при работе с любыми языковыми моделями
https://habr.com/ru/companies/cloud_ru/articles/1061546/