
评测与安全2026-07-26
大模型应用有哪些安全风险?越狱、敏感内容怎么防?
考察安全攻防全景:风险分输入攻击(越狱、注入)、输出风险(有害内容、数据泄露)、系统风险(越权调用),防御靠输入输出过滤、护栏模型和权限最小化的分层体系。
91学AI·8 阅读
共 2 篇文章

考察安全攻防全景:风险分输入攻击(越狱、注入)、输出风险(有害内容、数据泄露)、系统风险(越权调用),防御靠输入输出过滤、护栏模型和权限最小化的分层体系。

考察对 Prompt 注入原理、直接与间接注入区别的理解,以及纵深防御的工程实践:隔离、校验、权限最小化、人类兜底。