跳到主要内容
CodeWiki
练习
学习路径
学习方向
速查表
试验场
术语表
AI 时代
搜索
⌘K
中文
英语
中文
练习
学习路径
学习方向
速查表
试验场
术语表
AI 时代
中文
英语
中文
练习
/
测验
/
AI 与大模型工程
/
AI 与大模型工程
如果越狱或提示注入成功,哪种架构最能限制损害?
来自 AI 与大模型工程
进阶
1分钟
如果越狱或提示注入成功,哪种架构最能限制损害?
把输入输出控制与最小权限工具、应用授权、审批门和监控分层组合
只依靠系统提示词中的一句话,要求模型永不违背指令
向模型提供广泛凭据,使其能从任何被阻止的操作中恢复
检查
向 AI 询问这道练习
报告错误
上一道练习
哪种 Hugging Face 加载实践能提供最强的可复现边界?
测验
下一道练习
写出冻结基础权重、只学习低秩更新矩阵的参数高效微调方法
填空
有新版本可用
重新加载