什么是 AI 安全与伦理
AI 安全与伦理关注大语言模型及其应用在使用过程中可能产生的风险,以及如何通过技术手段和规范降低这些风险。它不是附加功能,而是构建可信 AI 系统的基石。
为什么需要关注 AI 安全
- 提示词注入:恶意输入可操纵模型行为,绕过原有指令
- 幻觉:模型生成看似正确但实际错误的内容,误导用户
- 数据隐私:用户对话、企业数据可能被泄露或滥用
- 偏见与歧视:模型可能放大训练数据中的偏见
- 对齐失效:模型可能产生有害、违规或不符合预期的输出
- 合规要求:各国对 AI 的法规趋严(如欧盟 AI 法案)
核心风险领域