安全治理与伦理
系统认识安全风险、法规治理、伦理公平与前沿对齐研究。
在能力、风险和责任之间建立工程化治理框架。
LEARNING SEQUENCE
按知识依赖逐步进入
每个主题保留完整原文,并增加教学图、图例、对比表和更清晰的阅读结构。
10.01
大模型安全风险全景
随着大模型和 Agent 深入各行各业,安全问题变得前所未有地重要。从提示注入到数据泄露,从幻觉到滥用,大模型面临着多层次的安全威胁。本章全面梳理大模型和 Agent 的安全风险图谱。
10.02AI 治理与法规
随着 AI 技术的快速发展,全球各国纷纷出台法规和治理框架,试图在促进创新与防范风险之间找到平衡。本章梳理全球 AI 治理的主要框架和法规要求。
10.03AI 伦理与公平性
大模型和 Agent 的决策可能影响人们的就业、信贷、司法等重要领域。如果 AI 系统存在偏见或不公平,将加剧社会不平等。本章探讨 AI 伦理的核心议题和公平性保障方法。
10.04AI 对齐与安全研究前沿
AI 对齐(AI Alignment)是确保 AI 系统的行为符合人类意图和价值观的核心研究方向。随着模型能力不断增强,对齐问题变得更加紧迫。本章介绍 AI 对齐的核心概念、研究前沿和安全实践。
CHAPTER OVERVIEW
本章主题对照
先看每篇解决什么问题,再决定从哪里深入。
| 主题 | 核心概念 | 学习产出 |
|---|---|---|
| 大模型安全风险全景 | 安全威胁分类、提示注入攻击、数据安全风险 | 随着大模型和 Agent 深入各行各业,安全问题变得前所未有地重要。从提示注入到数据泄露,从幻觉到滥用,大模型面临着多层次的安全威胁。本章全面梳理大模型和 Agent 的安全风险图谱。 |
| AI 治理与法规 | 全球 AI 法规概览、中国 AI 治理、AI 安全标准 | 随着 AI 技术的快速发展,全球各国纷纷出台法规和治理框架,试图在促进创新与防范风险之间找到平衡。本章梳理全球 AI 治理的主要框架和法规要求。 |
| AI 伦理与公平性 | AI 偏见、公平性度量、去偏见方法 | 大模型和 Agent 的决策可能影响人们的就业、信贷、司法等重要领域。如果 AI 系统存在偏见或不公平,将加剧社会不平等。本章探讨 AI 伦理的核心议题和公平性保障方法。 |
| AI 对齐与安全研究前沿 | AI 对齐问题、对齐技术前沿、安全研究前沿 | AI 对齐(AI Alignment)是确保 AI 系统的行为符合人类意图和价值观的核心研究方向。随着模型能力不断增强,对齐问题变得更加紧迫。本章介绍 AI 对齐的核心概念、研究前沿和安全实践。 |