第 10 章 · 安全治理与伦理
CHAPTER 10 · 安全边界

安全治理与伦理

系统认识安全风险、法规治理、伦理公平与前沿对齐研究。

4 个主题前置:建议结合应用章节阅读目标:在能力、风险和责任之间建立工程化治理框架。
本章知识关系安全治理与伦理

在能力、风险和责任之间建立工程化治理框架。

LEARNING SEQUENCE

按知识依赖逐步进入

每个主题保留完整原文,并增加教学图、图例、对比表和更清晰的阅读结构。

CHAPTER OVERVIEW

本章主题对照

先看每篇解决什么问题,再决定从哪里深入。

主题核心概念学习产出
大模型安全风险全景安全威胁分类、提示注入攻击、数据安全风险随着大模型和 Agent 深入各行各业,安全问题变得前所未有地重要。从提示注入到数据泄露,从幻觉到滥用,大模型面临着多层次的安全威胁。本章全面梳理大模型和 Agent 的安全风险图谱。
AI 治理与法规全球 AI 法规概览、中国 AI 治理、AI 安全标准随着 AI 技术的快速发展,全球各国纷纷出台法规和治理框架,试图在促进创新与防范风险之间找到平衡。本章梳理全球 AI 治理的主要框架和法规要求。
AI 伦理与公平性AI 偏见、公平性度量、去偏见方法大模型和 Agent 的决策可能影响人们的就业、信贷、司法等重要领域。如果 AI 系统存在偏见或不公平,将加剧社会不平等。本章探讨 AI 伦理的核心议题和公平性保障方法。
AI 对齐与安全研究前沿AI 对齐问题、对齐技术前沿、安全研究前沿AI 对齐(AI Alignment)是确保 AI 系统的行为符合人类意图和价值观的核心研究方向。随着模型能力不断增强,对齐问题变得更加紧迫。本章介绍 AI 对齐的核心概念、研究前沿和安全实践。