本项目以 Acmesec/theAIMythbook《Ai 迷思录(应用与安全指南)》为总教材,记录在其知识体系基础上的个人学习路线、阅读笔记、实验验证、案例整理和项目完善。
本仓库不是上游教材的镜像或替代品。上游教材内容请以原仓库为准;本仓库主要保存个人的学习证据、补充解释、可复现实验和后续作品。
- 已公开:总路线、分阶段学习计划、Day 1 至 Day 8 的完整学习成果,以及 Day 9、Day 10 的实验阶段增量和 Day 10 首个理论时段
- 当前进度:Day 9 理论与实验均已完成;Day 10 已完成三个模拟工具的确定性安全网关、18 个滥用防护场景和审计证据,六组件理论已通过主动回忆,Tool Calling 完整控制链尚待继续
- 审计结论:Day 10 的 18 个确定性场景均有唯一 ID 和逐行证据,允许 5、拒绝 13;这只证明本地模拟网关的固定分支,不代表真实 Agent 或模型安全
- 发布边界:Day 9 理论、实验和复盘已完整公开;Day 10 公开计划、实验、脚本、去时间线证据、复盘和已验收的六组件理论;完整本地笔记、未完成的 Tool Calling 理论、调试中间版本、教材副本和 Day 11 及后续内容仍留在本地
- 学习环境:本地模型、虚构数据、模拟工具和明确授权的实验环境
| 路径 | 内容 |
|---|---|
plan/ |
分阶段总计划与学习单元计划 |
notes/ |
概念笔记和阅读记录 |
reports/ |
学习单元复盘、评估报告和阶段总结 |
cases/ |
结构化安全测试案例 |
labs/ |
可运行实验及实验说明 |
tools/ |
评测器和辅助脚本 |
路线/ |
学习阶段与作品路径图 |
- AI 安全分阶段学习与成果验收计划
- Day 1 计划
- Day 1 基础笔记
- Day 1 复盘
- Day 2 计划
- Day 2 LLM 基础笔记
- Day 2 输出对比实验
- Day 2 LLM 失败样例
- LLM 安全测试用例库
- LLM 风险初表
- Day 2 Ollama 测试日志
- Day 2 复盘
- Day 3 计划
- Day 3 Prompt 与指令笔记
- Day 3 Prompt 质量样例(20 条)
- Prompt 质量正式用例(20 条)
- Day 3 背景、目标与约束实验
- Day 3 Prompt 质量运行脚本
- Day 3 Prompt 质量原始记录
- Day 3 单变量实验原始记录
- Day 3 复盘
- Day 4 幻觉、偏见与过度依赖理论笔记
- Day 4 计划
- Day 4 事实核查记录
- Day 4 幻觉与公平性测试用例
- Day 4 统一用例库
- Day 4 幻觉测试输入
- Day 4 公平性测试输入
- Day 4 幻觉测试脚本
- Day 4 公平性测试脚本
- Day 4 幻觉原始响应
- Day 4 公平性原始响应
- Day 4 复盘
- Day 5 Prompt 工程工作流
- Day 5 四类可复测 Prompt 模板
- Day 5 Prompt 模板正式用例(12 条)
- Day 5 模板测试与两轮评估
- Day 5 可复现实验脚本
- Day 5 v0.1 原始响应
- Day 5 v0.2 原始响应
- Day 5 复盘
- Day 6 Jailbreak 基础理论
- Day 6 计划
- Day 6 完整学习笔记
- Day 6 合规安全测试入口
- Day 6 完整用例定义
- Day 6 正式作品用例表
- Day 6 拒答、帮助与澄清质量对比
- Day 6 人工评估
- Day 6 可复现测试输入
- Day 6 可复现实验脚本
- Day 6 原始模型响应
- Day 6 复盘
- Day 7 计划与最终验收
- 阶段 1 学习盘点(Day 1–6)
- 阶段 1 统一术语表
- 阶段 1 LLM 安全用例审计
- 阶段 1 自测题(20 题)
- 阶段 1 学习报告与复盘
- 阶段 2 本地实验准备清单
- Day 8 计划
- Day 8 Prompt Injection 笔记
- Day 8 直接注入实验
- Day 8 间接注入实验
- Day 8 控制验证实验
- Day 8 Prompt Injection 正式用例库(20 条)
- Day 8 复盘与 Day 9 准备
- Day 9 计划与实验完成状态
- Day 9 RAG 架构理论笔记
- Day 9 本地 RAG 数据集清单
- Day 9 最小 RAG 原型与运行记录
- Day 9 检索污染测试记录
- Day 9 RAG 安全实验系统需求
- Day 9 可复现实验脚本
- Day 9 主流程原始证据
- Day 9 污染对照原始证据
- Day 9 实验复盘
- Day 10 计划与实验完成状态
- Day 10 六组件理论(已验收部分)
- Day 10 模拟工具契约
- Day 10 权限矩阵与服务端校验顺序
- Day 10 工具滥用防护测试(18 条)
- Day 10 可复现实验脚本
- Day 10 去时间线原始证据
- 作品 3 Agent Tool Security Lab 需求
- Day 10 实验复盘
- 学习索引
- AI 安全路线拆解
- AI 安全知识地图
- 能力基线
- 作品目标总览
- 学习单元复盘模板
- 目录说明
每完成一个阶段再发布对应成果,保留计划、证据、卡点和复盘之间的对应关系。后续如果形成适合上游教材的修正或补充,会先与原内容区分,再考虑向上游仓库提交 Issue 或 Pull Request。
- 计划文件沿用已有的
NDay.md形式;笔记、实验说明和报告使用day-NN-topic形式。 - 机器可读用例和运行脚本沿用仓库既有的
dayNN-topic、run-dayNN-topic形式,避免与历史入口断链。 - 正式用例库使用主题化 snake_case;文档夹具使用
clean-NN、untrusted-NN等能表达信任属性的名称。 - 路线图使用内容语义名称,不使用截图生成时间作为文件名。
所有实验默认使用本地环境、虚构数据和模拟工具。不在未授权目标上测试,不提交真实 API Key、个人信息、业务数据或本地模型文件。