AI学习目录索引

📚 八股文版AI-LLM-RAG-Agent 八股文


学习路线(按技术学习清单顺序)

LLM 基础

编号主题核心内容
0101-Token计费原理-Temperature控制-SystemPrompt层级Token计费原理、Temperature控制创造力的底层机制、System Prompt五大职能与指令层级
0202-LLM本质-API调用封装LLM本质(参数=数字/推理=数学、Transformer/显存/推理瓶颈)、API调用封装(SSE/重试/限流/结构化输出)、LLM/RAG/Agent三层辨析、框架vs库
0303-多模型后端抽象多后端统一抽象层:请求/响应格式归一化、错误码映射、重试/退避/回退策略、配置驱动、生产级 ModelRouter 实现

Embedding 与语义搜索

编号主题核心内容
0404-Embedding向量化原理+语义搜索场景Embedding训练原理(对比学习/InfoNCE)、稠密vs稀疏向量、对称vs非对称、MRL降维、ANN算法(HNSW/IVF)、Bi-Encoder vs Cross-Encoder、阿里云v4详解、MTEB评估
0505-Chroma向量数据库安装入库检索Chroma 安装部署、三种客户端模式、Collection 创建与管理、入库(add/upsert/update/delete)、检索(query/元数据过滤/HNSW调优)、嵌入函数自定义、常见考点

RAG

编号主题核心内容
0606-RAG检索增强生成流程Document Loader(PyMuPDF/Unstructured/CSV)、分块策略(固定/语义/递归/重叠)、Embedding 选型(BGE-M3/Jina/OpenAI)、混合检索(BM25+稠密+RRF)、Reranker(bge-reranker-v2-m3)、生成(Prompt 模板+幻觉防控)、RAGAS 评估、常见考点
0707-分块策略:chunk_sizeoverlap选择、语义分块chunk_size/overlap选择、语义分块、分块评估
0808-混合检索:向量+BM25+RRF融合向量+BM25+RRF融合、混合检索优化
0919-Query改写与多轮对话指代消解Query改写、多轮对话指代消解
1010-RAG评估:检索指标+生成指标检索指标(Recall/Precision)、生成指标(Faithfulness/Relevance)
1111-AgenticRAG:LLM主动决策多次检索vs传统单次被动检索Agentic RAG原理、LLM主动决策多次检索
1212-Self-RAG:自我反思+自纠正闭环Self-RAG原理、自我反思与自纠正闭环
1313-RAG参数调优:网格搜索实验框架RAG参数调优、网格搜索实验框架
1414-jieba分词+BM25关键词检索中文分词、BM25关键词检索

Agent 架构(核心)

编号主题核心内容
1515-Agent架构与工具调用ReAct循环、Function Calling、手写ReAct Agent、Agent vs Workflow
1616-ToolDescription设计铁律Tool Description五条铁律、参数约束、错误返回、description写作
1717-工具系统:定义→注册→发现→调用工具系统完整流程
1833-异常处理与降级策略工具调用失败处理
1937-有副作用工具的权限控制有副作用工具处理
2020-MCPServer实现:FastMCP+JWT认证中间件+contextvarsMCP Server实现
2121-MCP Transport:Streamable HTTP → ASGI 子应用挂载 + JSON-RPC 2MCP Transport实现
2222-MCPClient:自定义客户端+JSON-RPCoverHTTP+连接池+幂等重连MCP Client实现
2323-MCPTool-Resource定义与注册模式MCP Tool/Resource定义与注册
2424-Human-in-the-loop:人工介入兜底与敏感操作审批机制Human-in-the-loop机制
25Agent安全防护Agent安全防护
2626-工具幂等性与副作用控制:防止重复执行的工程手段工具幂等性与副作用控制

Agent 韧性工程

编号主题核心内容
2727-指数退避重试:ExponentialBackoff+Jitter指数退避重试
2828-降级路径(Degradation):某环节失败→回退到次优但可用方案降级路径
2929-熔断模式-CircuitBreaker熔断模式:三态状态机、分层多熔断器、代码实现
3030-Fallback兜底值设计Fallback三种退路、NON_RETRYABLE异常分类、三明治模式

记忆与上下文

编号主题核心内容
3131-短期记忆:当前任务轨迹+工具结果缓存短期记忆=上下文窗口、窗口限制与截断策略、LangGraph MemorySaver、工具结果缓存模式
3232-长期记忆:跨会话用户偏好、历史持久化长期记忆=跨会话持久化、ChromaDB向量库存储、RAG记忆召回、用户偏好三层结构
3333-上下文治理:多轮任务上下文越来越长的处理策略上下文膨胀根因、滑动窗口策略、摘要压缩策略、混合模式、触达时机与参数调优
3434-上下文压缩:任务摘要-文件摘要-过程笔记任务摘要、文件摘要、过程笔记、压缩校验机制、数字一致性检查
3535-重复状态识别:避免Agent反复读同一文件或重复调用同一工具哈希去重、访问集合、频率限制、循环检测器、强制终止

规划与高级模式

编号主题核心内容
3636-Reflexion:带自我反思的AgentReflexion三步循环、Actor-Evaluator-Reflector、自纠错、与ReAct区别
3737-Multi-Agent协作模式三种协作模式、Supervisor-Worker深度解析、幻觉放大预防、A2A协议
3838-Agent成本控制:Token用量分析+三级模型路由+语义缓存Token消耗分布、三级模型路由、语义缓存、成本监控策略

Harness 与评测

编号主题核心内容
3939-Agent评测体系:benchmark-case-指标设计三层评测体系、关键指标、Golden Test Case设计
4040-LLM-as-Judge评测工具链:Ragas-DeepEval-Langfuse配置与接入LLM-as-Judge原理、Ragas/DeepEval/Langfuse配置、对比分析
4141-错误Patch回滚-验证-再尝试机制Patch-Rollback-Retry循环、状态快照回滚、Checkpoint恢复
4242-可观测性工具链实操:Langfuse-Ragas-DeepEval链路追踪与评测Langfuse链路追踪、Ragas检索评估、DeepEval回归测试、集成实践
4343-Agent回归测试体系:基线建立-Case管理-自动化流水线Golden Test Case格式、基线管理、CI回归流水线、评分对比

LangChain + LangGraph

编号主题核心内容
4444-LangChain框架入门LangChain框架、LCEL管道、ChatPromptTemplate、Memory
4545-LangGraph框架:StateGraph-Node-Edge-CheckpointStateGraph定义、Node/Edge/Checkpoint概念、条件边、代码示例
4646-LangGraphMemorySaverCheckpointMemorySaver持久化、thread_id隔离、get_state调试、三种后端对比

相关链接