实战 本目录共 43 个条目,按名称组织。 00-AI 01-Token计费原理-Temperature控制-SystemPrompt层级 02-LLM本质-API调用封装 03-多模型后端抽象 04-Embedding向量化原理+语义搜索场景 05-Chroma向量数据库安装入库检索 06-RAG检索增强生成流程 07-分块策略:chunk_sizeoverlap选择、语义分块 08-混合检索:向量+BM25+RRF融合 10-RAG评估:检索指标+生成指标 11-AgenticRAG:LLM主动决策多次检索vs传统单次被动检索 12-Self-RAG:自我反思+自纠正闭环 13-RAG参数调优:网格搜索实验框架 14-jieba分词+BM25关键词检索 15-Agent架构与工具调用 16-ToolDescription设计铁律 17-工具系统:定义→注册→发现→调用 20-MCPServer实现:FastMCP+JWT认证中间件+contextvars 21-MCPTransport:StreamableHTTP→ASGI子应用挂载+JSON-RPC2.0 22-MCPClient:自定义客户端+JSON-RPCoverHTTP+连接池+幂等重连 23-MCPTool-Resource定义与注册模式 24-Human-in-the-loop:人工介入兜底与敏感操作审批机制 26-工具幂等性与副作用控制:防止重复执行的工程手段 27-指数退避重试:ExponentialBackoff+Jitter 28-降级路径(Degradation):某环节失败→回退到次优但可用方案 29-熔断模式-CircuitBreaker 30-Fallback兜底值设计 31-短期记忆:当前任务轨迹+工具结果缓存 32-长期记忆:跨会话用户偏好、历史持久化 33-上下文治理:多轮任务上下文越来越长的处理策略 34-上下文压缩:任务摘要-文件摘要-过程笔记 35-重复状态识别:避免Agent反复读同一文件或重复调用同一工具 36-Reflexion:带自我反思的Agent 37-Multi-Agent协作模式 38-Agent成本控制:Token用量分析+三级模型路由+语义缓存 39-Agent评测体系:benchmark-case-指标设计 40-LLM-as-Judge评测工具链:Ragas-DeepEval-Langfuse配置与接入 41-错误Patch回滚-验证-再尝试机制 42-可观测性工具链实操:Langfuse-Ragas-DeepEval链路追踪与评测 43-Agent回归测试体系:基线建立-Case管理-自动化流水线 44-LangChain框架入门 45-LangGraph框架:StateGraph-Node-Edge-Checkpoint 46-LangGraphMemorySaverCheckpoint 回到 知识