嵌入模型与向量存储实战
文本嵌入的原理与常用模型选型、embed_query/embed_documents 两个接口、向量数据库的作用与选型,以及用 Milvus + bge-m3 + Agent 手搓一个客服知识库的完整流程


文本嵌入的原理与常用模型选型、embed_query/embed_documents 两个接口、向量数据库的作用与选型,以及用 Milvus + bge-m3 + Agent 手搓一个客服知识库的完整流程

大模型的三个局限与 RAG 的六个环节,文档加载器(Document 对象、txt/csv/json/pdf/word/markdown/html)与文档切分器(五种策略、四种实现、chunk 参数与实测)

长期记忆的三类划分、store→namespace→key→value 四层存储架构、put/get/search 三个 API、在工具与中间件里读写记忆,以及何时写入记忆与静态运行时上下文

模型本身无状态,记忆要靠 State + Checkpointer + Thread ID 三件套;InMemorySaver 与 PostgresSaver 的用法、thread_id 隔离的实测、上下文变长后的裁剪/删除/摘要三种管理手段

六个 hook 函数(before/after_agent、before/after_model、wrap_model_call、wrap_tool_call)的两类风格、装饰器与类两种写法、state/runtime 参数、返回值与 jump_to 流程跳转

限流(Model/Tool call limit)、故障转移、重试(指数退避+jitter)、上下文编辑、文件搜索等内置中间件,以及多个中间件的洋葱模型执行顺序与"同名中间件"的坑

中间件是什么、为什么需要它,以及四个最常用的内置中间件:Summarization 压缩上下文、HumanInTheLoop 人工审批、PII 敏感信息保护、TodoList 任务规划(含假服务端实测结果)

把前面的知识拼成一个能用的助手:五个工具(天气/计算/时间/货币/搜索)、用类封装 Agent、维护对话历史,以及自动演示+交互式主程序

agent.stream 的七种输出模式(values/updates/messages/tasks/debug/checkpoints/custom)分别输出什么、用在什么场景,以及如何组合使用

如果你喜欢,那么欢迎来到我的世界!
了解更多暂未播放



"人生最大的幸福,是发现自己爱的人正好也爱着自己。"—— 张爱玲


