【LLM】第七章:LangChain中的消息、提示词模板、工具的使用

发布时间:2026/9/24 11:15:16
【LLM】第七章:LangChain中的消息、提示词模板、工具的使用 【LLM】第七章LangChain中的消息、提示词模板、工具的使用一、本章要讲解的内容消息和提示词模板上图是我们和大模型交互的流程分A、B、C三部分A是用户喂入大模型的提示词。对提示词进行格式封装的称为提示词模板本章节讲这部分。B是大模型本模也叫基座目前都以对话模型为主。大模型创建和调用请参考【LLM】第六章LangChain框架中的大模型的创建与调用-CSDN博客 。C是大模型的输出因为大模型本身的输出格式不一定是用户想要的输出格式比如我们想让大模型输出字符串格式或者json格式或者其他指定的格式那此时就得把大模型的输出进一步解析(Parse)才能得到我们想要的特定输出格式。这部分内容后面章节会单独讲。二、langchain的消息对象在langchain中消息(Message)是模型交互的基本单元。Message标准可以保证不同的模型(无论你使用的是OpenAI、Anthropic、Gemini还是本地大模型)的消息格式自动对齐提供一致的上下文数据结构。1、消息的构成一轮大模型对话由一条或多条Message构成。每个Message包括三种字段1Role消息所属的角色。目前共有4种角色:system、user、assistant、tool。system表示这是系统消息用于在用户对话开始时给模型设定的角色、行为准则和上下文背景。user表示这是用户信息也就是用户喂入模型的提示词prompt可是是文本、图片、音频、文档等也叫user message。assistant是模型的回复就是模型生成的文本、工具调用、元数据等也叫AI message。tool是工具调用信息。2content文本内容就是说了什么。3metadata元数据字段描述上下文状态的元信息比如名称、时间戳、对话角色、轮次ID等用于保持对话的一致性和可追踪性。matadata字段属于自定义的字段用于对消息进行区分。所以这个数据的字段名取决于模型提供商需要查看官方手册。2、消息格式langchain支持JSON格式和对象格式的信息三、记忆对话历史管理上面例子是一轮大模型对话的输入和输出。我们知道大模型是没有记忆功能的那要使多轮对话是连贯一致的我们就要把每次对话的历史信息都记下来每次对话都拿着所有前面轮次的对话内容本论内容一起喂入大模型此时大模型返回的内容就是具有记忆的回答。但是随着问答轮次的增加对话历史会越来越长消耗的token和时间成本也会更大所以我们一般都是一是保留所有的system消息因为这是定义对话角色的。二是保留最近N论对话丢弃更早的对话历史。根据这个思路我们这里写一个多轮对话聊天机器人的示例from langchain_deepseek import ChatDeepSeek from dotenv import load_dotenv load_dotenv(overrideTrue) #基础配置 MODEL_NAME deepseek-v4-flash MAX_PAIRS_HISTORY 3 EXIT_WORDquit llm ChatDeepSeek(modelMODEL_NAME) # 初始化模型 messages [{role:system, content:你是一个AI小姐姐}] #初始化消息列表 def get_recent_messages(messages, max_pairs3): #保留最近的N轮对话 system_messages [m for m in messages if m.get(role)system] conversation_maessages [m for m in messages if m.get(role)!system] return system_messages conversation_maessages[-(max_pairs*2):] #开始多轮聊天对话 print(f请输入你的问题当输入{EXIT_WORD}时结束对话。) i 1 while True: print(*10, f第{i}轮对话开始, *10) user_input input(请输入) if user_input EXIT_WORD: #判断是否结束当前对话 print(会话已结束欢迎下次再来) break messages.append({role:user, content:user_input}) #将用户的输入信息添加到消息列表中 memory_messages get_recent_messages(messages, max_pairsMAX_PAIRS_HISTORY) #print(-----messages--------, messages) #print(---memory_messages---, memory_messages) print(ai小姐姐, end, flushTrue) reply_content for chunk in llm.stream(memory_messages): #流式输出模型的响应 if chunk.content: print(chunk.content, end, flushTrue) reply_content chunk.content print(\n, *10, f第{i}轮对话结束, *10, \n) i 1 messages.append({role:assistant, content:reply_content})from langchain_deepseek import ChatDeepSeek from dotenv import load_dotenv load_dotenv(overrideTrue) #基础配置 MODEL_NAME deepseek-v4-flash MAX_PAIRS_HISTORY 3 EXIT_WORDquit llm ChatDeepSeek(modelMODEL_NAME) # 初始化模型 messages [{role:system, content:你是一个AI小姐姐}] #初始化消息列表 def get_recent_messages(messages, max_pairs3): #保留最近的N轮对话 system_messages [m for m in messages if m.get(role)system] conversation_maessages [m for m in messages if m.get(role)!system] return system_messages conversation_maessages[-(max_pairs*2):] #开始多轮聊天对话 print(f请输入你的问题当输入{EXIT_WORD}时结束对话。) i 1 while True: print(*10, f第{i}轮对话开始, *10) user_input input(请输入) if user_input EXIT_WORD: #判断是否结束当前对话 print(会话已结束欢迎下次再来) break messages.append({role:user, content:user_input}) #将用户的输入信息添加到消息列表中 memory_messages get_recent_messages(messages, max_pairsMAX_PAIRS_HISTORY) #print(-----messages--------, messages) #print(---memory_messages---, memory_messages) print(ai小姐姐, end, flushTrue) reply_content for chunk in llm.stream(memory_messages): #流式输出模型的响应 if chunk.content: print(chunk.content, end, flushTrue) reply_content chunk.content print(\n, *10, f第{i}轮对话结束, *10, \n) i 1 messages.append({role:assistant, content:reply_content})待续。。。。