大模型多轮对话技巧
temperature 如果是0每次返回的是增量代码temperature 如果是0.7每次返回的是全部代码没有多轮对话的效果。import urllib import json import requests import base64 from http.client import HTTPException from typing import List, Dict, Any, Optional from pathlib import Path import os from img_val.val_img_xiti import test_single_image from tools.ggb_html_tool import generate_multi_ggb_html _MODEL_ID None BASE_URL http://192.168.100.203:17890 # 请根据实际服务地址修改 def get_model_id() - str: 获取 vLLM 服务的模型 ID并缓存 global _MODEL_ID if _MODEL_ID is not None: return _MODEL_ID try: resp urllib.request.urlopen(f{BASE_URL}/v1/models, timeout30) data json.loads(resp.read().decode(utf-8)) _MODEL_ID data[data][0][id] print(f获取到模型 ID: {_MODEL_ID}) return _MODEL_ID except Exception as e: print(f获取模型 ID 失败: {e}) raise HTTPException(status_code500, detail无法获取 vLLM 模型 ID) def chat_with_text(text: str, system_prompt: str , temperature: float 0.7, history: Optional[List[Dict[str, str]]] None, stream: bool True) - Dict[str, Any]: model_id get_model_id() messages [] if system_prompt: messages.append({role: system, content: system_prompt}) if history: messages.extend(history) # 添加当前用户消息 messages.append({role: user, content: text}) payload {model: model_id, messages: messages, temperature: temperature, max_tokens: 4096, stream: stream, } full_response try: response requests.post(f{BASE_URL}/v1/chat/completions, jsonpayload, streamstream, timeout300) if response.status_code ! 200: print(f❌ Error: {response.status_code}) print(response.text) return {response: , history: history or []} if stream: # 流式输出 for line in response.iter_lines(): if line: line line.decode(utf-8) if line.startswith(data: ): data line[6:] if data [DONE]: break try: chunk json.loads(data) choices chunk.get(choices, []) if choices: delta choices[0].get(delta, {}) content_delta delta.get(content, ) if content_delta: print(content_delta, end, flushTrue) full_response content_delta except json.JSONDecodeError: continue print() # 换行 else: # 非流式输出 data response.json() full_response data.get(choices, [{}])[0].get(message, {}).get(content, ) print(full_response) # 更新历史记录 updated_history (history or []).copy() updated_history.append({role: user, content: text}) updated_history.append({role: assistant, content: full_response}) return {response: full_response, history: updated_history} except requests.exceptions.Timeout: print(❌ Request timeout) return {response: , history: history or []} except Exception as e: print(f❌ Error: {e}) return {response: , history: history or []} class ChatSession: 对话会话类方便管理多轮对话 def __init__(self, system_prompt: str , temperature: float 0.7): self.system_prompt system_prompt self.temperature temperature self.history: List[Dict[str, str]] [] self.responses: List[str] [] def ask(self, text: str, stream: bool True) - str: result chat_with_text(texttext, system_promptself.system_prompt, temperatureself.temperature, historyself.history, streamstream) self.history result[history] response result[response] self.responses.append(response) return response def clear_history(self): 清空对话历史 self.history [] self.responses [] def get_full_conversation(self) - str: 获取完整的对话文本 conversation [] for msg in self.history: role 用户 if msg[role] user else 助手 conversation.append(f{role}: {msg[content]}) return \n\n.join(conversation) if __name__ __main__: # 方式1直接使用 chat_with_text 函数手动管理历史 if 0: print(方式1手动管理历史) history [] questions [画一个圆 生成ggb代码不要注释, 圆内画一个内接三角形ABC, 过点C 画AB的垂线, 过点A 画角A的角平分线,画一个三角形] for i, q in enumerate(questions): print(f\n--- 第 {i 1} 轮对话 ---) print(f用户: {q}) result chat_with_text(textq, system_prompt你是一个数学几何助手请根据要求生成GeoGebra代码。, historyhistory,temperature0.0, streamTrue) history result[history] print(fresponse: {result[response]}) # 只打印前100字符 if 1: # 方式2使用 ChatSession 类更方便 print(方式2使用 ChatSession 类) session ChatSession(system_prompt你是一个数学几何助手请根据要求生成GeoGebra代码。, temperature0.7) questions [画一个圆 生成ggb代码不要注释, 圆内画一个内接三角形ABC, 过点C 画AB的垂线, 过点A 画角A的角平分线,画一个四边形] for i, q in enumerate(questions): print(f--- 第 {i 1} 轮对话 ---) print(fask: {q}) response session.ask(q, streamTrue) print(fresponse: {response}) # 打印完整对话历史 print(\n * 50) print(完整对话历史:) print( * 50) print(session.get_full_conversation())

相关新闻

解锁魂系游戏模组新境界:ModEngine2智能运行时注入库完全指南

解锁魂系游戏模组新境界:ModEngine2智能运行时注入库完全指南

解锁魂系游戏模组新境界:ModEngine2智能运行时注入库完全指南 【免费下载链接】ModEngine2 Runtime injection library for modding Souls games. WIP 项目地址: https://gitcode.com/gh_mirrors/mo/ModEngine2 探索《艾尔登法环》和《黑暗之魂3》模组管理的…

2026/7/28 0:19:50 阅读更多 →
TPS65982BB芯片解析:集成USB Billboard、数据MUX与5V负载开关的设计指南

TPS65982BB芯片解析:集成USB Billboard、数据MUX与5V负载开关的设计指南

1. 项目概述与核心价值如果你最近在折腾USB Type-C扩展坞、充电器或者任何支持USB Power Delivery(PD)协议的设备,大概率会碰到一个需求:当你的设备(比如一个支持DisplayPort Alt Mode的扩展坞)连接到电脑时…

2026/7/28 0:19:50 阅读更多 →
RISC-V IOMMU 硬件设计学习计划|第 1 天:IOMMU 在 RISC-V SoC 中解决什么问题

RISC-V IOMMU 硬件设计学习计划|第 1 天:IOMMU 在 RISC-V SoC 中解决什么问题

RISC-V IOMMU 硬件设计学习计划|第 1 天:IOMMU 在 RISC-V SoC 中解决什么问题> 计划日期:2026-07-27。本系列基于官方 RISC-V IOMMU Architecture Specification 与官方 riscv-iommu/iommu_ref_model C 参考模型整理。本文自包含阅读&…

2026/7/28 0:19:50 阅读更多 →

最新新闻

阿里网盘几百KB/s卡爆了?这套免费提速方案,解决你的下载焦虑

阿里网盘几百KB/s卡爆了?这套免费提速方案,解决你的下载焦虑

在使用在线云端存储传输文件时,经常会遇到数据接收速率忽高忽低、波动剧烈的情况。有时前一秒还能跑满几兆的速度,下一秒就陡降至几十千字节,这种不稳定的传输体验往往由多方面因素共同决定。 https://www.pandown.orghttps://www.pandown.o…

2026/7/28 0:29:53 阅读更多 →
百度网盘下载太慢怎么办?2026百度网盘加速与解析技巧实测汇总

百度网盘下载太慢怎么办?2026百度网盘加速与解析技巧实测汇总

相信很多人都注意到过这样一个现象:明明使用的是同一根光纤网络,处理同一个文件的获取任务,在下午时往往几分钟就能搞定,可到了晚上,速度却明显变慢,甚至进度条几乎走不动。为什么到了特定时间段&#xff0…

2026/7/28 0:29:53 阅读更多 →
鸣潮自动化工具ok-ww:3步实现游戏智能辅助的后台运行方案

鸣潮自动化工具ok-ww:3步实现游戏智能辅助的后台运行方案

鸣潮自动化工具ok-ww:3步实现游戏智能辅助的后台运行方案 【免费下载链接】ok-wuthering-waves 鸣潮 后台自动战斗 自动刷声骸 一键日常 Automation for Wuthering Waves 项目地址: https://gitcode.com/GitHub_Trending/ok/ok-wuthering-waves 在当今快节奏…

2026/7/28 0:29:53 阅读更多 →
Kafka配置SASL_SSL认证传输加密

Kafka配置SASL_SSL认证传输加密

Kafka配置SASL_SSL认证传输加密 在大数据与消息队列领域,Apache Kafka 凭借其高吞吐、低延迟、高可扩展性等特性,成为实时数据流处理的核心组件。然而,随着数据安全与合规性要求日益严格,Kafka 需要同时满足 传输加密(…

2026/7/28 0:29:53 阅读更多 →
上下文压缩 — 设计规范

上下文压缩 — 设计规范

上下文压缩 — 设计规范 概述 为 opencode-goal 插件增加自动和手动的对话压缩功能。 压缩通过 opencode 服务端对对话历史进行摘要实现,在降低 Token 用量的同时保留关键上下文(目标状态、进度)。 已有的 compact_after_tokens 选项将被激活…

2026/7/28 0:29:53 阅读更多 →
使用Unidbg Debugger逆向分析魔改哈希算法:动态调试实战指南

使用Unidbg Debugger逆向分析魔改哈希算法:动态调试实战指南

1. 逆向分析中的“找不同”:为什么Unidbg Debugger是定位魔改哈希算法的利器逆向分析,尤其是针对移动端应用的加密算法分析,很多时候就像一场高难度的“找不同”游戏。你手头可能有一份标准的算法实现,比如SHA-256、MD5&#xff0…

2026/7/28 0:28:53 阅读更多 →

日新闻

告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生 【免费下载链接】OmenSuperHub Control Omen laptop performance, fan speeds, and keyboard lighting, and unlock power limits. 项目地址: https://gitcode.com/gh_mirrors/om/OmenSuperHub 你是否也曾为官方Om…

2026/7/28 0:00:43 阅读更多 →
RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

做 RAG 的人应该都踩过这个致命的坑:把几百页的财报、法规、技术手册扔给向量库,问一个具体问题,搜出来的全是沾边但没用的内容 —— 关键信息要么被硬切块拆碎了,要么藏在几十条结果的最下面。语义相似≠真正相关,这个…

2026/7/28 0:00:43 阅读更多 →
抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

2026年做短视频运营,从抖音上扒文案早就不是偷偷抄笔记的事了。我刚开始做内容的时候,每天刷半小时抖音,手动把爆款视频的口播敲进备忘录,一条2分钟的视频得花十来分钟,碰到语速快的还要反复回听。后来试了一圈工具&am…

2026/7/28 0:00:43 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/27 4:33:59 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/27 6:31:56 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/27 4:01:12 阅读更多 →

月新闻