元数据索引有关的错
1、代码#!/usr/bin/env python # -*- coding: UTF-8 -*- from langchain_chroma import Chroma from meta_data import docs, metadata_field_info # 自我问询rag self-rag from base_llm import llm, embeddings_model from langchain_classic.retrievers.self_query.base import SelfQueryRetriever #from langchain_classic.retrievers.self_query.chroma import ChromaTranslator # 文档内容描述指导LLM理解文档内容 document_content_description Brief description of technical articles # 创建向量数据库 vectorstore Chroma.from_documents(docs, embeddings_model) SelfQueryRetriever.from_llm 问题:作者A发布的论文2025的 发送给大模型 意图识别 { query: 发布的论文 filter: {year:2025, author:A} } 2.元数据过滤 本地条件判断 3. 语义搜索 在过滤完之后的数据中进行相识度对比 retriever SelfQueryRetriever.from_llm( llm, vectorstore, document_content_description, metadata_field_info, #translatorChromaTranslator(), # 明确指定 enable_limitTrue ) print(retriever.invoke(作者A发布的一篇论文))引用的文件base_llm.py代码如下#!/usr/bin/env python # -*- coding: UTF-8 -*- from dotenv import load_dotenv from langchain_huggingface import HuggingFaceEmbeddings from langchain_openai import ChatOpenAI import os load_dotenv() llm ChatOpenAI(api_keyos.getenv(DASHSCOPE_API_KEY), base_urlos.getenv(DASHSCOPE_BASE_URL), model_nameqwen3.7-plus) # 本地embedding模型地址 embedding_model_path rD:\LLM\Local_model\maidalun\bce-embedding-base_v1 # 初始化嵌入模型用于文本向量化 embeddings_model HuggingFaceEmbeddings( model_nameembedding_model_path )引用的文件meta_data.py代码如下#!/usr/bin/env python # -*- coding: UTF-8 -*- from langchain_core.documents import Document from langchain_classic.chains.query_constructor.schema import AttributeInfo docs [ Document( page_content作者A团队开发出基于深度学习的图像识别系统在复杂场景下的识别准确率提升250%, metadata{year: 2025, rating: 9.3, genre: AI, author: A}, ), Document( page_content物联网技术成功应用于智能农业监控作者B主导的项目实现农作物产量提升20%, metadata{year: 2024, rating: 9.5, genre: IoT, author: B}, ), Document( page_content边缘计算平台实现实时数据处理突破作者C构建的新型架构支持千万级并发计算, metadata{year: 2023, rating: 8.8, genre: Edge Computing, author: C}, ), Document( page_content机器学习模型预测2025年股市趋势作者A团队构建的模型准确率超95%, metadata{year: 2024, rating: 9.0, genre: Machine Learning, author: A}, ), Document( page_content基于人工智能的心脏病诊断系统在临床应用中达到顶级专家水平作者B获医疗科技创新奖, metadata{year: 2025, rating: 7.2, genre: AI, author: B}, ), Document( page_content区块链技术在供应链管理中取得突破作者C设计的新型协议提升供应链透明度30%, metadata{year: 2024, rating: 8.9, genre: Blockchain, author: C}, ), Document( page_content云计算平台实现能效优化作者A研发的智能调度系统使数据中心能耗降低50%, metadata{year: 2024, rating: 8.6, genre: Cloud, author: A}, ), Document( page_content大数据分析助力环保监测作者B团队实现污染源识别准确率提升30%, metadata{year: 2025, rating: 7.5, genre: Big Data, author: B}, ) ] # 元数据字段定义指导LLM如何解析查询条件 工具 metadata_field_info [ AttributeInfo( namegenre, descriptionTechnical domain of the article, options: [AI, Blockchain, Cloud, Big Data], typestring, ), AttributeInfo( nameyear, descriptionPublication year of the article, typeinteger, ), AttributeInfo( nameauthor, descriptionAuthors name who signed the article, typestring, ), AttributeInfo( namerating, descriptionTechnical value assessment score (1-10 scale), typefloat ) ]2、执行报错了报错内容如下C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Scripts\python.exe C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_core\utils\pydantic.py:41: UserWarning: Core Pydantic V1 functionality isnt compatible with Python 3.14 or greater. from pydantic.v1 import BaseModel as BaseModelV1 Loading weights: 100%|██████████| 199/199 [00:0000:00, 65081.21it/s] Traceback (most recent call last): File C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py, line 39, in module retriever SelfQueryRetriever.from_llm( llm, ...4 lines... enable_limitTrue ) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 374, in from_llm structured_query_translator _get_builtin_translator(vectorstore) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 71, in _get_builtin_translator from langchain_community.vectorstores import ( ...17 lines... ) ImportError: cannot import name DatabricksVectorSearch from langchain_community.vectorstores (C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_community\vectorstores\__init__.py) Process finished with exit code 1在deepseek上面搜索方案DeepSeek使用了这种方案执行还是报一样的错C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Scripts\python.exe C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_core\utils\pydantic.py:41: UserWarning: Core Pydantic V1 functionality isnt compatible with Python 3.14 or greater. from pydantic.v1 import BaseModel as BaseModelV1 Loading weights: 100%|██████████| 199/199 [00:0000:00, 49983.02it/s] Traceback (most recent call last): File C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py, line 39, in module retriever SelfQueryRetriever.from_llm( llm, ...4 lines... enable_limitTrue ) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 374, in from_llm structured_query_translator _get_builtin_translator(vectorstore) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 71, in _get_builtin_translator from langchain_community.vectorstores import ( ...17 lines... ) ImportError: cannot import name DatabricksVectorSearch from langchain_community.vectorstores (C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_community\vectorstores\__init__.py) Process finished with exit code 1

相关新闻

Linux磁盘分区与Swap和磁盘故障查询

Linux磁盘分区与Swap和磁盘故障查询

Linux 磁盘分区 GPT、swap 与磁盘故障排查总结一、磁盘分区实操:GPT GPT,全称是 GUID Partition Table,中文一般叫“全局唯一标识分区表”。 如果说 MBR 是老式分区表,那么 GPT 就是现在新服务器、大容量磁盘更常见的分区方式。尤…

2026/10/1 21:13:35 阅读更多 →
【单片机毕设案例分享】基于 STM32 的电梯声光报警与楼层提示系统设计 基于嵌入式单片机电梯内外呼叫信号处理系统(016801)

【单片机毕设案例分享】基于 STM32 的电梯声光报警与楼层提示系统设计 基于嵌入式单片机电梯内外呼叫信号处理系统(016801)

博主介绍:✌️码农一枚 ,专注于大学生项目实战开发、讲解和毕业🚢文撰写修改等。全栈领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于单片机,STM32单片机,51单片机,J…

2026/10/3 13:47:48 阅读更多 →
如何快速上手DeepSeek-Coder-V2:AI编程助手的完整指南

如何快速上手DeepSeek-Coder-V2:AI编程助手的完整指南

如何快速上手DeepSeek-Coder-V2:AI编程助手的完整指南 【免费下载链接】DeepSeek-Coder-V2 DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence 项目地址: https://gitcode.com/GitHub_Trending/de/DeepSeek-Coder-V2 D…

2026/10/3 0:27:40 阅读更多 →

最新新闻

绿色版Directory Opus 9.5.0.0实战:配置、批量处理与避坑指南

绿色版Directory Opus 9.5.0.0实战:配置、批量处理与避坑指南

简介:Directory Opus 9.5.0.0 3568.x86 绿色特别版是一款面向 Windows 32 位系统的专业文件管理工具,适合希望替代系统自带资源管理器、追求高效文件操作与便携使用的普通及进阶用户。它支持双面板或多面板布局,集成批量重命名、目录同步、快…

2026/10/11 10:29:12 阅读更多 →
情感分析从模型跑通到业务敢用:技术选型、微调参数与避坑指南

情感分析从模型跑通到业务敢用:技术选型、微调参数与避坑指南

简介:这份资源是一篇系统梳理自然语言处理中情感分析技术的docx文档,面向NLP研究人员、数据科学家及从事情感分析应用的专业人士。内容从研究背景与意义切入,依次探讨基于规则、机器学习与深度学习三类方法的原理与差异,并通过公开…

2026/10/11 10:29:12 阅读更多 →
2.5 倍更快、缩小 97%:Claude Code Rust 性能基准测试深度剖析

2.5 倍更快、缩小 97%:Claude Code Rust 性能基准测试深度剖析

2.5 倍更快、缩小 97%:Claude Code Rust 性能基准测试深度剖析 【免费下载链接】claude-code-rust 🚀 Rust 全量重构的 Claude Code - 性能提升 2.5x,体积减少 97% | High-performance Rust implementation of Claude Code with 2.5x faster …

2026/10/11 10:29:12 阅读更多 →
Eta接入MCP生态:连接远程工具服务器与安全配置Bearer Token

Eta接入MCP生态:连接远程工具服务器与安全配置Bearer Token

【免费下载链接】Eta System-level Android AI Agent with direct OS access. | Android 系统级 AI Agent——越过沙盒,让模型访问底层API、屏幕、终端与你的数据 项目地址: https://gitcode.com/gh_mirrors/eta9/Eta 点击查看 免费下载 Eta 是一款 And…

2026/10/11 10:29:12 阅读更多 →
ArcGIS Pro水文水环境全流程教学:数据处理、水文分析、三维模拟、二次开发与论文实战

ArcGIS Pro水文水环境全流程教学:数据处理、水文分析、三维模拟、二次开发与论文实战

ArcGIS Pro 是一款集成数据采集、处理、分析与可视化的专业 GIS 平台,广泛应用于水文、水资源、水生态和水环境研究。在水文分析方面,基于 DEM 可实现流域划分、河网提取及控制面积计算;支持矢量与栅格数据融合,便于空间关联分析。…

2026/10/11 10:29:12 阅读更多 →
WPS表格函数公式实战:VLOOKUP、SUMIFS避坑与组合应用

WPS表格函数公式实战:VLOOKUP、SUMIFS避坑与组合应用

简介:WPS官方函数公式视频教程是一份面向职场办公与数据分析人群的精选函数指南,旨在帮助用户系统掌握VLOOKUP、IF、SUMIF、COUNTIF等高频函数的实用技巧,解决数据处理中查找、统计、排序与日期计算的常见难题。压缩包共1个PDF文件&#xff0…

2026/10/11 10:28:12 阅读更多 →

日新闻

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

简介:基于 ARIMA、LSTM、Transformer 等模型的流感时间序列预测 Python 源码,面向计算机相关专业课程设计与期末大作业学生,以及项目实战学习者。内容覆盖预处理、平稳性检验、定阶、残差分析、多模型对比预测的完整时序建模流程,…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别 做影刀RPA自动化,十个新手有八个栽在"往输入框里填东西"这件事上:要么填不进去,要么填了一半,要么直接把原来内容追加在后面。这背后的根因&…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容 1. 认识影刀:什么场景该用RPA采小说数据 起点中文网的页面结构相对稳定——分类榜单、书籍详情、章节内容三块独立页面,跳转链路清晰。这种场景非常适合影刀自动化&#x…

2026/10/11 0:00:27 阅读更多 →

周新闻

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

流感时间序列预测实战:ARIMA/LSTM全流程拆解与避坑指南

简介:基于 ARIMA、LSTM、Transformer 等模型的流感时间序列预测 Python 源码,面向计算机相关专业课程设计与期末大作业学生,以及项目实战学习者。内容覆盖预处理、平稳性检验、定阶、残差分析、多模型对比预测的完整时序建模流程,…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别

影刀RPA新手教程:键盘模拟输入实战——输入文本与模拟按键的区别 做影刀RPA自动化,十个新手有八个栽在"往输入框里填东西"这件事上:要么填不进去,要么填了一半,要么直接把原来内容追加在后面。这背后的根因&…

2026/10/11 0:00:27 阅读更多 →
影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容

影刀RPA新手教程:阅文起点小说数据采集实战——书籍信息与章节内容 1. 认识影刀:什么场景该用RPA采小说数据 起点中文网的页面结构相对稳定——分类榜单、书籍详情、章节内容三块独立页面,跳转链路清晰。这种场景非常适合影刀自动化&#x…

2026/10/11 0:00:27 阅读更多 →

月新闻

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 5:23:50 阅读更多 →
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/9 21:32:20 阅读更多 →
黑夜航拍船只数据集训练YOLOV5模型全流程解析

黑夜航拍船只数据集训练YOLOV5模型全流程解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/10 10:38:42 阅读更多 →