Jina Reranker 3.5:法律、医疗检索提速超 50%,多领域超越大 7 倍参数模型!
信息检索新高度Jina Reranker 3.5 优势尽显信息检索的竞争已进入新高度。Jina Reranker 3.5 在判例法表现比 v3 提升超 50%在法律、医疗和金融基准测试中缩小与体积大 7 倍模型差距在结构化数据上超越它们且是 v3 直接替代品无需修改 API。可通过 Elasticsearch 动手实践深入体验示例 Notebook查看 Elasticsearch Labs repo 开始 免费云试用或在本地机器体验 Elastic。jina - reranker - v3.5 是拥有 6 亿参数的重排序模型相比前代 jina - reranker - v3在法律检索任务显著提升在法律、医疗和金融重排序任务缩小与参数规模大 7 倍模型差距。长文档场景下比 jina - reranker - v3 最快提升 56%运行速度判例法检索任务得分提高超 50%还在 STaRK 结构化数据基准测试击败 Qwen3 - Reranker - 4B。对 v3 用户来说可直接替换无需修改 API 代码。重排序模型揭秘重排序模型reranker用于信息检索流水线后期对候选结果从最匹配到最不匹配重新排序用针对候选结果排序训练的模型可提升检索结果质量。Jina AI 最新重排序模型采用后期交互late interaction技术将查询和文档分别编码为 token 向量嵌入embeddings表示 token 语义后比较。这类似词汇和语法歧义消解在 AI 中的实现基于 Transformer 的模型能完成歧义消解并编码更丰富语义信息。后期交互重排序模型为查询和候选文档生成融合上下文信息的 token 向量通过比较计算可排序分数不依赖候选结果生成方式但最终效果取决于候选结果质量虽无法修复糟糕的第一阶段检索但能提升已有检索结果质量。jina - reranker - v3.5 是 listwise 重排序模型采用 [last - but - not - late](https://jina.ai/news/jina - reranker - v3 - 0 - 6b - listwise - reranker - for - sota - multilingual - retrieval/#:~:textquery%2Ddocument%20interaction%20%22-,last%20but%20not%20late,-.%22%20It%27s%20%22last) 技术查询和候选结果一起输入模型一次前向计算处理为候选结果返回数值分数能利用更多信息生成更好排序结果。jina - reranker - v3 证明该交互方式的列表式重排序模型可在通用重排序基准测试与最大模型竞争目前只有 jina - reranker - v3.5 和参数规模超 40 亿模型在大规模文本向量嵌入基准[Massive Text Embedding BenchmarkMTEB](https://mteb - leaderboard.hf.space/benchmark/MTEB%28Multilingual%2C%20v2%29)重排序任务表现超它但该方法对候选列表大小有限制。Jina Reranker v3.5 解决的问题尽管 jina - reranker - v3 有业界领先性能但存在明显短板。在特定领域文本检索方面它基于通用文本语料训练在法律文本、医学文献、金融数据集、计算机编程和 IT 文档、产品目录等场景表现不理想。在结构化数据处理上大量现实世界数据以结构化记录存储仅针对文本比较训练的 jina - reranker - v3 处理这类数据表现差。长候选列表带来高计算成本多数文本处理 AI 模型采用自注意力架构内存和计算需求随输入规模增加呈二次方增长jina - reranker - v3 使用完整输入上下文窗口时计算成本高而要发挥模型效果需放入更多候选匹配结果导致运行速度慢、计算成本高。开发 jina - reranker - v3.5 就是为解决这些问题且不降低通用文本检索任务性能。Jina Reranker v3.5 新特性jina - reranker - v3.5 采用改进后的注意力机制提升性能、处理速度降低推理[inference](https://www.elastic.co/docs/explore - analyze/elastic - inference)阶段处理完整输入上下文窗口的计算资源。引入全新三阶段自蒸馏训练流程适合大输入上下文模型的滑动窗口架构。针对 jina - reranker - v3 短板使用新训练数据包括多语言法律文本、医学文本含中文医疗问答数据、金融行业数据、结构化数据电商领域及公开表格语料数据、扩展后的多语言和跨语言文本。有关其数据来源和技术创新详细信息可参阅技术报告。Jina Reranker 3.5 在检索基准测试中的表现在通用文本重排序性能BEIR 和 MIRACL方面jina - reranker - v3.5 表现提升。英文 [Benchmarking Information Retrieval (BEIR)](https://github.com/beir - cellar/beir) 基准测试中平均得分超业界领先的 [Qwen3 - Reranker - 4B](https://huggingface.co/Qwen/Qwen3 - Reranker - 4B)、[Qwen3 - Reranker - 0.6B](https://huggingface.co/Qwen/Qwen3 - Reranker - 0.6B) 以及 Mixedbread AI 的重排序模型。还提升了 jina - reranker - v3 在 Multilingual Information Retrieval Across a Continuum of Languages (MIRACL) 基准测试的多语言重排序性能目前只有拥有 40 亿参数的 Qwen3 重排序模型能稳定超 jina - reranker - v3.5 得分。在法律、医疗和金融领域重排序中[Retrieval Embedding Benchmark (RTEB) suite](https://huggingface.co/blog/rteb) 包含多领域检索基准测试jina - reranker - v3.5 在相关 RTEB 任务中超 jina - reranker - v3 表现只有参数量接近 7 倍的大型 Qwen3 重排序模型平均性能更好新模型在法律数据提升显著判例法检索任务得分相比 jina - reranker - v3 提升超 50%。在结构化数据重排序Struct - IR 和 STaRK 基准测试中评估 jina - reranker - v3.5 能力两个基准测试含 AI 生成的 JSON 文本数据覆盖多种场景。jina - reranker - v3.5 在 Struct - IR 基准测试得分提升仅 Qwen3 - Reranker - 4B 超它在 STaRK 基准测试击败所有其他测试模型。推理速度方面候选文档越长jina - reranker - v3.5 架构改进优势越明显。用两个平均文档长度差异大的检索数据集验证jina - reranker - v3.5 在两种情况下都更快。Natural Questions 基准测试中速度提升 22%平均请求延迟从 371.1 毫秒降至 305.3 毫秒。AILAcasedocs 基准测试中jina - reranker - v3 需 16,064.9 毫秒jina - reranker - v3.5 需 10,290.9 毫秒实现 56%速度提升降低应用程序延迟和计算成本。使用建议与方式重排序能提升搜索精准度jina - reranker - v3.5 适用于各种信息检索场景但有一定限制最佳实践建议总结在表格中。jina - reranker - v3.5 可通过 [Jina API](https://jina.ai/reranker/) 使用有免费 token 体验也可通过 [Elastic Inference API](https://www.elastic.co/docs/explore - analyze/elastic - inference/inference - api) 和 [Elastic Inference Service](https://www.elastic.co/docs/explore - analyze/elastic - inference/eis) 使用。已使用 jina - reranker - v3 的用户修改相应字段即可替换两模型接口一致。可将其作为 [Jina On - Prem 容器](https://www.elastic.co/search - labs/blog/on - prem - ai - jina - embedding - models) 安装在本地硬件运行模型权重可下载测试研究按 [Hugging Face 上该模型页面](https://huggingface.co/jinaai/jina - reranker - v3.5) 说明操作。该模型基于 [CC BY - NC - 4.0](https://creativecommons.org/licenses/by - nc/4.0/deed.en) 许可证提供可用于测试、构建原型或科研商业用途联系 Elastic 销售团队。

相关新闻

南华大学附属长沙中心医院团队Aging Cell:心肌衰老为什么越拖越难逆?USP45-CFTR轴给出线索

南华大学附属长沙中心医院团队Aging Cell:心肌衰老为什么越拖越难逆?USP45-CFTR轴给出线索

导读 2026 年 Aging Cell 发表文献“A Non-Channel Function of CFTR: Attenuating Mitochondrial Oxidative Stress and Cardiomyocyte Senescence via Stabilization by USP45”,DOI:10.1111/acel.70610。文献来自南华大学衡阳医学院附属长沙中心医院心…

2026/7/31 7:39:26 阅读更多 →
武汉AI客服与销售跟进系统热门厂商选择指南

武汉AI客服与销售跟进系统热门厂商选择指南

武汉AI客服与销售跟进系统热门厂商选择指南随着数字化转型的深入,企业对获客效率和服务质量的要求日益提升。在华中地区,尤其是武汉,武汉AI客服与销售跟进系统热门厂商有哪些逐渐成为本地企业管理者关注的热点话题。目前,武汉地区…

2026/7/31 7:38:26 阅读更多 →
我不再让 Codex 一口气改完整个页面:前端需求这样拆,才真正可验收

我不再让 Codex 一口气改完整个页面:前端需求这样拆,才真正可验收

上一篇解决的是“信息怎么分层”,这篇继续往下走:需求已经讲清楚之后,怎样把它拆成 Codex 可以逐步完成、我也能逐步验收的小任务? 很多人听到“拆任务”,第一反应是按文件拆: 先改页面文件。 再改接口文…

2026/7/31 7:38:26 阅读更多 →

最新新闻

UE4 GameClient源码剖析:从架构到性能优化的核心技术解析

UE4 GameClient源码剖析:从架构到性能优化的核心技术解析

1. 项目概述:从“能用”到“精通”的必经之路在UE4客户端开发这条路上,很多朋友可能已经能熟练地拖拽蓝图、编写简单的C Actor,甚至能独立完成一个功能模块。但你是否遇到过这样的困惑:为什么我的游戏在特定场景下会莫名卡顿&…

2026/7/31 8:03:34 阅读更多 →
5分钟快速上手BilibiliDown:免费跨平台B站视频下载终极指南

5分钟快速上手BilibiliDown:免费跨平台B站视频下载终极指南

5分钟快速上手BilibiliDown:免费跨平台B站视频下载终极指南 【免费下载链接】BilibiliDown (GUI-多平台支持) B站 哔哩哔哩 视频下载器。支持稍后再看、收藏夹、UP主视频批量下载|Bilibili Video Downloader 😳 项目地址: https://gitcode.com/gh_mirr…

2026/7/31 8:03:34 阅读更多 →
C++ STL list::push_back() 底层机制与性能优化全解析

C++ STL list::push_back() 底层机制与性能优化全解析

1. 项目概述:从 push_back() 窥探C STL容器的设计哲学 如果你写过C,尤其是用过标准模板库(STL),那么 std::list 和它的 push_back() 函数对你来说,就像吃饭用筷子一样自然。但就是这个看似简单的“在…

2026/7/31 8:03:34 阅读更多 →
二极管核心应用电路全解析:从整流、保护到信号处理实战

二极管核心应用电路全解析:从整流、保护到信号处理实战

1. 从“单向导电”到“电路基石”:二极管应用全景解析提起二极管,很多刚入行的电子爱好者或工程师的第一反应可能就是“单向导电”。这个定义没错,但它就像只告诉你汽车有四个轮子一样,远远不足以让你真正驾驭它。在我十多年的电路…

2026/7/31 8:03:34 阅读更多 →
Jdk17安装、环境配置详细教程【Windows】

Jdk17安装、环境配置详细教程【Windows】

JDK 17(Java Development Kit 17)是Java编程语言的软件开发工具包,它的主要功能是为开发者提供编译、调试和运行Java程序所需的所有工具和环境。如果你想要学习Java编程、开发Java应用程序,或者需要在电脑上运行Java软件&#xff…

2026/7/31 8:03:34 阅读更多 →
3分钟破解百度网盘提取码:智能工具让你的资源获取效率提升10倍

3分钟破解百度网盘提取码:智能工具让你的资源获取效率提升10倍

3分钟破解百度网盘提取码:智能工具让你的资源获取效率提升10倍 【免费下载链接】baidupankey 在线查询网盘提取码(维护中 rm repo) 项目地址: https://gitcode.com/gh_mirrors/ba/baidupankey 还在为百度网盘分享链接的提取码而烦恼吗…

2026/7/31 8:02:34 阅读更多 →

日新闻

物理复制比逻辑复制好在哪?数据库复制原理详解

物理复制比逻辑复制好在哪?数据库复制原理详解

数据库复制是把主库数据同步到备库的机制,分为逻辑复制和物理复制两种。逻辑复制传输的是 SQL 语句或行变更事件,物理复制传输的是存储引擎底层的物理日志。阿里云 PolarDB(云原生数据库)采用物理复制,在同步延迟、数据…

2026/7/31 0:00:34 阅读更多 →
BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南 【免费下载链接】BilibiliDown (GUI-多平台支持) B站 哔哩哔哩 视频下载器。支持稍后再看、收藏夹、UP主视频批量下载|Bilibili Video Downloader 😳 项目地址: https://gitcode.com/gh_mirrors/bi/Bilib…

2026/7/31 0:00:34 阅读更多 →
有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

当前,游戏行业的“DataAI融合”已从概念验证进入价值落地阶段。根据IDC 2025年数据,中国AI游戏云市场规模已达18.6亿元;同时,游戏研发环节AI渗透率高达86%,生成式AI内容普及率超过50%。面对庞大的市场,游戏…

2026/7/31 0:00:34 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/31 1:03:03 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/29 14:34:28 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/31 4:19:39 阅读更多 →

月新闻