生命涌现的小龙虾技能之【Intelligent Video Search  Retrieval Analysis Skill | 视频搜索检索智能分析技能】简介
Intelligent Video Search Retrieval Analysis Skill | 视频搜索检索智能分析技能智能分析中枢· 图片/视频智能分析 · 结构化报告 · 历史报告云端查询 技能概览 | Overview模块内容️ 技能名称视频搜索检索智能分析技能 核心目标视频搜索/视频检索智能分析技能基于目标、语义描述进行智能视频搜索支持常规目标检索、自然语言描述检索、向量化模型匹配️ 输入类型图片、视频、本地文件、网络 URL 输出能力结构化分析报告、识别/监测结果、建议与报告链接 场景码VIDEO_SEARCHBased on multimodal large models and deep learning algorithms, this feature constructs a next-generation intelligentvideo retrieval system, supporting three core modes: conventional object retrieval, natural language descriptionretrieval, and vectorized model matching. Through computer vision technology, the system automatically identifies andindexes conventional targets such as people, vehicles, and objects. Simultaneously, it leverages image-text multimodallarge models to achieve cross-modal alignment between semantics and video content, enabling open-ended retrieval vianatural language descriptions like “person wearing red clothes” or “talking on the phone.” Furthermore, employing afull-modal vectorization model, the system transforms video content into high-dimensional vectors, realizing fusedretrieval across mixed modalities of text, image, and video. Supporting multi-condition combination and fuzzy semanticmatching, it rapidly locates target footage, meeting the precise retrieval demands of complex scenarios such as securitysurveillance and video asset management.本功能基于多模态大模型与深度学习算法构建了新一代智能视频检索系统支持常规目标检索、自然语言描述检索及向量化模型匹配三种核心模式。系统通过计算机视觉技术自动识别并索引人、车、物等常规目标同时利用图文多模态大模型实现语义与视频内容的跨模态对齐支持用户通过“穿红色衣服的人”、“打电话”等自然语言描述进行开放式检索。此外系统采用全模态向量化模型将视频内容转化为高维向量实现文本、图像、视频混合模态的融合检索支持多条件组合与模糊语义匹配快速定位目标画面满足安防监控、视频资产管理等复杂场景下的精准检索需求 技能演示 | Skill Demo▶️ 点击查看技能使用介绍 任务目标 | Goals1. 技能用途在长视频中根据用户提供的目标描述或关键词智能搜索定位包含特定目标的片段2. ️ 能力范围序号具体能力1常规目标检索检测特定物体/人物出现2自然语言智述检索用自然语言描述要找的内容3向量化模型匹配3. ⚡ 触发条件触发类型触发规则✅ 默认触发默认触发当用户需要在视频中搜索特定内容/目标时默认触发本技能进行视频检索分析 明确分析意图当用户明确需要视频搜索、视频检索时提及视频搜索、视频检索、找片段、定位目标、智能搜视频等关键词并且提供了视频文件和搜索描述 历史报告查询当用户提及以下关键词时自动触发历史报告查询功能查看历史搜索报告、视频搜索报告清单、搜索报告列表、查询历史搜索报告、显示所有搜索报告、视频检索分析报告查询视频搜索分析报告4. 自动行为自动行为执行要求 附件处理如果用户上传了附件或者视频/图片文件则自动保存为本地文件☁️ 历史报告查询如果用户触发历史报告查询关键词必须直接调用云端 API 查询不得从本地记忆或人工汇总中获取⚠️ 强制数据获取规则次高优先级橙色强约束历史报告清单只允许从云端接口读取不允许从本地记录、长期记忆或人工汇总中提取。必须执行python-mscripts.video_search_analysis--list类型要求✅ 必须使用python -m scripts.video_search_analysis --list调用 API 查询云端的历史报告数据 严格禁止从本地memory目录读取历史会话信息 严格禁止手动汇总本地记录中的报告 严格禁止从长期记忆中提取报告✅ 输出格式必须统一从云端接口获取最新完整数据然后以 Markdown 表格格式输出结果 前置准备 | Requirements依赖说明:scripts 脚本所需的依赖包及版本requests2.28.0 操作步骤 | Workflow 用户身份处理内部自动完成绿色安全原则用户身份参数由系统内部自动处理不得向用户展示、询问或要求输入任何身份标识。执行本技能分析或历史报告查询时脚本会自动完成身份初始化场景系统行为上游系统有内部身份参数由脚本静默接收并使用上游系统未提供内部身份参数脚本会自动复用本地缺省用户本地缺省用户不存在脚本会自动创建并在后续任务中复用对用户输出只展示分析进度、分析结果和报告链接不展示内部身份值 关键约束禁止/要求说明 不得询问身份不得提示用户输入用户名、手机号或任何内部身份参数 不得暴露身份值不得在回复、报告、示例、错误提示中暴露内部身份值 不得列为用户参数不得把内部身份参数列为用户需要理解或传入的参数✅ 自动关联报告历史报告查询同样由系统内部身份自动关联用户只需表达“查看历史报告/报告清单”等意图 标准流程 | Standard Flow步骤阶段执行动作1 准备视频输入提供本地文件路径或网络 URL确保输入内容清晰、符合技能场景要求2 系统自动完成身份关联无需用户输入任何身份参数不在回复中展示内部身份值3⚙️ 执行视频搜索智能分析调用-m scripts.video_search_analysis处理输入必须在技能根目录下运行脚本4 查看分析结果接收结构化分析报告查看识别/监测结果、风险提示、建议与报告链接⚙️ 脚本参数说明参数含义备注--input本地视频文件路径适用于本地文件分析--url网络视频 URL 地址API 服务自动下载API 服务自动下载网络资源--text搜索目标/自然语言描述说明要找什么内容按需填写--list显示历史视频搜索分析报告列表清单可以输入起始日期参数过滤数据范围用于云端历史报告查询--api-urlAPI 服务地址可选使用默认值按需填写--detail输出详细程度basic/standard/json默认 json输出详细程度--output结果输出文件路径可选可选️ 资源索引 | Resource Index资源类型路径用途何时读取 必要脚本scripts/video_search_analysis.py调用 API、执行分析或查询历史报告执行分析或查询时使用 必要脚本scripts/config.py调用 API、执行分析或查询历史报告执行分析或查询时使用 领域参考references/api_doc.md了解 API 接口规范、字段说明和错误码仅在需要了解接口规范或错误码时读取⚠️ 注意事项 | Notes分类注意事项 文档读取仅在需要时读取参考文档保持上下文简洁 格式支持支持格式mp4/avi/mov最大 1GB‍⚖️ 结果性质搜索结果仅供参考请以实际视频内容为准 脚本限制禁止临时生成脚本只能用技能本身的脚本 网络地址传入的网路地址参数不需要下载本地默认地址都是公网地址api 服务会自动下载 报告输出当显示历史分析报告清单的时候从接口返回 json 数据中提取字段 作为超链接地址且自动转化为如下 Markdown 报告输出表格输出示例 使用示例 | Examples# 在本地视频中搜索特定目标python-mscripts.video_search_analysis--input/path/to/life.mp4--text狗狗出现的片段在网络视频中用自然语言搜索 python-mscripts.video_search_analysis--urlhttps://example.com/event.mp4--text有人发言的片段显示历史搜索报告/显示搜索报告清单列表/显示历史视频搜索自动触发关键词查看历史搜索报告、历史报告、搜索报告清单等 python-mscripts.video_search_analysis--list# 输出精简报告python-mscripts.video_search_analysis--inputvideo.mp4--text汽车--detailbasic# 保存结果到文件python-mscripts.video_search_analysis--inputvideo.mp4--text人物出现--outputresult.json我们提供定制化AI技能开发服务。如果您有特定的业务需求可以联系我们的商务团队我们会为您量身打造专属的AI解决方案。

相关新闻

深入解析ADC08DL500:高速模数转换器的折叠插值架构与工程实践

深入解析ADC08DL500:高速模数转换器的折叠插值架构与工程实践

1. ADC08DL500:高速信号数字化的核心引擎在雷达、软件无线电、高端示波器或者医疗成像设备的设计中,工程师们常常面临一个核心挑战:如何将现实世界中瞬息万变、高达数百兆赫兹的模拟信号,精准、实时地“翻译”成数字世界能够理解的…

2026/7/23 15:36:20 阅读更多 →
【架构实战】多活架构:异地多活与单元化部署

【架构实战】多活架构:异地多活与单元化部署

一、那场"机房断电"事故 2022年7月,某天下午3点,我们主机房所在的城市突发大规模停电。 虽然机房有UPS和柴油发电机,但运营商骨干网也受到了影响。 结果: 主机房服务完全不可用备用机房冷备状态,切换需要4小…

2026/7/23 15:35:20 阅读更多 →
LLM Wiki:AI自主管理的动态知识库实践

LLM Wiki:AI自主管理的动态知识库实践

1. 项目概述:LLM Wiki与传统知识库的本质差异上周在调试RAG系统时,偶然发现Andrej Karpathy在内部文档中提到的"LLM Wiki"概念。这个用Markdown文件构建的动态知识库,与我们熟知的Confluence、Notion等传统知识管理系统有着本质区别…

2026/7/23 15:35:20 阅读更多 →

最新新闻

基于ggml的跨平台语音转录库transcribe.cpp部署与实战指南

基于ggml的跨平台语音转录库transcribe.cpp部署与实战指南

这次我们来看一个本地语音转录项目 transcribe.cpp,这是一个基于 ggml 的跨平台语音转录库,支持 16 个 ASR 模型族。如果你需要在本地环境部署语音识别服务,特别是关注 CPU 推理、跨平台兼容性和批量任务处理,这个项目值得重点关注…

2026/7/23 15:46:23 阅读更多 →
Optimus项目部署指南:AI自动化框架的核心能力与实战验证

Optimus项目部署指南:AI自动化框架的核心能力与实战验证

这次我们来看一个名为"Optimus"的项目,从标题"Optimus 将改变一切,你尚未察觉"来看,这很可能是一个具有颠覆性潜力的技术项目。虽然具体技术细节在现有材料中还不够明确,但结合"Optimus"这个关键词…

2026/7/23 15:46:23 阅读更多 →
开源大模型Kimi K3部署实践:从环境配置到生产应用

开源大模型Kimi K3部署实践:从环境配置到生产应用

如果你最近在关注大模型领域,可能会注意到一个现象:开源模型正在以惊人的速度追赶闭源模型的性能。就在不久前,月之暗面(Moonshot AI)发布了全新的开源模型 Kimi K3,官方宣称其性能已经接近前沿闭源模型水平…

2026/7/23 15:46:23 阅读更多 →
化学智能体架构设计:核心挑战与7种典型模式

化学智能体架构设计:核心挑战与7种典型模式

1. AI应用架构师的角色定位与核心挑战 化学智能体作为AI在科研领域的前沿应用方向,正在改变传统研究范式。作为AI应用架构师,我们需要在技术可行性与业务需求之间架设桥梁。这个角色不同于算法研究员或软件工程师,更强调系统级的整合能力——…

2026/7/23 15:46:23 阅读更多 →
AI驱动的渗透测试:Strix多智能体系统解析与应用

AI驱动的渗透测试:Strix多智能体系统解析与应用

1. 项目概述:当AI学会黑客思维第一次看到Strix的演示视频时,我正端着咖啡的手突然停在了半空。屏幕上,这个AI系统正在对一个电商网站进行渗透测试:它先是发现了登录页面的SQL注入漏洞,接着通过目录遍历获取了后台管理界…

2026/7/23 15:46:23 阅读更多 →
Cursor怎么用,深度拆解AI原生开发工作流,附12个真实项目模板

Cursor怎么用,深度拆解AI原生开发工作流,附12个真实项目模板

更多请点击: https://intelliparadigm.com 第一章:Cursor怎么用 Cursor 是一款基于 VS Code 内核、深度集成 AI 编程能力的智能开发工具,专为提升代码编写效率与理解深度而设计。它支持自然语言交互式编程、AI 辅助重构、跨文件上下文感知及…

2026/7/23 15:45:23 阅读更多 →

日新闻

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:25 阅读更多 →
AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

更多请点击: https://codechina.net 第一章:AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析 在对2,346篇跨行业AI生成文案的A/B测试数据进行聚类分析后,我们发现&#xff1…

2026/7/23 0:01:26 阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:01:26 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 19:43:43 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 12:54:44 阅读更多 →

月新闻