VIA 图像标注工具实战:从打开浏览器到导出标注的完整指南
VIA 图像标注工具实战从打开浏览器到导出标注的完整指南【免费下载链接】via(MIRROR) see https://gitlab.com/vgg/via/项目地址: https://gitcode.com/gh_mirrors/via/viaVIAVGG Image Annotator是牛津大学视觉几何组VGG出品的浏览器端手动图像标注工具支持对图片、音频、视频做区域标注和属性标注。整套软件打包成一个小于 400 KB 的独立 HTML 页面无需安装任何服务端环境适合刚开始接触数据标注的研究者和开发者。项目定位与核心能力VIA 要解决的问题很具体在准备训练数据时需要把图里有什么、在哪里、是什么颜色/类别这类信息人工整理成结构化数据。它把这件事压缩到浏览器里完成不依赖外部库也不依赖网络。仓库按三个大版本组织能力各有侧重图像区域标注矩形、圆形、椭圆、多边形、点五种形状配合区域属性如name、colour和文件属性记录标注结果项目与元数据管理所有标注存为一个项目可整体导出、再导入另一台机器时序标注v3 版支持在音频/视频上划时间片段并在视频帧上同时做空间区域标注见 src/js/_via_temporal_segmenter.js批量导入导出支持 CSV、JSON、COCO 格式也支持把整个项目打包成一个文件零依赖离线运行纯 HTML/CSS/Javascript 实现单文件即可离线打开环境准备与启动参考文章里pip 装依赖、跑 Python 服务的流程其实用不上——VIA 不需要 Python也不需要 Flask打开 HTML 文件就是启动它。完整流程只有三步克隆仓库到本地git clone https://gitcode.com/gh_mirrors/via/via进入目录。只标图片的话用 v1 版单文件入口via-1.x.y/index.html要标视频、音频则用via-3.x.y/src/html/下对应的_via_video_annotator.html或_via_audio_annotator.html。浏览器直接打开该 HTML 文件双击或拖进去均可。如果想让示例数据走相对路径加载可以起一个静态文件服务器cd via python3 -m http.server 8080然后在浏览器访问http://localhost:8080/via-1.x.y/index.html。界面左上角是菜单栏Home / Image / Annotation / Attributes / Settings / Help右侧是图片画布标注操作都在这两个区域完成。标注工作流实操以仓库自带的天鹅图为例走一遍完整的标注流程导入图片在 Image 菜单里选择本地图片。仓库自带示例可对照练习via-2.x.y/data/basic/下的天鹅图、via-2.x.y/data/face/下的人物图。设置属性在 Attributes 菜单里给区域加属性。截图里演示了两个属性name标注对象名和colour颜色每张图的每个区域都要填。这一步决定了导出的 CSV 有哪些列建议标注前一次性定好。绘制区域在左侧工具区选中形状矩形 / 圆形 / 椭圆 / 多边形 / 点在图片上拖拽绘制。图中 Big Ben 用了多边形、公交车用矩形、船用了椭圆同一张图可以自由混用形状。修正与补充点击已画好的区域可以移动、改大小、删除属性填错直接在表格里改即可。导出在 Annotation 菜单选择导出格式结果会以下载文件的形式保存到你电脑上。做视频标注时界面会多出一条时间轴区域上方是视频画面下方是 timeline 和元数据面板可以一边划时间片段一边在某一帧上画框。数据导出与团队协作导出时有三种常见选择CSV一行一个区域列包含文件名、形状、坐标和所有属性Excel 直接打开就能看适合人工核对JSON保留完整元数据是程序化处理的默认格式COCO 格式仓库自 2.0.8 版起支持导出后可以直接喂给主流检测训练框架项目文件把整个项目图片清单 全部标注 属性定义打包成一个文件是团队流转标注成果最稳妥的方式多人协作的典型链路是A 导出项目文件发给 BB 在本地 VIA 里导入后接着标两边各自做完后再用 scripts/io/merge_via2_projects.py 把两个项目文件合并成一份。注意 COCO 导出对属性类型有限制只支持单选类属性如果项目里放了自定义文本属性导出时留意界面上的提示。典型应用场景医学影像MRI 狭窄程度标注器见 projects/mri_stenosis_annotator/视频目标跟踪在连续帧上给同一目标如人脸画跟踪框并打 track 属性语音活动标注在音频上切分说话人片段配合音频标注器使用影视片段切分subtitle_annotator 示例展示了按镜头分组、给片段打属性的完整做法见 projects/subtitle_annotator/上手建议先小批量试跑拿仓库里via-2.x.y/data/face/的几张示例图把建属性 → 画框 → 导出完整走一遍确认格式符合下游需求再上全量图片。标注前锁定属性表属性列决定了 CSV 结构中途加列会导致前后导出的文件列不一致返工成本高。导出后人工抽检随机打开 CSV 对照原图核对坐标和属性值确认没问题再交付训练流程。结语熟悉基本流程后可以进一步看看仓库里的 demo 页面和 v3 音视频标注器把标注范围从单张图片扩展到整个视频片段。【免费下载链接】via(MIRROR) see https://gitlab.com/vgg/via/项目地址: https://gitcode.com/gh_mirrors/via/via创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

Cellpose-SAM 细胞分割工具上手指南:从第一次分割到训练专属模型

Cellpose-SAM 细胞分割工具上手指南:从第一次分割到训练专属模型

Cellpose-SAM 细胞分割工具上手指南:从第一次分割到训练专属模型 【免费下载链接】cellpose a generalist algorithm for cellular segmentation with human-in-the-loop capabilities 项目地址: https://gitcode.com/gh_mirrors/ce/cellpose Cellpose-SAM 是…

2026/8/21 21:39:11 阅读更多 →
MCP协议与AI Agent:零基础入门JS逆向工程的新范式

MCP协议与AI Agent:零基础入门JS逆向工程的新范式

你是不是觉得“逆向工程”这个词听起来就头大?尤其是看到那些动辄几千行的混淆JS代码,或者复杂的加密算法,感觉没个几年JavaScript功底根本无从下手?如果你还停留在“逆向硬啃JS”的认知里,那可能已经落后了。 最近&a…

2026/8/21 21:38:11 阅读更多 →
NVIDIA显卡驱动安全回退指南:彻底卸载与纯净安装

NVIDIA显卡驱动安全回退指南:彻底卸载与纯净安装

在实际使用英伟达显卡进行开发、游戏或专业图形处理时,驱动版本的选择并非总是“越新越好”。新驱动可能带来性能优化,也可能引入新的兼容性问题、稳定性Bug,甚至导致特定软件或游戏无法正常运行。当遇到黑屏、闪退、性能下降或特定功能失效时…

2026/8/23 7:44:47 阅读更多 →

最新新闻

基于DeepSeek Harness构建Obsidian智能助手:私有知识库的AI Agent实践

基于DeepSeek Harness构建Obsidian智能助手:私有知识库的AI Agent实践

1. 这篇文章真正要解决的问题如果你是一个重度使用 Obsidian 的知识工作者或开发者,你是否曾有过这样的体验:面对一个凌乱的笔记库,想快速找到某个概念的定义,却需要手动翻阅多个笔记;或者,你想基于已有的笔…

2026/8/24 12:21:13 阅读更多 →
中小团队后端技术栈搭配方案:稳定、高效、可维护

中小团队后端技术栈搭配方案:稳定、高效、可维护

“这个项目用Go重写吧,性能好。”——说这话的人不用维护旧系统。“用Spring Cloud吧,业界标准。”——说这话的人不用负责月底对账。“上K8s吧,以后扩展方便。”——说这话的人忘了你们团队只有六个后端。 中小团队的技术栈选择&#xff0c…

2026/8/24 12:21:13 阅读更多 →
SenseNova U1.5 Lite:轻量级多模态模型从入门到部署实战

SenseNova U1.5 Lite:轻量级多模态模型从入门到部署实战

最近在尝试将多模态能力集成到移动端或资源受限的边缘设备时,常常遇到模型体积庞大、推理速度慢、部署成本高的难题。商汤科技最新开源的 SenseNova U1.5 Lite 模型,恰好为这个痛点提供了一个高效的解决方案。本文将带你从零开始,全面解析这个…

2026/8/24 12:21:13 阅读更多 →
大语言模型上下文压缩技术:原理、应用场景与工程实践指南

大语言模型上下文压缩技术:原理、应用场景与工程实践指南

上周,我花了一下午时间,试图复现一个关于“上下文压缩”的“神奇”效果。起因是看到一些讨论,说最新的模型在处理超长文本时,通过某种压缩技术,能在保持性能的同时,大幅降低计算成本。听起来像是解决“上下…

2026/8/24 12:21:13 阅读更多 →
体制内文档自动化:基于本地部署的模板化生成与LLM润色实践

体制内文档自动化:基于本地部署的模板化生成与LLM润色实践

这次我们来看一个体制内工作者为了应对日常材料撰写需求而开发的自动化系统。这个项目的核心不是追求前沿的AI模型,而是聚焦于解决一个非常具体的痛点:如何利用现有的、可本地部署的技术栈,将繁琐、重复的文字材料工作自动化,从而…

2026/8/24 12:21:13 阅读更多 →
DeepSeek Harness:在Obsidian中构建个人AI助手的完整指南

DeepSeek Harness:在Obsidian中构建个人AI助手的完整指南

这次我们来看一个能让你在 Obsidian 里直接调用 DeepSeek 大模型,打造个人专属 AI 助手的项目。它不是简单的聊天插件,而是一个名为 DeepSeek Harness 的框架,核心目标是让你能基于自己的知识库和工作流,构建出功能强大、听话好…

2026/8/24 12:20:13 阅读更多 →

日新闻

前端内容安全与依赖审计实践

前端内容安全与依赖审计实践

前端内容安全与依赖审计实践 前端安全依赖分层防护。没有任何单一配置能替代输出编码、权限校验和依赖更新。 把不可信内容当作数据 默认使用框架的转义能力;确需渲染 HTML 时,先在服务端或可信的客户端库中进行白名单过滤。避免把用户输入直接赋给 inne…

2026/8/24 1:08:15 阅读更多 →
Windows登录密码存储机制全解析:从哈希算法到安全加固实战

Windows登录密码存储机制全解析:从哈希算法到安全加固实战

1. 项目概述:Windows登录密码的“黑匣子”每次你按下CtrlAltDel,输入密码,然后看到那个熟悉的桌面,这背后发生了一系列复杂而精密的操作。作为一名长期与Windows系统打交道的从业者,我经常被问到:“我的密码…

2026/8/24 1:08:15 阅读更多 →
AI面试系统安全挑战与解决方案

AI面试系统安全挑战与解决方案

1. 项目概述:AI面试系统的安全挑战去年参与某跨国企业AI面试系统部署时,遇到一个典型案例:候选人在视频面试中无意提到竞争对手产品名称,系统竟自动将该信息关联到企业知识库并生成竞品分析报告。这个看似"智能"的功能&…

2026/8/24 1:08:15 阅读更多 →

周新闻

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/24 0:06:02 阅读更多 →
SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/24 0:20:20 阅读更多 →
Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/24 0:14:11 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/23 18:47:06 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/23 12:10:44 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/24 11:20:22 阅读更多 →