VIAVGG Image Annotator完整指南免费在浏览器里注释图像、音频与视频【免费下载链接】via(MIRROR) see https://gitlab.com/vgg/via/项目地址: https://gitcode.com/gh_mirrors/via/viaVIAVGG Image Annotator是牛津大学视觉几何组VGG开发并维护的轻量图像注释工具如今同样覆盖音频与视频。需要手工标注数据时不必再安装重型软件把文件拖进浏览器就能画选区、切时间轴标完直接导出 JSON 或 XML 给下游流程用。️ 打开、标注、导出一条流水线的标注流程整个使用过程就是三步加载本地文件、在画面或时间轴上做标注、导出结果文件。下面按媒体类型看每一步具体能做什么。图像上直接画矩形、椭圆、多边形与点选区打开一张图后左侧面板提供选区形状拖拽即可画出矩形框和椭圆复杂轮廓如建筑尖顶、不规则物体用多边形工具逐点勾勒点位标注则用于记录单一坐标。每个选区都可以命名并挂属性——经典用法是给每个区域填name/colour这样的属性列形成一张随图保存的标注表。批量看图时用 n/p 键快速翻到上一张/下一张v3 还内置了放大查看功能方便核对细节。音频视频一起标时间轴分段 逐帧选区音频的标注单位是时间在波形/进度条上划出分段给每段写上说话人或活动类别仓库里的音频示例就是给一段塔台-飞行员通话分别圈出两人的语音段。视频则是时间轴与画面两层结合——先按时间段切活动打蛋、倒水这类再对选定帧画空间选区跨帧追踪场景如人脸识别跟踪支持把分散在几十帧里的选区按 track 分组、批量编辑属性。 导出标注结果JSON / XML / COCO 直接进训练管线标完不是终点VIA 的导出路径是为工程侧准备的区域与文件级元数据可导出为 JSON、XML 等格式直接喂给解析脚本或训练流程视频帧级标注可用 scripts/io/ 下的 COCO 导出工具转成 COCO 格式多份项目用merge_via3_projects.py合并协作场景下共享项目采用三路3-way合并算法减少相互覆盖项目 JSON 可回导再编辑2.x 建的项目能直接导入 3.x 继续标零安装上手一个 HTML 文件装下整个注释器完整软件就是单个自包含的 HTML 页面体积不到 400KB复制一份就能用在大多数现代浏览器里作为离线应用运行不联网、不装依赖、不跑服务器不捆绑任何外部库只使用浏览器标准能力BSD-2 许可学术和商业场景都可用仓库自带预载样例的演示页见 via-3.x.y/data/demo/打开就能体验图像、音频、视频各注释器 技术实现纯 HTML CSS JavaScript 拼出的轻量内核JavaScript 承担全部交互与数据逻辑via-3.x.y/src/js/ 按职责拆成小模块如_via_data.js数据中枢、_via_view_annotator.js选区绘制、_via_temporal_segmenter.js时间轴HTML 负责页面结构CSS 放在 via-3.x.y/src/css/ 里按注释器分开维护原型只有 40 行 HTML/CSS/JS完整版本就是在这条主线上扩展出来的via-3.x.y/CodeDoc.md 等文档按版本记录了模块结构模块间依赖关系一目了然 演进与社区如何跟进更新、如何贡献代码版本主线v12017-04做图像标注v22018-06扩展图像能力并加入人脸跟踪场景v3 新增音频/视频标注、字幕编辑、放大查看与 COCO 导出近期发布持续做稳定性与体验加固事件监听器残留、缩放画布残留、协作合并冲突等问题陆续修复同时加入线段/折线选区等新工具与选项社区贡献形态多样issue 里报 bug、给修复建议、提交代码各版本在Contributors.md中单独记录贡献者想动手先git clone https://gitcode.com/gh_mirrors/via/viaPR 发到对应版本分支via-1.x.y / via-2.x.y / via-3.x.y而不是 master并遵循项目现有的 BSD-2 许可【免费下载链接】via(MIRROR) see https://gitlab.com/vgg/via/项目地址: https://gitcode.com/gh_mirrors/via/via创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考