CVAT v2.37.0版本发布:增强标注质量检查与交互式检测功能
项目简介
CVAT(Computer Vision Annotation Tool)是一个开源的计算机视觉标注工具,广泛应用于机器学习数据标注领域。它提供了强大的图像和视频标注功能,支持多种标注类型和格式,是计算机视觉领域研究人员和工程师的重要工具。
新增功能亮点
项目级标注质量检查
本次版本最重要的更新之一是增加了对项目的标注质量检查功能。这意味着用户现在可以在项目级别对整个数据集的标注质量进行全面评估,而不仅仅是针对单个任务。该功能可以帮助团队快速发现标注中的共性问题,提高整体数据质量。
交互式检测请求支持
在CLI工具中,代理现在能够处理交互式检测请求。这一改进使得自动化标注流程更加灵活,用户可以根据实际情况动态调整检测参数,获得更精确的标注结果。
SDK改进
SDK新增了BackgroundRequestException异常类,当后台请求(如导出数据集或创建任务)失败时,将抛出此异常而非原来的ApiException。这一改变使得错误处理更加明确,开发者可以更精准地捕获和处理后台任务相关的异常。
数据格式支持增强
Datumaro格式现在支持椭圆标注类型。这一更新扩展了CVAT的数据兼容性,使得使用椭圆标注的数据集可以更方便地在不同工具间迁移和共享。
用户体验优化
按文件名搜索帧
新增的按文件名搜索帧功能大大提升了大型数据集中的导航效率。用户现在可以直接通过文件名快速定位到特定帧,而不需要手动浏览整个数据集。
快捷键提示改进
修复了当未分配快捷键时工具提示显示空括号的问题,使得界面更加整洁和专业。
性能优化与问题修复
本次版本对质量检查相关的API端点进行了性能优化,特别是GET api/quality/reports/和GET api/quality/conflicts/请求。同时修复了多个关键问题,包括:
- COCO格式导入不再要求非必要字段,提高了格式兼容性
- 修复了工作队列中可能出现的Redis异常
- 解决了轨迹插值中的属性错误问题
向后兼容性说明
需要注意的是,服务器API中的frame_count和frame_share字段已被标记为弃用,取而代之的是新的validation_frames和validation_frame_share字段。开发者应逐步迁移到新字段以确保未来版本的兼容性。
总结
CVAT v2.37.0版本通过增强标注质量检查、改进交互式检测功能以及优化用户体验,进一步巩固了其作为专业级计算机视觉标注工具的地位。这些更新不仅提高了标注效率,也为团队协作和数据质量管理提供了更强大的支持。对于计算机视觉领域的研究人员和工程师来说,升级到最新版本将带来更流畅、更高效的标注体验。
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust099- DDeepSeek-V4-ProDeepSeek-V4-Pro(总参数 1.6 万亿,激活 49B)面向复杂推理和高级编程任务,在代码竞赛、数学推理、Agent 工作流等场景表现优异,性能接近国际前沿闭源模型。Python00
MiMo-V2.5-ProMiMo-V2.5-Pro作为旗舰模型,擅⻓处理复杂Agent任务,单次任务可完成近千次⼯具调⽤与⼗余轮上 下⽂压缩。Python00
GLM-5.1GLM-5.1是智谱迄今最智能的旗舰模型,也是目前全球最强的开源模型。GLM-5.1大大提高了代码能力,在完成长程任务方面提升尤为显著。和此前分钟级交互的模型不同,它能够在一次任务中独立、持续工作超过8小时,期间自主规划、执行、自我进化,最终交付完整的工程级成果。Jinja00
Kimi-K2.6Kimi K2.6 是一款开源的原生多模态智能体模型,在长程编码、编码驱动设计、主动自主执行以及群体任务编排等实用能力方面实现了显著提升。Python00
MiniMax-M2.7MiniMax-M2.7 是我们首个深度参与自身进化过程的模型。M2.7 具备构建复杂智能体应用框架的能力,能够借助智能体团队、复杂技能以及动态工具搜索,完成高度精细的生产力任务。Python00