Somnusochi

VLM-AutoYOLO

Somnusochi

AI Auto Annotation & YOLO Training Pipeline, End-to-end object detection auto-labeling and YOLO training platform. VLM-powered annotation with NVIDIA LocateAnything-3B, manual refinement, one-click YOLO training, video keyframe extraction, and model validation. Supports image and video.

AI 简介

VLM-AutoYOLO 是一个端到端的自动标注与YOLO模型训练平台,支持图像和视频数据。它基于视觉语言模型(LocateAnything-3B)实现开放词汇目标检测自动标注,结合SAM2.1/SAM3生成像素级掩码,并提供画布式手动精修、视频关键帧智能抽取(含场景/运动分析与SSIM去重)、多格式数据导出(YOLO/YOLO-Seg/COCO等)及一键式YOLOv8/v11/v26训练与验证。全流程GPU加速,兼容CUDA与macOS MPS。适用于中小规模CV项目中需快速构建高质量检测/分割数据集并迭代训练模型的场景,尤其适合缺乏专业标注团队但需兼顾效率与精度的工业质检、安防监控、农业识别等应用。

Python
GNU Affero General Public License v3.0
161
Stars
19
Forks
58
Watchers
1
Issues

Star 增长

今日0
近 7 天0
近 30 天+24
综合评分46.3
默认分支master