۱۰ تا از بهترین ابزار های متن باز برای برچسب زنی داده ها در بینایی کامپیوتر

نویسنده:
شرکت پیشرو Ai
تاریخ انتشار:
18 آذر 1403
دیدگاه ها:
Best Open Source Tools for Data Labeling in Computer Vision Image

در قلمرو بینایی کامپیوتر، ابزارهای برچسب‌ گذاری داده‌های منبع باز نقش مهمی در آموزش مدل‌ها ایفا می‌کنند. ما اکنون 13 ابزار منبع باز را...

در قلمرو بینایی کامپیوتر، ابزارهای برچسب‌ گذاری داده‌های منبع باز نقش مهمی در آموزش مدل‌ها ایفا می‌کنند. ما اکنون 13 ابزار منبع باز را برای شما انتخاب کرده ایم که به تیم های هوش مصنوعی اجازه می دهد مجموعه داده های خود را برای مدل های یادگیری ماشین قوی حاشیه نویسی و برچسب گذاری کنند.

Xtreme1

یک پلتفرم منبع باز همه‌جانبه برای داده‌های آموزشی چندوجهی است.

این ابزار حاشیه نویسی داده (data annotation)، مدیریت داده (curation) و مدیریت واژ‌ه شناسی (ontology management) برای مقابله با چالش های یادگیری ماشین در بینایی کامپیوتر و LLM را رفع میکند.

ابزارهای مبتنی بر هوش مصنوعی این پلتفرم، حاشیه نویسی شما را به سطح کارایی بالایی ارتقا می دهند، و پروژه های شما را در / کشف اشیاء 2 بعدی و ۳ بعدی (2D/3D Object Detection) / قطعه بندی معنایی (2D/3D Semantic) / قطعه بندی نمونه (Instance Segmentation) قدرتمند می کند.

Scalabel.ai

یک ابزار نوآورانه حاشیه نویسی وب متن باز است.

از تکنیک‌های حاشیه‌نویسی مختلف (annotation)، از جمله جعبه‌های محدود تصویر دوبعدی (2D image bounding boxes)، قطعه بندی  معنایی (semantic segmentation)، منطقه قابل رانندگی (drivable area)، علامت‌گذاری خط (lane marking)، جعبه‌های محدود سه‌بعدی (3D point cloud bounding boxes)‌ و ردیابی ویدیو (video tracking) پشتیبانی می‌کند.

  • Object Tracking (ردیابی شی)
  •  Project Management (مدیریت پروژه)

RectLabel

یک ابزار حاشیه نویسی تصویر منبع باز است که برای کشف (object detection) و تقسیم بندی اشیاء (object segmentation)‌ و جعبه محدود (bounding box) طراحی شده است.

از ابزارهای حاشیه نویسی مختلفی از جمله جعبه محدود (bounding box)، چند ضلعی (polygon)، منحنی بیزیر (cubic-bezier)، خط (line) و نقطه (point) پشتیبانی می کند.

MakeSense.AI

یک ابزار وب آنلاین رایگان و متن باز برای حاشیه نویسی عکس است.

از مدل منبع باز (COCO SSD) کشف اشیا و تخمین موقعیت (POSE-NET) برای حاشیه نویسی استفاده می کند.

✅ Object Detection Model: COCO SSD

✅ Pose Estimation: POSE-NET

✅ Quick Operations

VGG Image Annotator (VIA)

یک ابزار متن باز و رایگان برای حاشیه نویسی تصویر است که می تواند به صورت آفلاین نیز استفاده شود. چندین ابزار حاشیه نویسی را ارائه می دهد و از حاشیه نویسی ویدیویی پشتیبانی می کند.

ابزارهای این پلتفرم مبتنی بر هوش مصنوعی  است و برای کارهای تیمی مناسب است.

  •  Suitable for Team Cooperation (مناسب برای کارهای تیمی)
  •  Video Annotation (برچسب گذاری ویدیو ها)
  • AI-Fueled Tools (بر پایه ی هوش مصنوعی)

VoTT (Visual Object Tagging Tool)

این ابزار برچسب گذاری اشیاء بصری یک ابزار حاشیه نویسی و برچسب گذاری تصویر رایگان و متن باز است که توسط مایکروسافت توسعه یافته است (دیگر فعالانه نگهداری نمی شود!).

پشتیبانی سرتاسری برای تولید مجموعه داده‌ها و اعتبارسنجی مدل‌های کشف اشیا از دارایی‌های ویدئویی و تصویری را فراهم می‌کند.

  •  (ویژگی یادگیری فعال)  Active Learning Feature
  • Export Formats: Azure Custom Vision Service ,CSV ,CNTK, Pascal VOC, Tensorflow Records ,VoTT Json (پشتیبانی از فرمت های مختلف voc, xml, pascal, …)  

Tictag.io

توسعه داده شده است تا حاشیه نویسی داده های منبع باز را آسان و سرگرم کننده کند. این پلتفرم به صورت بازی در امده است و به شما امکان می دهد از طریق حاشیه نویسی پاداش کسب کنید. از نسخه موبایل برای حاشیه نویسی در حال حرکت پشتیبانی می کند.

  •  (مانند بازی است) Works Like a Game
  •  (از نسخه موبایل پشتیبانی میکند) Supports Mobile Version
  •  (داده های دقیق را برای یادگیری ماشین جمع آوری می کند) Collects Accurate Data for ML

LabelMe

یک ابزار حاشیه نویسی تصویری کلاسیک، رایگان و متن باز است که با استفاده از Qt توسعه یافته است.

از ابزارهای حاشیه نویسی چند ضلعی، مستطیل، دایره، خط و نقطه پشتیبانی می کند.

  •  (ابزار حاشیه نویسی چندگانه) Multiple Annotation Tools
  •  (تغییر نقاط  کنترلی) Control Points Modification   

Imglab

یک ابزار مبتنی بر وب متن باز برای برچسب گذاری تصاویر برای اشیا است. می توان از آن برای آموزش کشف اشیا استفاده کرد. این مجموعه داده های مختلف را پشتیبانی می کند و با پشتیبانی افزونه ارائه می شود.

  • (از دیتا ست های مختلف پشتیبانی میکند) Supports Various Datasets
  • (نیازی به نصب نیست) No Installation Required
  • (حریم خصوصی و امنیتی) Privacy and Security Assured

CVAT (Computer Vision Annotation Tool)

یک ابزار حاشیه نویسی تصویر و ویدئو مبتنی بر وب رایگان و متن باز است که توسط اینتل توسعه یافته است. از کشف شی (object detection)، طبقه بندی تصویر (image classification) و تقسیم بندی تصویر (image segmentation) پشتیبانی می کند.

  • (برچسب گذاری نیمه خودکار) Semi-Automatic Annotation
  • (درون یابی اشیاع) Interpolation of Shapes

LabelImg

یک ابزار حاشیه نویسی تصویر متن باز گرافیکی است که جعبه های محدود اشیاء را در تصاویر برچسب گذاری می کند. نصب آن بسیار آسان است و برای مبتدیان مناسب است.

  • (پشتیبانی از فرمت xml) Annotations Format: XML (PASCAL VOC)
  • (ابزاری  راحت و سریع) Simple and Quick

مشتاقانه منتظر دریافت نظرات شما دوستان عزیز هستیم





مطالب مرتبط

ai-model-quantization

کوانتیزاسیون (Quantization)

تأثیر نور بر کیفیت تصویر دیجیتال انواع نویز در تصاویر دیجیتال روش‌های کاهش نویز تصویر ساختار دوربین و حسگر تصویر تنظیم روشنایی و کنتراست تصویر تفاوت Global Shutter و Rolling Shutter دوربین صنعتی برای بینایی ماشین اتصال دوربین صنعتی به NVIDIA Jetson پردازش تصویر با بردهای Jetson بهترین دوربین برای پروژه‌های بینایی ماشین

تصویر در دنیای واقعی: نور، نویز و دوربین

TensorRT (تنسور آر تی)، NVIDIA GPU Optimization، AI Inference (استنتاج هوش مصنوعی)، ONNX to TensorRT، Deep Learning Deployment (استقرار یادگیری عمیق)، NVIDIA MIG، Model Quantization (کوانتیزیشن مدل)، NVIDIA Triton Inference Server، AI Model Acceleration (شتاب‌دهی مدل هوش مصنوعی)، Computer Vision Deployment

TensorRT

Jetson Nano کیت توسعه NVIDIA هوش مصنوعی امبدد راه‌اندازی Jetson Nano فلش کردن کارت microSD NVIDIA Jetson Developer Kit بوت اولیه Jetson Nano تنظیمات Headless Jetson Nano منبع تغذیه Jetson Nano آموزش نصب Jetson Nano

راه اندازی اولیه جتسون

NVIDIA Jetson (به عنوان هسته سخت‌افزاری) Edge AI (به دلیل ماهیت هوش مصنوعی روی لبه) برنامه‌نویسی پایتون (به عنوان هسته نرم‌افزاری) بینایی ماشین (Machine Vision) پردازش تصویر در پایتون هوش مصنوعی در رباتیک TensorRT (مهم‌ترین ابزار برای بهینه‌سازی روی جتسون) توسعه سیستم‌های هوشمند JetPack SDK (اکوسیستم نرم‌افزاری جتسون) پردازش بلادرنگ (Real-time Processing)

مبانی پایتون و نقش آن در توسعه بر روی NVIDIA Jetson

دیپ‌استریم (NVIDIA DeepStream) تحلیل ویدئویی هوشمند (Video Analytics) بینایی ماشین در جتسون پردازش ویدئو بلادرنگ (Real-Time Video Processing) GStreamer در DeepStream TensorRT رهگیری اشیا (Object Tracking) استنتاج هوش مصنوعی (AI Inference) Edge AI NVIDIA Jetson DeepStream

دیپ‌استریم(DeepStream)