Skip to main content

vision

Analyze images using a Vision-Language Model through the wu CLI. Use when the user wants to describe an image, caption a picture, ask questions about visual content, inspect renders or screenshots, compare visual evidence, or produce text or JSON answers with public VLM backends.

الانتقال إلى التثبيت

معلومات المصدر

المستودع
NVIDIA-Omniverse/usd-content-agents
آخر نشاط في المصدر
٣٠ يوليو ٢٠٢٦ في ٢١:٣٤
لغة SKILL.md المكتشفة
الإنجليزية
النجوم
١٨٨
التفرعات
٢٣

خيارات التثبيت

يُحدَّد Prompt الذي يراجع المصدر أولًا بشكل افتراضي. يمكنك التبديل إلى أمر مباشر أو تنزيل نسخة محلية.

مراجعة ملفات المصدر

اقرأ SKILL.md وأي ملفات مرافقة يعرضها SkillsMP قبل أن تقرر التثبيت.