Skip to main content

vision

Analyze images using a Vision-Language Model through the wu CLI. Use when the user wants to describe an image, caption a picture, ask questions about visual content, inspect renders or screenshots, compare visual evidence, or produce text or JSON answers with public VLM backends.

Zur Installation springen

Quellinformationen

Repository
NVIDIA-Omniverse/usd-content-agents
Letzte Quellaktivität
30. Juli 2026 um 21:34
Erkannte Sprache von SKILL.md
Englisch
Sterne
188
Forks
23

Installationsoptionen

Standardmäßig ist der Prompt ausgewählt, der zuerst die Quelle prüft. Sie können zu einem direkten Befehl wechseln oder eine lokale Kopie herunterladen.

Quelldateien prüfen

Lesen Sie SKILL.md und alle von SkillsMP angezeigten Begleitdateien, bevor Sie sich für eine Installation entscheiden.