在 Manus 中运行任何 Skill
一键导入
一键导入
一键在 Manus 中运行任何 Skill
开始使用multimodal-looker
星标0
分支0
更新时间2026年4月5日 07:38
Multimodal-Looker - 多模态内容分析和理解工具,支持图像、视频和音频。
安装
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
SKILL.md
readonly菜单
Multimodal-Looker - 多模态内容分析和理解工具,支持图像、视频和音频。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
Atlas - 知识导航 Agent,帮助浏览和组织大型知识库。
Autoresearch - 自主研究 Agent,自动搜集、分析和综合信息。
Awesome AI Agent - 最全面的 AI Agent 资源列表,包含 1500+ 工具和框架。
Claude Subconscious - Letta 的 Claude 子意识模块,用于 AI Agent 的长期记忆和人格管理。
DeerFlow 2.0 - 字节跳动开源的长时程 AI Agent 框架,支持研究、编码和创作任务。
Hephaestus - 半结构化 Agentic 框架,工作流根据实际发现的任务自动构建。
| name | multimodal-looker |
| description | Multimodal-Looker - 多模态内容分析和理解工具,支持图像、视频和音频。 |
| license | MIT |
| tags | ["multimodal","vision","audio","video","analysis"] |
Multimodal-Looker 是一个多模态内容分析和理解工具,能够处理和理解图像、视频和音频内容。
from multimodal_looker import MultiModalClient
client = MultiModalClient(api_key="your-api-key")
# 分析图像
result = client.analyze_image(
image_url="https://example.com/image.jpg",
tasks=["describe", "extract_text", "detect_objects"]
)
# 分析视频
video_result = client.analyze_video(
video_path="video.mp4",
tasks=["summarize", "detect_scenes", "transcribe"]
)