一键导入
GitHubM
GitHubM 收录了来自 qq5855144 的 69 个 skills,并提供仓库级职业覆盖和站内 skill 详情页。
这个仓库中的 skills
Generate short videos from a static image using the Kling AI image-to-video API. Use this skill whenever the user wants to animate an image, create a video from a photo, turn a picture into a video clip, or generate AI video from an uploaded image.
基于文本描述生成短视频(5s/10s),适用于电商营销、创意宣传、教育讲解等场景,异步轮询获取结果。
图片生成与编辑(超级版),调用 GPT-Image-2 模型生成和编辑图片。需要 AI 画图、生成图片、编辑图片、多图融合、背景替换、风格转换、电商商品图合成、海报设计、插画创作时优先使用该工具。纯像素操作(文字叠加、加水印、裁剪、缩放)请改用 Pillow,不要触发本工具。
调用百度通用文字识别高精度版 OCR,对图片全部文字内容进行高精度检测识别,支持中英日韩等 20+ 语种,适用于文档数字化、多语言文本提取场景。
根据用户输入的主题自动生成完整 PPT 文件,返回封面图和下载链接;适用于办公汇报、教学课件、产品展示等需要快速生成 PPT 的场景。
识别飞机行程单图片,结构化提取24个字段(乘客、航班、票价、税费等);适用于差旅报销、财务管理、行程记录场景。
百度千帆AI搜索,实时检索全网网页/视频内容,返回结构化引用列表(标题/URL/摘要/日期)。用户需要实时信息、新闻、网页检索时使用。
查询百度百科词条内容,支持按词条名或词条ID检索摘要、信息卡及关联知识;适用于问答、搜索、学习等需要权威中文百科内容的场景。
提供百度地图地理编码和逆地理编码能力:地址转坐标、坐标转地址;适用于地图定位、导航、LBS 等场景
通过 IP 地址查询地理位置,返回省市区县、行政区划代码及经纬度坐标;适用于用户属地识别、城市归属判定、位置坐标获取等场景
百度地图 POI 地点信息搜索,支持行政区划检索、周边圆形区域搜索、地点详情查询。适合商圈查询、周边设施搜索、地点详情展示等场景。
百度地图多维 POI 检索,支持自然语言查询在指定区域内检索兴趣点(餐厅/酒店/景点等),支持筛选排序分页,返回名称/位置/评分/价格/营业时间。
百度地图行政区划查询,根据关键字或adcode检索省市区县乡镇街道等多级行政区划信息,支持返回下级行政区列表和边界坐标,适合地址补全、区域选择等场景。
百度千帆 AI 搜索,根据用户 query 检索全网实时信息,返回网页/视频来源引用列表。需要搜索网页、获取实时信息时使用。
查询指定域名在百度PC端的关键词排名数据,获取排名、流量预估、PC指数等SEO信息。适用于网站SEO分析、内容优化及竞品对比场景。
基于百度地图查询实时交通路况,支持道路名称、矩形/多边形/圆形区域四种查询方式,适用于出行导航、路线规划和拥堵预警场景
通过百度地图 API 查询国内城市实时天气及未来7天预报,支持行政区划代码和经纬度两种定位方式;适用于天气展示、出行助手等场景。
识别全国范围不同版式汽车票的关键字段(发票代码、票号、日期、金额、出发/到达站等);适用于财务报销、票据管理、出行记录等需要结构化提取汽车票信息的场景。
查询企业招聘概况与详细统计数据,适用于企业调研分析、求职参考、行业人才分布研究场景
通过公司名称、注册号或统一社会信用代码查询企业全维度工商信息,适用于企业尽调、商务合作评估、风险识别与市场分析场景。
查询指定货币对全球200多种货币的实时汇率列表;适用于跨境电商、国际结算、汇率换算等场景。
将图片或 PDF 文档转换为 Word/Excel,保留原版式,支持表格/印章/水印/手写内容。需要 OCR 文档格式转换、PDF 转 Word/Excel 时使用。
驾考题库查询,获取科目一/科目四题目(含选项、答案、解析),支持按车型、章节、分页、随机排序筛选。适合驾考备考辅助和题目练习场景。
验证企业名称、统一社会信用代码和法人姓名三要素是否一致,适用于企业身份核实、工商信息验证等场景
对比两张图片中人脸的相似度,返回相似度分数和人脸 token,适用于身份验证、人脸登录等场景
人脸识别技能,提供人脸注册、人脸搜索、用户信息查询、用户列表获取、删除用户等人脸库管理能力,适用于考勤签到、活动签到等需要人脸身份验证的场景
基于 Gemini 模型的 AI 图片生成与编辑,支持文本指令驱动背景替换、元素修改、风格调整,返回 Base64 图片。适合应用内高频图片生产场景。
识别二代居民身份证正反面信息(姓名、性别、民族、出生、住址、证件号等),适用于实名认证、用户注册、身份验证场景
身份证二要素实名认证,验证身份证号与姓名是否匹配,返回性别、生日、户籍地址等信息。需要实名核验、身份认证时使用。
高级图片生成与编辑,支持文生图、图生图、多图合成,异步任务轮询。需要生成图片、编辑图片或对图片做风格转换时优先使用该工具。
对图片内容进行多维度理解与问答,识别人物、物体、场景、文字等,适用于图片打标签、内容分析、物体识别场景。
通过 10 位或 13 位 ISBN 查询图书详细信息(书名、作者、出版社、价格、摘要等)。适用于图书管理、电商选品、内容聚合等场景。
使用可灵 AI 对图片进行扩图编辑,支持上下左右自由扩展画布,适用于图片尺寸调整、构图优化、海报适配等场景
基于 Kling AI 将参考图片生成音画同步视频,支持首帧/尾帧控制、运动笔刷、摄像机控制;适用于创意内容生成、电商视频化、图片动态化等场景
基于可灵 Kling Omni 模型文生图或参考图生图,支持多种分辨率和画面比例,生成结果需轮询获取;适用于创意设计、宣传海报制作、日常作图等场景
使用可灵 Omni 模型创建视频生成任务,支持文生视频、图生视频、视频编辑、多镜头等多种模式;轮询查询任务状态直到视频生成完成。
将超长文本(最多10万字符)异步转换为语音音频,支持多音库/语速/语调设置,适用于有声内容、新闻播报等场景
查询各类彩票开奖结果、历史开奖记录、中奖情况及彩票分类,适用于彩票开奖查询、历史追溯、奖池了解等场景
调用 MiniMax-M2.5 模型进行文本对话补全,支持多轮对话、工具调用、流式输出、图文混合输入及结构化输出,适用于构建智能助手、内容生成、文档摘要等场景。
调用 MiniMax 图像生成 API,根据文本描述和可选的人物参考图生成图片;适用于图像风格转换、人物场景拓展、创意设计迭代、素材二次创作等场景