en un clic
GitHubM
GitHubM contient 69 skills collectées depuis qq5855144, avec une couverture métier par dépôt et des pages de détail sur le site.
Skills dans ce dépôt
Generate short videos from a static image using the Kling AI image-to-video API. Use this skill whenever the user wants to animate an image, create a video from a photo, turn a picture into a video clip, or generate AI video from an uploaded image.
基于文本描述生成短视频(5s/10s),适用于电商营销、创意宣传、教育讲解等场景,异步轮询获取结果。
图片生成与编辑(超级版),调用 GPT-Image-2 模型生成和编辑图片。需要 AI 画图、生成图片、编辑图片、多图融合、背景替换、风格转换、电商商品图合成、海报设计、插画创作时优先使用该工具。纯像素操作(文字叠加、加水印、裁剪、缩放)请改用 Pillow,不要触发本工具。
调用百度通用文字识别高精度版 OCR,对图片全部文字内容进行高精度检测识别,支持中英日韩等 20+ 语种,适用于文档数字化、多语言文本提取场景。
根据用户输入的主题自动生成完整 PPT 文件,返回封面图和下载链接;适用于办公汇报、教学课件、产品展示等需要快速生成 PPT 的场景。
识别飞机行程单图片,结构化提取24个字段(乘客、航班、票价、税费等);适用于差旅报销、财务管理、行程记录场景。
百度千帆AI搜索,实时检索全网网页/视频内容,返回结构化引用列表(标题/URL/摘要/日期)。用户需要实时信息、新闻、网页检索时使用。
查询百度百科词条内容,支持按词条名或词条ID检索摘要、信息卡及关联知识;适用于问答、搜索、学习等需要权威中文百科内容的场景。
提供百度地图地理编码和逆地理编码能力:地址转坐标、坐标转地址;适用于地图定位、导航、LBS 等场景
通过 IP 地址查询地理位置,返回省市区县、行政区划代码及经纬度坐标;适用于用户属地识别、城市归属判定、位置坐标获取等场景
百度地图 POI 地点信息搜索,支持行政区划检索、周边圆形区域搜索、地点详情查询。适合商圈查询、周边设施搜索、地点详情展示等场景。
百度地图多维 POI 检索,支持自然语言查询在指定区域内检索兴趣点(餐厅/酒店/景点等),支持筛选排序分页,返回名称/位置/评分/价格/营业时间。
百度地图行政区划查询,根据关键字或adcode检索省市区县乡镇街道等多级行政区划信息,支持返回下级行政区列表和边界坐标,适合地址补全、区域选择等场景。
百度千帆 AI 搜索,根据用户 query 检索全网实时信息,返回网页/视频来源引用列表。需要搜索网页、获取实时信息时使用。
查询指定域名在百度PC端的关键词排名数据,获取排名、流量预估、PC指数等SEO信息。适用于网站SEO分析、内容优化及竞品对比场景。
基于百度地图查询实时交通路况,支持道路名称、矩形/多边形/圆形区域四种查询方式,适用于出行导航、路线规划和拥堵预警场景
通过百度地图 API 查询国内城市实时天气及未来7天预报,支持行政区划代码和经纬度两种定位方式;适用于天气展示、出行助手等场景。
识别全国范围不同版式汽车票的关键字段(发票代码、票号、日期、金额、出发/到达站等);适用于财务报销、票据管理、出行记录等需要结构化提取汽车票信息的场景。
查询企业招聘概况与详细统计数据,适用于企业调研分析、求职参考、行业人才分布研究场景
通过公司名称、注册号或统一社会信用代码查询企业全维度工商信息,适用于企业尽调、商务合作评估、风险识别与市场分析场景。
查询指定货币对全球200多种货币的实时汇率列表;适用于跨境电商、国际结算、汇率换算等场景。
将图片或 PDF 文档转换为 Word/Excel,保留原版式,支持表格/印章/水印/手写内容。需要 OCR 文档格式转换、PDF 转 Word/Excel 时使用。
驾考题库查询,获取科目一/科目四题目(含选项、答案、解析),支持按车型、章节、分页、随机排序筛选。适合驾考备考辅助和题目练习场景。
验证企业名称、统一社会信用代码和法人姓名三要素是否一致,适用于企业身份核实、工商信息验证等场景
对比两张图片中人脸的相似度,返回相似度分数和人脸 token,适用于身份验证、人脸登录等场景
人脸识别技能,提供人脸注册、人脸搜索、用户信息查询、用户列表获取、删除用户等人脸库管理能力,适用于考勤签到、活动签到等需要人脸身份验证的场景
基于 Gemini 模型的 AI 图片生成与编辑,支持文本指令驱动背景替换、元素修改、风格调整,返回 Base64 图片。适合应用内高频图片生产场景。
识别二代居民身份证正反面信息(姓名、性别、民族、出生、住址、证件号等),适用于实名认证、用户注册、身份验证场景
身份证二要素实名认证,验证身份证号与姓名是否匹配,返回性别、生日、户籍地址等信息。需要实名核验、身份认证时使用。
高级图片生成与编辑,支持文生图、图生图、多图合成,异步任务轮询。需要生成图片、编辑图片或对图片做风格转换时优先使用该工具。
对图片内容进行多维度理解与问答,识别人物、物体、场景、文字等,适用于图片打标签、内容分析、物体识别场景。
通过 10 位或 13 位 ISBN 查询图书详细信息(书名、作者、出版社、价格、摘要等)。适用于图书管理、电商选品、内容聚合等场景。
使用可灵 AI 对图片进行扩图编辑,支持上下左右自由扩展画布,适用于图片尺寸调整、构图优化、海报适配等场景
基于 Kling AI 将参考图片生成音画同步视频,支持首帧/尾帧控制、运动笔刷、摄像机控制;适用于创意内容生成、电商视频化、图片动态化等场景
基于可灵 Kling Omni 模型文生图或参考图生图,支持多种分辨率和画面比例,生成结果需轮询获取;适用于创意设计、宣传海报制作、日常作图等场景
使用可灵 Omni 模型创建视频生成任务,支持文生视频、图生视频、视频编辑、多镜头等多种模式;轮询查询任务状态直到视频生成完成。
将超长文本(最多10万字符)异步转换为语音音频,支持多音库/语速/语调设置,适用于有声内容、新闻播报等场景
查询各类彩票开奖结果、历史开奖记录、中奖情况及彩票分类,适用于彩票开奖查询、历史追溯、奖池了解等场景
调用 MiniMax-M2.5 模型进行文本对话补全,支持多轮对话、工具调用、流式输出、图文混合输入及结构化输出,适用于构建智能助手、内容生成、文档摘要等场景。
调用 MiniMax 图像生成 API,根据文本描述和可选的人物参考图生成图片;适用于图像风格转换、人物场景拓展、创意设计迭代、素材二次创作等场景