Skip to main content

Skills en este repositorio

calesthio/generative-media-skills - Página 2

SkillsMP ha recopilado 153 skills de calesthio/generative-media-skills. Abre una skill para revisar su origen y sus detalles.

calesthio/generative-media-skills

Mostrando 40 de 153 skills recopiladas.

ocupación
Técnicos de audio y video
descripción

Produce audio-first podcast episodes with generative tools — design the show and episode format (interview, narrative, news brief, two-host conversational), write scripts for the ear, decide between fully-synthetic and hybrid (recorded human + synthetic)…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Produce 3D assets with Meshy (meshy.ai) through its REST API and web platform — text-to-3D, image-to-3D, multi-image-to-3D, AI texturing/PBR, remesh/topology control, UV, and auto-rigging/animation. Use this skill when an agent must generate a mesh from a…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Generate 3D assets with Tencent's Hunyuan3D family — open-weight self-hosted models (Hunyuan3D-2.0/2.1 and HunyuanWorld / HY-World for scenes) and the hosted, closed API tiers (2.5, PolyGen, 3.0/3.1 via Tencent Cloud and third-party hosts). Use when a task…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Produce 3D assets with Tripo (tripo3d.ai / Tripo AI by VAST) through its OpenAPI and Studio platform — text-to-3D, image-to-3D, and multiview-to-3D generation; PBR texturing; auto-rigging and preset animation; retopology/low-poly and quad remesh; format…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Generate AI lip sync and visual dubbing with Sync Labs (sync.so) — choose the right model (sync-3, lipsync-2, lipsync-2-pro, lipsync-1.9.0-beta, react-1), build the POST /v2/generate request, host inputs, handle async jobs via polling or webhooks, run batch…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Generate music with Suno (v5 / v5.5 era, 2026) and advise a production team on what they may legally do with the output. Use this skill when a user wants to create, extend, remaster, or stem-separate a track in Suno; craft Suno prompts (style field,…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Operate AudioShake's cloud source-separation service (developer.audioshake.ai) to split a recording into stems. Use when a task involves isolating vocals, drums, bass, guitar, piano, keys, strings, or winds from music; separating dialogue / music / effects…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Produce speech and clone voices with Fish Audio — its hosted TTS API (S2.1-Pro / S2-Pro / S1 model lineup, REST + WebSocket streaming, instant and persistent voice cloning) and its open-weight OpenAudio S1-mini / Fish-Speech models for self-hosting. Use this…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Local and self-hosted text-to-speech with Kokoro, the ~82M-parameter open-weight (Apache 2.0) model by hexgrad. Use when synthesizing speech offline, on-device, in the browser, or on your own server without per-character API cost — for high-volume narration,…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Use when enhancing, upscaling, restoring, denoising, sharpening, deinterlacing, stabilizing, motion-deblurring, colorizing, SDR-to-HDR converting, or frame-rate/slow-motion converting video (and secondarily images) with Topaz Labs — whether cleaning up…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Produce video (and its supporting stills) through Higgsfield (higgsfield.ai), a multi-model creative platform that fronts third-party video models (Kling, Veo, Seedance, Wan, MiniMax, and, until retirement, Sora) plus Higgsfield's own control layer — Soul /…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Produce video with Moonvalley's Marey model family (Marey Realism v1.5) — a filmmaker-oriented, 1080p/24fps generative video model marketed as trained exclusively on licensed data. Use this skill when a task asks for Marey or Moonvalley specifically, when a…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Produce short-form video with Pika (pika.art) — its effect-driven tools (Pikaffects, Pikadditions, Pikaswaps, Pikaframes, Pikascenes, Pikatwists) and audio-driven lip sync (Pikaformance), plus text-to-video and image-to-video. Use when a task calls for…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Select, integrate, and operate multi-model video-generation gateways — hosted inference aggregators such as fal.ai, Replicate, and WaveSpeed that expose many third-party video (and video-adjacent audio) models behind one account, one API surface, and one…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Use when an agent must make TwelveLabs do real video-understanding work: indexing footage, semantic/visual search across an archive, generating descriptions, summaries, chapters, highlights, and tags from video, producing multimodal embeddings, or wiring…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Build, configure, and ship production voice agents on the ElevenLabs Agents platform (branded "ElevenAgents," formerly "Conversational AI"). Use when an agent must design a spoken-conversation system prompt, pick an LLM and TTS voice/model for a real-time…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Plan and scope production work with Odyssey's real-time interactive video world models (odyssey.ml — Odyssey-1/Odyssey-2/Starchild-1/Agora-1). Use when a request involves generating video that a user steers live with keyboard, text, speech, or controller…

Idioma del texto original: inglés

actualizado
ocupación
Desarrolladores de software
descripción

Generate persistent, explorable 3D worlds/environments with Marble by World Labs — from text, a single image, multiple images, video, or a 360 panorama, plus coarse-structure blocking with Chisel. Use this skill when a task needs a navigable 3D scene,…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Provider-independent dialogue editing and ADR direction for AI agents producing generated videos, films, ads, avatar clips, explainers, localization/dubbing, podcasts, recuts, and social content. Use for dialogue prep, repair, room tone, take comping, sync,…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Provider-independent localization and dubbing production direction for AI agents producing translated videos, dubbed ads, social clips, explainers, avatar videos, documentaries, training media, and multi-market campaigns. Use when planning or reviewing…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Provider-independent music supervision and scoring direction for AI agents producing generated videos, ads, trailers, explainers, product films, social clips, documentaries, game trailers, and branded content. Use when planning, prompting, selecting,…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Provider-independent sound design and Foley direction for generated media. Use when an agent must plan, prompt, source, generate, edit, mix, hand off, repair, or QA sound effects, Foley, ambience, impacts, transitions, UI/product audio, emotional sound…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Use for video-conditioned audio and automated Foley production: adding synchronized sound effects, ambience, impacts, footsteps, cloth, prop, and environmental audio to silent or under-sounded video using video-to-audio models, text-to-sound tools, manual…

Idioma del texto original: inglés

actualizado
ocupación
Editores de cine y video
descripción

Provider-independent production workflow for AI avatar spokesperson videos, including presenter briefs, consent and likeness rights, disclosure and platform labeling, casting, localization, performance direction, brand fit, claims review, lip-sync/audio QA,…

Idioma del texto original: inglés

actualizado
ocupación
Editores de cine y video
descripción

Provider-independent production workflow for AI agents creating brand launch films, product reveal videos, manifesto films, campaign hero films, website hero videos, investor/customer launch assets, and social cutdowns. Use when planning, scripting,…

Idioma del texto original: inglés

actualizado
ocupación
Editores de cine y video
descripción

Provider-independent cinematic trailer production for AI agents creating movie-style trailers, teaser trailers, launch trailers, game trailers, documentary trailers, series promos, and high-impact generated-media previews. Use for trailer strategy, structure,…

Idioma del texto original: inglés

actualizado
ocupación
Editores de cine y video
descripción

Provider-independent workflow for AI agents producing documentary-style montages, archive-driven timelines, interview-supported sequences, nonprofit or advocacy shorts, historical explainers, and hybrid generated/archive edits. Use for editorial thesis…

Idioma del texto original: inglés

actualizado
ocupación
Diseñadores gráficos
descripción

Provider-independent ecommerce product imagery production for marketplace listings, product pages, hero shots, lifestyle scenes, comparison charts, infographics, variant/packaging images, virtual try-on or placement mockups, ads, and AI-assisted product…

Idioma del texto original: inglés

actualizado
ocupación
Artistas de efectos especiales y animadores
descripción

Provider-independent production workflow for AI agents creating educational animated lessons, classroom explainers, STEM visualizations, history/social-science animations, training modules, microlearning clips, whiteboard-style explainers, diagram-driven…

Idioma del texto original: inglés

actualizado
ocupación
Editores de cine y video
descripción

Provider-independent explainer video production for AI agents creating educational, product, concept, nonprofit/public-service, onboarding, training, animated, mixed-media, and short social explainers. Use when an agent must turn a topic, brief, research…

Idioma del texto original: inglés

actualizado
ocupación
Diseñadores gráficos
descripción

Provider-independent production workflow for AI-assisted fashion campaigns, lookbooks, editorial fashion films, ecommerce/editorial hybrids, social cutdowns, virtual try-on assets, generated model/lifestyle ads, and retouched fashion visuals; use when an…

Idioma del texto original: inglés

actualizado
ocupación
Diseñadores gráficos
descripción

Provider-independent production guidance for AI agents creating or retouching appetizing food and beverage images, recipe videos, restaurant/menu visuals, CPG ads, ecommerce product images, beverage pours, packaging/lifestyle shots, and social food clips,…

Idioma del texto original: inglés

actualizado
ocupación
Artistas de efectos especiales y animadores
descripción

Provider-independent production workflow for AI agents creating game trailers and promos, including announcement, gameplay, launch, DLC/update, store-page videos, social cutdowns, and generated/engine-capture hybrid trailers. Use when planning, scripting,…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Provider-independent production workflow for AI agents creating music videos, lyric videos, visualizers, performance/narrative/dance videos, social cutdowns, album or single launch assets, and generated-media clips synchronized to songs. Use when planning,…

Idioma del texto original: inglés

actualizado
ocupación
Artistas de efectos especiales y animadores
descripción

Diagnose, design, script, produce, adapt, and quality-control product video advertisements from evidence-backed briefs. Use for physical-product, software, app, service, ecommerce, direct-response, brand-response, demonstration, testimonial, launch, and…

Idioma del texto original: inglés

actualizado
ocupación
Diseñadores gráficos
descripción

Provider-independent real estate media production for listing photos, virtual staging, property videos, walkthrough reels, floor-plan explainers, neighborhood clips, renovation concepts, agent ads, and generated or retouched property visuals. Use when…

Idioma del texto original: inglés

actualizado
ocupación
Artistas de efectos especiales y animadores
descripción

Provider-independent workflow for producing SaaS and software product demo videos, including app walkthroughs, feature launches, sales demos, onboarding clips, help-center explainers, website hero demos, and PLG assets. Use when an agent must plan, script,…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Plan, produce, adapt, finish, deliver, and improve platform-ready short vertical social videos from a brief, script, transcript, or source media. Use for TikTok videos, Instagram or Facebook Reels, YouTube Shorts, LinkedIn vertical clips, and cross-platform…

Idioma del texto original: inglés

actualizado
ocupación
Técnicos de audio y video
descripción

Provider-independent production workflow for recutting long talking-head, podcast, interview, webinar, panel, lecture, livestream, founder call, or customer-call footage into short clips, highlight reels, trailers, audiograms, captioned vertical videos, and…

Idioma del texto original: inglés

actualizado
ocupación
Artistas de efectos especiales y animadores
descripción

Provider-independent workflow for producing UGC-style paid and social ads, creator testimonials, product demos, hooks, before/after concepts, app walkthroughs, TikTok/Reels/Shorts variants, synthetic-persona or avatar UGC, ad-policy checks, disclosure…

Idioma del texto original: inglés

actualizado
Mostrando 40 de 153 skills recopiladas.