| name | fal-ai-media |
| description | fal.ai MCP를 통한 통합 미디어 생성 — 이미지, 비디오 및 오디오. 텍스트-이미지(Nano Banana), 텍스트/이미지-비디오(Seedance, Kling, Veo 3), 텍스트-음성(CSM-1B) 및 비디오-오디오(ThinkSound)를 포함합니다. 사용자가 AI로 이미지, 비디오 또는 오디오를 생성하고자 할 때 사용하세요. |
| origin | ECC |
fal.ai 미디어 생성 (fal.ai Media Generation)
MCP를 통해 fal.ai 모델을 사용하여 이미지, 비디오 및 오디오를 생성합니다.
활성화 시점
- 사용자가 텍스트 프롬프트로 이미지를 생성하고자 할 때
- 텍스트나 이미지로부터 비디오를 제작할 때
- 음성, 음악 또는 사운드 효과를 생성할 때
- 모든 종류의 미디어 생성 작업
- 사용자가 "이미지 생성해 줘", "비디오 만들어 줘", "텍스트를 음성으로", "썸네일 만들어 줘" 또는 이와 유사한 말을 할 때
MCP 요구 사항
fal.ai MCP 서버가 구성되어 있어야 합니다. ~/.claude.json에 추가하세요:
"fal-ai": {
"command": "npx",
"args": ["-y", "fal-ai-mcp-server"],
"env": { "FAL_KEY": "YOUR_FAL_KEY_HERE" }
}
API 키는 fal.ai에서 발급받을 수 있습니다.
MCP 도구
fal.ai MCP는 다음 도구들을 제공합니다:
search — 키워드로 사용 가능한 모델 찾기
find — 모델 상세 정보 및 파라미터 가져오기
generate — 파라미터와 함께 모델 실행
result — 비동기 생성 상태 확인
status — 작업 상태 확인
cancel — 실행 중인 작업 취소
estimate_cost — 생성 비용 예측
models — 인기 모델 목록 보기
upload — 입력으로 사용할 파일 업로드
이미지 생성 (Image Generation)
Nano Banana 2 (빠름)
용도: 빠른 반복 작업, 초안, 텍스트-이미지, 이미지 편집.
generate(
app_id: "fal-ai/nano-banana-2",
input_data: {
"prompt": "a futuristic cityscape at sunset, cyberpunk style",
"image_size": "landscape_16_9",
"num_images": 1,
"seed": 42
}
)
Nano Banana Pro (고화질)
용도: 프로덕션용 이미지, 사실주의, 타이포그래피, 상세한 프롬프트.
generate(
app_id: "fal-ai/nano-banana-pro",
input_data: {
"prompt": "professional product photo of wireless headphones on marble surface, studio lighting",
"image_size": "square",
"num_images": 1,
"guidance_scale": 7.5
}
)
공통 이미지 파라미터
| 파라미터 | 타입 | 옵션 | 비고 |
|---|
prompt | string | 필수 | 원하는 이미지 설명 |
image_size | string | square, portrait_4_3, landscape_16_9, portrait_16_9, landscape_4_3 | 가로세로 비율 |
num_images | number | 1-4 | 생성할 이미지 개수 |
seed | number | 정수 | 재현성 |
guidance_scale | number | 1-20 | 프롬프트를 얼마나 엄격하게 따를지 (높을수록 글자 그대로 따름) |
이미지 편집
인페인팅, 아웃페인팅 또는 스타일 전송을 위해 이미지 입력과 함께 Nano Banana 2를 사용하세요:
# 먼저 소스 이미지 업로드
upload(file_path: "/path/to/image.png")
# 그런 다음 이미지 입력과 함께 생성
generate(
app_id: "fal-ai/nano-banana-2",
input_data: {
"prompt": "same scene but in watercolor style",
"image_url": "<uploaded_url>",
"image_size": "landscape_16_9"
}
)
비디오 생성 (Video Generation)
Seedance 1.0 Pro (ByteDance)
용도: 높은 모션 품질을 가진 텍스트-비디오, 이미지-비디오.
generate(
app_id: "fal-ai/seedance-1-0-pro",
input_data: {
"prompt": "a drone flyover of a mountain lake at golden hour, cinematic",
"duration": "5s",
"aspect_ratio": "16:9",
"seed": 42
}
)
Kling Video v3 Pro
용도: 네이티브 오디오 생성이 포함된 텍스트/이미지-비디오.
generate(
app_id: "fal-ai/kling-video/v3/pro",
input_data: {
"prompt": "ocean waves crashing on a rocky coast, dramatic clouds",
"duration": "5s",
"aspect_ratio": "16:9"
}
)
Veo 3 (Google DeepMind)
용도: 생성된 사운드가 포함된 비디오, 높은 시각적 품질.
generate(
app_id: "fal-ai/veo-3",
input_data: {
"prompt": "a bustling Tokyo street market at night, neon signs, crowd noise",
"aspect_ratio": "16:9"
}
)
이미지-비디오
기존 이미지에서 시작하기:
generate(
app_id: "fal-ai/seedance-1-0-pro",
input_data: {
"prompt": "camera slowly zooms out, gentle wind moves the trees",
"image_url": "<uploaded_image_url>",
"duration": "5s"
}
)
비디오 파라미터
| 파라미터 | 타입 | 옵션 | 비고 |
|---|
prompt | string | 필수 | 비디오 설명 |
duration | string | "5s", "10s" | 비디오 길이 |
aspect_ratio | string | "16:9", "9:16", "1:1" | 프레임 비율 |
seed | number | 정수 | 재현성 |
image_url | string | URL | 이미지-비디오용 소스 이미지 |
오디오 생성 (Audio Generation)
CSM-1B (대화형 음성)
자연스럽고 대화 스타일의 품질을 가진 텍스트-음성.
generate(
app_id: "fal-ai/csm-1b",
input_data: {
"text": "Hello, welcome to the demo. Let me show you how this works.",
"speaker_id": 0
}
)
ThinkSound (비디오-오디오)
비디오 콘텐츠에 맞는 오디오를 생성합니다.
generate(
app_id: "fal-ai/thinksound",
input_data: {
"video_url": "<video_url>",
"prompt": "ambient forest sounds with birds chirping"
}
)
ElevenLabs (API 경유, MCP 아님)
전문적인 음성 합성을 위해 ElevenLabs를 직접 사용하세요:
import os
import requests
resp = requests.post(
"https://api.elevenlabs.io/v1/text-to-speech/<voice_id>",
headers={
"xi-api-key": os.environ["ELEVENLABS_API_KEY"],
"Content-Type": "application/json"
},
json={
"text": "Your text here",
"model_id": "eleven_turbo_v2_5",
"voice_settings": {"stability": 0.5, "similarity_boost": 0.75}
}
)
with open("output.mp3", "wb") as f:
f.write(resp.content)
VideoDB 생성형 오디오
VideoDB가 구성된 경우, 해당 생성형 오디오를 사용하세요:
audio = coll.generate_voice(text="Your narration here", voice="alloy")
music = coll.generate_music(prompt="upbeat electronic background music", duration=30)
sfx = coll.generate_sound_effect(prompt="thunder crack followed by rain")
비용 예측
생성하기 전에 예상 비용을 확인하세요:
estimate_cost(
estimate_type: "unit_price",
endpoints: {
"fal-ai/nano-banana-pro": {
"unit_quantity": 1
}
}
)
모델 검색
특정 작업을 위한 모델 찾기:
search(query: "text to video")
find(endpoint_ids: ["fal-ai/seedance-1-0-pro"])
models()
팁
- 프롬프트 반복 작업 시 재현 가능한 결과를 위해
seed를 사용하세요.
- 프롬프트 튜닝에는 저비용 모델(Nano Banana 2)로 시작하고, 최종 결과물에 Pro 모델을 사용하세요.
- 비디오의 경우, 프롬프트를 묘사적이면서도 간결하게 유지하세요 (움직임과 장면에 집중).
- 이미지-비디오 방식이 순수 텍스트-비디오보다 더 통제된 결과를 만들어냅니다.
- 비용이 많이 드는 비디오 생성 전에는
estimate_cost를 확인하세요.
관련 스킬
videodb — 비디오 처리, 편집 및 스트리밍
video-editing — AI 기반 비디오 편집 워크플로우
content-engine — 소셜 플랫폼용 콘텐츠 제작