Bytedance modelsvideo generation api

bytedance/seedance/2.0/fast/image-to-video

ByteDance's most advanced image-to-video model in its fast tier delivering lower latency and cost without compromising on cinematic output, native audio, multi-shot editing, and director-level camera control for profess...

Input
Idle

Example output — click Run to generate your own

API README

Seedance 2.0 Fast Image to Video

ByteDance's fast-tier image-to-video model — transforms a reference image into video with lower latency and ~20% cost savings compared to the standard version.

Highlights

Lower latency — Optimized for speed, ideal for iterative workflows and rapid prototyping.

Image-driven generation — Use a first-frame image to guide the video's visual style and starting point.

Native audio generation — Automatically creates synchronized sound effects and ambient audio.

Up to 720p — Supports 480p and 720p output (1080p not available in fast tier).

Pricing

ResolutionPrice per second
480p$0.08
720p$0.16

Default: 5 seconds at 720p = $0.80. Audio generation included at no extra cost.

Technical Specs

SpecValue
InputImage + optional text prompt
OutputMP4 video with optional audio
Resolution480p / 720p
Aspect ratios16:9, 9:16, 1:1, 4:3, 3:4, 21:9
Duration4–15 seconds
ExecutionAsync (submit → poll for result)
Typical latency1–5 minutes

Related

Related Models

bytedance/seedance/2.0/fast/reference-to-videoByteDance's most advanced reference-to-video model in its fast tier delivering lower latency and cost without compromising on cinematic output, native audio, multi-shot editing, and director-level camera control for professional-grade video creation.bytedance/seedance/2.0/fast/text-to-videoByteDance's most advanced text-to-video model in its fast tier delivering lower latency and cost without compromising on cinematic output, native audio, multi-shot editing, and director-level camera control for professional-grade video creation.bytedance/seedance/2.0/image-to-videoByteDance's most advanced image-to-video model transforming still images into cinematic video with native audio, multi-shot editing, and director-level camera control for professional-grade video creation.bytedance/seedance/2.0/reference-to-videoByteDance's most advanced reference-to-video model generating cinematic video guided by reference content, with native audio, multi-shot editing, and director-level camera control for professional-grade video creation.bytedance/seedance/2.0/text-to-videoByteDance's most advanced text-to-video model delivering cinematic output, native audio, multi-shot editing, and director-level camera control for professional-grade video creation.bytedance/seedance/1.5/pro/text-to-videoByteDance Seedance v1.5 Pro text-to-video model generating cinematic video from text prompts with native audio generation, camera control, and professional-grade output quality.bytedance/seedance/1.0/pro/fast/image-to-videoSeedance 1.0 Pro by Bytedance - animate still images into dynamic videos with AI. Transform photos into cinematic clips with natural motion, camera movement, and optional audio generation.bytedance/seedance/1.0/pro/fast/text-to-videoSeedance 1.0 Pro is Bytedance's text-to-video AI model. Turn written scripts and prompts into professional-quality video clips with realistic motion, lighting, and scene composition.