Vidu Q2 is a high-end text-to-image model with cinematic lighting and clean composition. Supports up to 4K resolution and flexible aspect ratios. Upload reference images to guide generation with subject/composition consistency.
Added Dec 2, 2025
Approx. Price
$0.030 per image
Model Type
both
Settings
Generation controls available for this model.
Images Per Run
Up to 1
Output images
Input Images
Up to 7
Reference/edit images accepted • Route max 30 MB
Output Sizes
Aspect Ratio
Default
1:1
Options (9)
Auto (match references), Square, 16:9 Widescreen, 9:16 Vertical +5 more
Canvas shape for generation. Use "auto" to match reference images.
Number of Images
Default
1
Resolution
Default
1080p
Options (3)
1080p (Fast preview (1920x1080)), 2K (Higher detail (2560x1440)), 4K (Maximum sharpness (3840x2160))
Seed
Default
-1
Control reproducibility (-1 for random).
Benchmarks
Benchmarks
Human preference benchmarks sourced from Artificial Analysis.
Text to Image
#89 / 159
ELO
915.0
Appearances
7,144
95% CI
-7/7
Image Editing
#54 / 76
ELO
956.0
Appearances
7,912
95% CI
-7/7
Release Date 2025-11 · Matched as Vidu Q2
Artificial Analysis APIExamples
Loading examples…
Related image models
Compare Vidu Q2 with similar models from the same provider or model family.
Vidu Q2 Reference
vidu-q2-referenceVidu Q2 Reference-to-Image generates images based on 1-7 reference images with customizable prompts. Ideal for keeping product, character, or actor identity consistent across shots.
BiRefNet V2
fal-ai/birefnet/v2Remove backgrounds with dedicated foreground segmentation, preserving transparent edges. Optionally return the mask itself.
GPT Image 2.5 Flare Edit
openai/gpt-image-2.5/flare/editGPT Image 2.5 Flare edits images from natural-language instructions with up to 16 reference images. Supports quality levels from low to max and 1K, 2K, or 4K output. Pricing depends on quality, resolution, and reference image count.
GPT Image 2.5 Flare
openai/gpt-image-2.5/flare/text-to-imageGPT Image 2.5 Flare generates images from text prompts or edits images with up to 16 reference images. Supports quality levels from low to max and 1K, 2K, or 4K output. Pricing depends on quality, resolution, and reference image count.
GPT Image 2.5 Sunburst Edit
openai/gpt-image-2.5/sunburst/editGPT Image 2.5 Sunburst edits images from natural-language instructions with up to 16 reference images. Supports quality levels from low to max and 1K, 2K, or 4K output. Pricing depends on quality, resolution, and reference image count.
GPT Image 2.5 Sunburst
openai/gpt-image-2.5/sunburst/text-to-imageGPT Image 2.5 Sunburst generates images from text prompts or edits images with up to 16 reference images. Supports quality levels from low to max and 1K, 2K, or 4K output. Pricing depends on quality, resolution, and reference image count.