video_generate.vidu_q1_r2v_novita
vidu/vidu-q1/reference-to-video

La Vidu Q1 API génère une vidéo à partir d'images de référence et d'un prompt optionnel en langage naturel (Vidu Q1) — sortie fixe de 5 s en 1080p, cohérence d'identité et de personnage entre les images, amplitude de mouvement réglable (auto / petit / moyen / grand), musique de fond optionnelle et seed reproductible — le tout via un endpoint REST compatible OpenAI, 15 % en dessous du tarif officiel.

Entrée
Prompt texte envoyé au modèle
Sortie
Sample edited image — run the model to replace this previewSampleRun the model to replace this preview

Vidu Q1 API : référence vers vidéo

Utilisez la Vidu Q1 API pour générer des clips cohérents de 5 s en 1080p depuis des images de référence.

La Vidu Q1 API (video_generate.vidu_q1_r2v_novita) génère des clips vidéo de 5 s en 1080p à partir d'images de référence et d'un prompt optionnel. Chaque appel à la Vidu Q1 API fixe l'identité et l'apparence de votre sujet, produisant une sortie cohérente avec une amplitude réglable — auto, small, medium ou large — et une musique de fond optionnelle, via un unique appel REST compatible OpenAI. La Vidu Q1 API est conçue pour les personnages — avatar, mascotte, héros de jeu — où le même visage et la même tenue doivent tenir à chaque image ; elle lit les références pour verrouiller l'identité avant le rendu.

Le prix de la Vidu Q1 API est de 0,34 $ par génération — 15 % en dessous du tarif publié. La Vidu Q1 API utilise une seule clé RouterBase ; aucun SDK Vidu ni compte séparé n'est requis. Comme la Vidu Q1 API est asynchrone et compatible OpenAI, mettez en file des jobs, traitez une distribution entière de nuit et récupérez les clips depuis une seule URL de CDN.

Pourquoi ce modèle

Six raisons pour lesquelles les équipes choisissent la Vidu Q1 API

De la cohérence des références au contrôle du mouvement par appel — ce que la Vidu Q1 API réussit.

Cohérence d'identité

Fournissez des références et la Vidu Q1 API préserve visage, tenue et proportions dans chaque image du clip, si bien qu'un personnage reste fidèle d'un plan à l'autre.

Clips 5 s en 1080p

Chaque appel à la Vidu Q1 API produit une vidéo de 5 s en 1080p — la durée fixe garde coût et stockage prévisibles.

Contrôle de l'amplitude

Passez auto, small, medium ou large par appel. Small stabilise un portrait, large pousse l'action, auto laisse la Vidu Q1 API choisir le mouvement.

Musique de fond optionnelle

Mettez bgm=true et la Vidu Q1 API habille le clip d'une piste adaptée ; omettez-le pour une sortie silencieuse.

0,34 $ / génération

15 % sous le tarif publié sur la Vidu Q1 API — prix fixe par génération, quels que soient l'amplitude, les références ou le BGM.

REST compatible OpenAI

Un endpoint, une clé — la Vidu Q1 API utilise le même JSON et en-tête Bearer que tout modèle RouterBase ; y passer n'est qu'un changement de model ID.

RouterBase dashboard preview
Démarrage rapide

Démarrez avec la Vidu Q1 API en 3 étapes

De l'inscription au premier appel référence-vers-vidéo en moins de 5 minutes.

  1. Téléchargez votre image de référence

    Hébergez l'image de votre sujet sur une URL publique — la Vidu Q1 API accepte une ou plusieurs URLs de référence ; des angles en plus affinent la cohérence.

  2. Faites un POST vers l'endpoint Vidu Q1 API

    Envoyez reference_images, prompt optionnel, motion_amplitude et bgm en JSON à POST /v1/images/generations. La Vidu Q1 API renvoie un id de job ; interrogez GET /v1/images/generations/{id} jusqu'à status=success.

  3. Téléchargez le clip

    La réponse de succès de la Vidu Q1 API contient une URL de CDN signée dans results. Mettez-la dans une balise <video> ou copiez-la dans votre bucket — le MP4 de 5 s en 1080p est prêt sans post-traitement.

Tarifs

Ne payez que ce que vous utilisez

RouterBase répercute les prix partenaires. Comparé au tarif public officiel du modèle.

RésolutionRouterBaseOfficielÉconomie
generation $0.340$0.400−15%

Un appel avec la configuration par défaut (generation) coûte $0.340.Avec 1 $ vous pouvez exécuter ce modèle environ 2 fois.

Témoignages clients

Ce que les équipes construisent avec la Vidu Q1 API

Charges de production réelles sur la Vidu Q1 API et le catalogue RouterBase.

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

Nous avons passé des références à la Vidu Q1 API et l'avatar a gardé son visage dans chaque clip. Une cohérence jamais atteinte avant.

Priya Lakshmi
Priya LakshmiFounder, Quillo

Une photo de référence, un appel à la Vidu Q1 API — même personnage, clip de 5 s, en ligne en 90 secondes. Notre équipe adore.

Thomas Beck
Thomas BeckStaff Engineer, Northbeam

Grâce à la référence-vers-vidéo de la Vidu Q1 API, plus besoin de retransmettre des images pour la continuité. Une photo, c'est tout.

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

Références envoyées à la Vidu Q1 API chaque nuit. BGM activé, mouvement auto — le personnage est impeccable chaque matin.

Jonas Keller
Jonas KellerIndie Developer

J'ai basculé la base URL vers RouterBase et passé reference_images. La Vidu Q1 API a gardé mon personnage de jeu cohérent sur dix clips.

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

RouterBase met 200+ modèles derrière une clé. La référence-vers-vidéo de la Vidu Q1 API est celle que notre marque réserve à chaque sprint.

Sophia Martín
Sophia MartínCTO, Relay

À 0,34 $ par clip, la Vidu Q1 API entre dans le budget publicitaire — et notre porte-parole apparaît identique dans chaque vidéo.

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

Même JSON, autre model ID. La référence-vers-vidéo de la Vidu Q1 API fut la plus simple de notre déploiement de 42 services.

David Okonkwo
David OkonkwoCo-founder, Figment

La remise de 15 % se fait sentir quand on génère des milliers de clips à marque cohérente par semaine.

Questions fréquentes

Questions courantes sur la référence-vers-vidéo de la Vidu Q1 API.

La tâche référence-vers-vidéo de la Vidu Q1 API utilise des images d'un sujet pour maintenir l'identité et la cohérence de personnage dans le clip de 5 s en 1080p — contrairement à image-vers-vidéo qui anime une seule image. Idéal quand un personnage doit rester reconnaissable sur de nombreux clips.