DÉCOUVERTE DE MODÈLES D’IA

Aperçu du modèle TypeSafe Jev 1.13
TypeSafe

TypeSafe Jev 1.13

Structured decisions from text or JSON, with yes/no probabilities, choices and scores.

Chronologie des sorties de modèles

  1. Aperçu du modèle Wan 3.0 Prime

    Wan 3.0 Prime

    Alibaba

    Génération vidéo Alibaba Wan 3.0 Prime avec références de texte, d'image, de vidéo, d'audio, de document et de page web.

  2. Aperçu du modèle Wan 3.0

    Wan 3.0

    Alibaba

    Génération vidéo Alibaba Wan 3.0 avec références de texte, d'image, de vidéo, d'audio, de document et de page web.

  3. Aperçu du modèle Seedance 2.5

    Seedance 2.5

    ByteDance

    Modèle vidéo nouvelle génération de ByteDance pour les récits longs, avec jusqu'à 50 références multimodales

  4. Aperçu du modèle MiniMax H3

    MiniMax H3

    MiniMax

    Génération vidéo multimodale avec audio natif via MiniMax H3 (Hailuo 03), jusqu’en 2K.

  5. Aperçu du modèle Seedance 2.0 Mini

    Seedance 2.0 Mini

    ByteDance

    Modèle vidéo Seedance 2.0 économique de ByteDance, conçu pour une génération plus rapide et des coûts d'inférence réduits

  6. Aperçu du modèle Seedance 2.0 Fast

    Seedance 2.0 Fast

    ByteDance

    Vidéo multimodale rapide et abordable avec entrées texte, image, vidéo et audio jusqu'à 720p

  7. Aperçu du modèle Grok Imagine Video 1.5

    Grok Imagine Video 1.5

    Grok

    Génération image vers vidéo avec xAI Grok Imagine Video 1.5

  8. Aperçu du modèle Wan 2.7

    Wan 2.7

    Alibaba

    L'API vidéo Wan 2.7 d'Alibaba prend en charge les entrées multimodales complètes (texte, image, vidéo, audio) pour quatre modes (T2V, I2V, Reference2V, Edit), avec des sorties en 720P–1080P.

  9. Aperçu du modèle Veo 3.1 Lite

    Veo 3.1 Lite

    Google

    Génération vidéo économique avec audio natif—idéale pour les flux de travail à grand volume

  10. Aperçu du modèle PixVerse V6

    PixVerse V6

    PixVerse

    Génération vidéo cinématographique avec PixVerse V6, prenant en charge les transitions, les références, l’extension vidéo et l’audio natif.

Concevez image et son ensemble

Cette catégorie réunit des modèles vidéo ayant une capacité audio.

Décrivez ce qui doit être entendu

Décrivez ce qui doit être entendu

Reliez le son aux événements visibles et distinguez dialogue et ambiance.

Comparez l’audio par endpoint

Comparez l’audio par endpoint

Interrupteurs, langues, audio de référence et comportement de la bande sonore varient.

Évaluez l’ensemble audiovisuel

Évaluez l’ensemble audiovisuel

Un bon extrait associe un son cohérent à l’action et des images continues.

Préparez un test audiovisuel

Transformez vos exigences en requête compatible avec la documentation publiée.

1

Écrivez un brief attentif au son

Indiquez scène, action principale et sons associés.

2

Vérifiez les réglages audio

Contrôlez mode d’entrée, options et prix avant l’envoi.

3

Regardez et écoutez

Examinez timing, dialogue et continuité, en conservant la configuration.

Génération vidéo IA avec audio : questions fréquentes

Clarifiez le flux avant de choisir un modèle.

Le son est produit dans la capacité de génération vidéo du modèle, plutôt qu’ajouté ensuite dans un éditeur.