Skip to content

Modèles d'IA sur Pixo

Pixo fait tourner 52 modèles d'IA de 13 créateurs — vidéo, image, voix, musique, synchronisation labiale et plus. Combinez-les librement dans un même projet, sur une seule facture.

Vidéo · 20

Texte vers vidéo et image vers vidéo. Combinez les modèles librement d'un plan à l'autre dans un même storyboard.

Seedance · ByteDance

ModèleRésolutionDuréeFormatsAudio natifEntrées de référence
Seedance 1 Pro Fast480p · 720p · 1080p2–12s16:9 · 4:3 · 1:1 · 3:4 · 9:16 · 21:9
Seedance 1.5 Pro480p · 720p · 1080p4–12s16:9 · 4:3 · 1:1 · 3:4 · 9:16 · 21:9Oui
Seedance 2.0480p · 720p · 1080p · 4k4–15s16:9 · 4:3 · 1:1 · 3:4 · 9:16 · 21:9Oui9 images, 3 vidéos, 3 audios
Seedance 2.0 Fast480p · 720p4–15s16:9 · 4:3 · 1:1 · 3:4 · 9:16 · 21:9Oui9 images, 3 vidéos, 3 audios
Seedance 2.0 Mini480p · 720p4–15s16:9 · 4:3 · 1:1 · 3:4 · 9:16 · 21:9Oui9 images, 3 vidéos, 3 audios

Kling · Kuaishou

ModèleRésolutionDuréeFormatsAudio natifEntrées de référence
Kling 3.0720p · 1080p3–15s16:9 · 9:16 · 1:1Oui
Kling 3.0 Omni720p · 1080p3–15s16:9 · 9:16 · 1:1Oui7 images
Kling 3.0 Turbo720p · 1080p3–15s16:9 · 9:16 · 1:1

Hailuo · MiniMax

ModèleRésolutionDuréeFormatsAudio natifEntrées de référence
Hailuo 2.3768p · 1080p6–10s
Hailuo 2.3 Fast768p · 1080p6–10s

Sora · OpenAI

ModèleRésolutionDuréeFormatsAudio natifEntrées de référence
Sora 24–12s16:9 · 9:161 image
Sora 2 Pro720p · 1080p4–12s16:9 · 9:161 image

VEO · Google

ModèleRésolutionDuréeFormatsAudio natifEntrées de référence
VEO 3.1720p · 1080p · 4k4–8s16:9 · 9:163 images
VEO 3.1 Fast720p · 1080p · 4k4–8s16:9 · 9:16

Autres modèles vidéo

ModèleCréateurRésolutionDuréeFormatsAudio natifEntrées de référence
Grok Imagine VideoxAI720p · 480p1–15s16:9 · 4:3 · 1:1 · 9:16 · 3:4 · 3:2 · 2:3
LatentSyncByteDance
LTX 2.3 ProLightricks1080p · 2k · 4k6–10s16:9 · 9:16Oui
Omni Human 1.5ByteDance
Pixverse V4.5PixVerse540p · 720p · 1080p5–8s16:9 · 9:16 · 4:3 · 3:4 · 1:1 · 21:9
WAN 2.6WAN720p · 1080p5–15s16:9 · 9:16

Image · 10

Images fixes, références de personnage et de style, et retouche d'image.

ModèleCréateurRésolutionFormatsEntrées de référence
Nano BananaGoogle1:1 · 2:3 · 3:2 · 3:4 · 4:3 · 4:5 · 5:4 · 9:16 · 16:9 · 21:9
Nano Banana ProGoogle1 MP · 2 MP · 4 MP1:1 · 2:3 · 3:2 · 3:4 · 4:3 · 4:5 · 5:4 · 9:16 · 16:9 · 21:914 images
Nano Banana 2Google1K · 2K · 4K1:1 · 1:4 · 1:8 · 2:3 · 3:2 · 3:4 · 4:1 · 4:3 · 4:5 · 5:4 · 8:1 · 9:16 · 16:9 · 21:914 images
Seedream 5.0 ProByteDance1 MP · 2 MPmatch_input_image · 1:1 · 4:3 · 3:4 · 16:9 · 9:16 · 3:2 · 2:3 · 21:910 images
Seedream 5.0 LiteByteDance2 MP · 3 MP · 4 MPmatch_input_image · 1:1 · 4:3 · 3:4 · 16:9 · 9:16 · 3:2 · 2:3 · 21:914 images
Seedream 5.0 ProByteDance1 MP · 2 MPmatch_input_image · 1:1 · 4:3 · 3:4 · 16:9 · 9:16 · 3:2 · 2:3 · 21:910 images
Seedream 5.0 LiteByteDance2 MP · 3 MP · 4 MPmatch_input_image · 1:1 · 4:3 · 3:4 · 16:9 · 9:16 · 3:2 · 2:3 · 21:914 images
Grok Imagine ImagexAI1k · 2k1:1 · 16:9 · 9:16 · 4:3 · 3:4 · 3:2 · 2:3 · 2:1 · 1:2 · 19.5:9 · 9:19.5 · 20:9 · 9:20 · auto
Grok Imagine Image ProxAI1k · 2k1:1 · 16:9 · 9:16 · 4:3 · 3:4 · 3:2 · 2:3 · 2:1 · 1:2 · 19.5:9 · 9:19.5 · 20:9 · 9:20 · auto
GPT Image 2OpenAI1:1 · 16:9 · 9:16 · 4:3 · 3:4 · 4:5 · custom4 images

Voix · 8

Synthèse vocale et clonage de voix pour la narration et les dialogues.

ModèleCréateurVoixLangues
Minimax Speech 02 HDMiniMax30243
Minimax Speech 02 TurboMiniMax30243
Minimax Voice CloningMiniMax
ElevenLabs v3ElevenLabs21
ElevenLabs Multilingual v2ElevenLabs21
ElevenLabs Turbo v2.5ElevenLabs21
ElevenLabs Flash v2.5ElevenLabs21
ElevenLabs Voice DesignElevenLabs

Texte · 6

Écriture de scénarios et génération de textes dans le playground.

ModèleCréateur
GPT-4o MiniOpenAI
Gemini 2.5 FlashGoogle
Gemini 3.1 ProGoogle
DeepSeek V3DeepSeek
DeepSeek R1DeepSeek
Doubao Seed 1.6ByteDance

Musique · 3

Musiques originales et pistes d'ambiance.

ModèleCréateurDurée
ElevenLabs MusicElevenLabs10–300s
Minimax Music 2.5MiniMax
Stable Audio 2.5Stability AI1–190s

Synchronisation labiale · 2

Alignez une vidéo existante sur une piste vocale.

ModèleCréateurEntrées
React 1Sync LabsVidéo + Audio
Omni HumanByteDanceAudio

Effets sonores · 1

Générez des effets sonores à partir d'une description textuelle.

Fonctionne avec ElevenLabs Sound Effects, de ElevenLabs.

Transcription · 1

Convertissez en texte la parole d'un audio ou d'une vidéo.

Fonctionne avec Whisper Large V3, de OpenAI.

Clonage de voix · 1

Clonez une voix à partir d'un court échantillon et faites-lui dire n'importe quel texte.

Fonctionne avec ElevenLabs Instant Voice Clone, de ElevenLabs.