modèles
modèles
wan2.6
wan2.6
veo3.1-lite
veo3.1-lite
Lightweight base variant of Veo3.1 with lower computing overhead, meets basic video generation demands for low-cost bulk preview scenarios.
doubao-seedance-2-0-fast
doubao-seedance-2-0-fast
Accelerated variant of Seedance 2.0. Balances generation speed and visual quality, reduces inference latency for high-concurrency testing and mass rapid content production.
doubao-seedance-2-0-mini
doubao-seedance-2-0-mini
Doubao Seedance 2.0 Mini is ByteDance’s lightweight text-to-video model under the Seed series. Optimized for fast inference and low GPU overhead, it generates smooth, style-consistent short videos from text prompts. Designed for API integration, test environments and low-cost batch video production.

GLM 5.1
TEST GLM-5.1 (released April 2026), purpose-built for long-horizon autonomous tasks. Unlike traditional models optimized for short interactions, GLM-5.1 excels at maintaining goal alignment, reducing strategy drift, and delivering production-grade results over extended periods — up to 8 hours of continuous autonomous work on a single complex task. It represents a major leap in agentic engineering, shifting evaluation from single-turn intelligence to real-world sustained execution.
gpt-5.6
gpt-5.6
Nano Banana 2 lite
Nano Banana 2 lite
Gemini 3.1 Flash Lite Image model est un spécialiste de l’efficacité au sein de la famille de génération d’images, conçu pour une latence ultra-faible et pour une génération et une modification d’images à faible coût.
GPT-4.1 nano
GPT-4.1 nano
GPT-4.1 nano est un modèle d’intelligence artificielle fourni par OpenAI. gpt-4.1-nano: Propose une fenêtre de contexte plus large — prenant en charge jusqu’à 1 million de jetons de contexte et capable d’exploiter plus efficacement ce contexte grâce à une meilleure compréhension des longs contextes. Dispose d’une date de coupure des connaissances actualisée à juin 2024. Ce modèle prend en charge une longueur de contexte maximale de 1,047,576 jetons.

MiMo-V2.5
MiMo-V2.5 is Xiaomi's native full-modal model. It achieves professional-grade agent performance at about half the cost of inference, while outperforming MiMo-V2-Omni in multimodal perception in image and video understanding tasks.

GPT-5.4 pro
seedance-2-0
Happy Horse 1.1
Happy Horse 1.1
HappyHorse 1.1 est un modèle multimodal de génération de vidéos, conçu pour la création de contenu professionnel, la publicité, les courts métrages, la production pour les réseaux sociaux et la narration. Il étend les capacités de HappyHorse 1.0 — qui a suscité une attention considérable après s’être classé parmi les premiers lors d’évaluations indépendantes de génération vidéo — en offrant une meilleure cohérence des scènes et une fidélité visuelle accrue.

GPT Image 2
Le modèle de génération d’images le plus performant d’OpenAI, avec un rendu de texte quasi parfait dans de multiples langues, jusqu’à une résolution 4K, et un Thinking Mode alimenté par le raisonnement. Conçu pour des flux de production exigeant la précision, la rapidité et des résultats visuels conformes à la marque.

DeepSeek V4 Flash
DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and high-throughput workloads, while maintaining strong reasoning and coding performance.
.jpeg&w=3840&q=75)
GPT 5.5
Le modèle phare le plus intelligent et le plus intuitif d’OpenAI, conçu pour la programmation complexe, les flux de travail pilotés par des agents, l’utilisation de l’ordinateur, l’analyse de données et la recherche approfondie. Offre une intelligence de pointe avec la même faible latence que GPT-5.4, tout en exécutant les tâches avec une efficacité d’utilisation des jetons accrue. Le modèle de référence pour les charges de travail professionnelles et d’entreprise les plus exigeantes.

GPT 5.5 Pro
Le modèle le plus performant d'OpenAI, conçu pour les tâches les plus difficiles et des workflows agentiques de longue durée. GPT-5.5 Pro excelle en programmation complexe, utilisation de l'ordinateur, recherche approfondie, analyse de données et raisonnement scientifique — offrant une intelligence de pointe avec la latence de GPT-5.4 et une meilleure efficacité des jetons. Idéal pour les cas d'usage en entreprise et professionnels exigeant le plus haut niveau de précision et une exécution autonome des tâches.

Claude Sonnet 4.6
Claude Sonnet 4.6 is our most capable Sonnet model yet. It’s a full upgrade of the model’s skills across coding, computer use, long-context reasoning, agent planning, knowledge work, and design. Sonnet 4.6 also features a 1M token context window in beta.
Grok Imagine Video 1.5
Grok Imagine Video 1.5
Le dernier modèle image‑vers‑vidéo de xAI intègre nativement la génération audio synchronisée — la vidéo et le son sont produits en un seul passage d’inférence. Prend en charge une sortie 480p/720p, des clips jusqu’à 15 secondes, et classé n° 1 au classement Image-to-Video Arena.

Claude Opus 4.7
Claude Opus 4.7 is a hybrid reasoning model designed specifically for frontier-level coding, AI agents, and complex multi-step professional work. Unlike lighter models (e.g., Sonnet or Haiku variants), Opus 4.7 prioritizes depth, consistency, and autonomy on the hardest tasks.
Happy Horse 1.0
Happy Horse 1.0
Happy Horse 1.0 — A high-quality audio-video generation model that supports text-to-video and image-to-video creation. It can generate synchronized visuals, audio, and lip movements, making it suitable for short films, advertising creatives, and product showcases.

Grok 4.3
Excels at agentic reasoning, knowledge work, and tool use.

GPT Image 2 ALL
GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Doubao-Seedance-2-0
Seedance 2.0 est le modèle de fondation vidéo multimodal de nouvelle génération de ByteDance, axé sur la génération de vidéos narratives cinématographiques à plans multiples. À l’inverse des démonstrations texte‑vers‑vidéo à plan unique, Seedance 2.0 met l’accent sur un contrôle basé sur des références (images, clips courts, audio), la cohérence des personnages et du style d’un plan à l’autre, ainsi qu’une synchronisation audio/vidéo native — afin de rendre la vidéo IA utile aux flux de travail professionnels de création et de prévisualisation.

Sora 2 Pro
Sora 2 Pro est notre modèle de génération de médias le plus avancé et le plus puissant, capable de générer des vidéos avec audio synchronisé. Il peut créer des clips vidéo détaillés et dynamiques à partir de langage naturel ou d’images.

Nano Banana 2
Core Capabilities Overview: Resolution: Up to 4K (4096×4096), on par with Pro. Reference Image Consistency: Up to 14 reference images (10 objects + 4 characters), maintaining style/character consistency. Extreme Aspect Ratios: New 1:4, 4:1, 1:8, 8:1 ratios added, suitable for long images, posters, and banners. Text Rendering: Advanced text generation, suitable for infographics and marketing poster layouts. Search Enhancement: Integrated Google Search + Image Search. Grounding: Built-in thinking process; complex prompts are reasoned before generation.

GPT-5.2 Pro
gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

DeepSeek V4 Pro
DeepSeek V4 Pro is a large-scale Mixture-of-Experts model from DeepSeek with 1.6T total parameters and 49B activated parameters, supporting a 1M-token context window. It is designed for advanced reasoning, coding, and long-horizon agent workflows, with strong performance across knowledge, math, and software engineering benchmarks.

MiniMax-M2.7
MiniMax-M2.7 offers the same top-tier intelligence as the standard version—including recursive self-evolution and expert-level office productivity—but is designed for applications requiring sub-second latency and high-speed token generation. Leveraging an enhanced inference backbone architecture, its output speed is 66% faster than the standard model (reaching 100 tps). It is the preferred choice for interactive programming assistants, real-time agent loop execution, and high-throughput enterprise pipelines with stringent completion time requirements.

GPT-5.4 nano
GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini
GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.
Gemini omni fast
Gemini omni fast
Omni is the new model that can create anything from any input — starting with video. With Omni, you can combine images, audio, video and text as input and generate high-quality videos grounded in Gemini's real-world knowledge. You can also easily edit your videos through conversation.