Aller à la navigationAller à la connexionAller au contenu principalAller au pied de page

Tarifs Model-as-a-service

Servez des modèles d'IA générative et payez pour une infrastructure dédiée ou pour des milliers de tokens.

Generative APIs - Serverless

Utilisez les derniers modèles d'IA, payez par millier de tokens.
Testez les nouveaux modèles avec notre free tier: 1 million de tokens et 60 minutes de transcription audio.
Toutes les requêtes effectuées via l'API Batches bénéficient d'un prix réduit de 50%.

Generative API
glm-5.2
Chat et code
1,80 € /million de tokens
5,50 € /million de tokens
deepseek-v4-flash-0731
Chat et code
0,40 € /million de tokens
0,08 € /million de tokens en cache
0,80 € /million de tokens
qwen3.8-27b
Chat, code et Vision
0,60 € /million de tokens
0,12 € /million de tokens en cache
3,30 € /million de tokens
gemma-4-26b-a4b-it
Chat, code et Vision
0,25 € /million de tokens
0,50 € /million de tokens
mistral-medium-3.5-128b
Chat, code et Vision
1,50 € /million de tokens
7,50 € /million de tokens
whisper-large-v3
Transcription audio
0,003 € /Minute audio
Gratuit
llama-3.3-70b-instruct
Chat
0,90 € /million de tokens
0,90 € /million de tokens
qwen3-235b-a22b-instruct-2507
Chat
0,75 € /million de tokens
2,25 € /million de tokens
qwen3-coder-30b-a3b-instruct
Chat et code
0,20 € /million de tokens
0,80 € /million de tokens
qwen3-embedding-8b
Embeddings
0,10 € /million de tokens
Gratuit
pixtral-12b-2409
Chat et Vision
0,20 € /million de tokens
0,20 € /million de tokens
mistral-small-3.2-24b-instruct-2506
Chat et Vision
0,15 € /million de tokens
0,35 € /million de tokens
gpt-oss-120b
Chat
0,15 € /million de tokens
0,60 € /million de tokens
bge-multilingual-gemma2
Embeddings
0,10 € /million de tokens
Gratuit
qwen3.6-35b-a3b
Chat, code et Vision
0,25 € /million de tokens
1,50 € /million de tokens
qwen3.5-397b-a17b
Chat, code et Vision
0,60 € /million de tokens
3,60 € /million de tokens
InformationOutlineIconMentions légalesArrowDownIcon

Prix HT.
Vous bénéficiez d'un essai gratuit de 1 000 000 tokens. Vous ne paierez qu'à partir de 1 000 001 token.

Generative APIs - Dedicated Deployment

Choisissez un modèle prêt à l'emploi et obtenez immédiatement un point d'accès dédié pour son inférence. Vous êtes facturé en fonction de l'utilisation du GPU que vous choisissez.

Managed Inference (trié par hourlyPrice croissant)
L4-1-24G
0,93 €
678,90 €
L40S-1-48G
1,72 €
1 255,31 €
H100-1-80G
3,40 €
2 481,71 €
H100-2-80G
6,68 €
4 876,25 €
H100-SXM-2-80G
7,95 €
5 803,50 €
H100-SXM-4-80G
15,22 €
11 110,57 €
H100-SXM-8-80G
30,06 €
21 943,80 €
InformationOutlineIconMentions légalesArrowDownIcon

Prix hors taxes
La facturation commence lorsque au moins un point de terminaison dédié est prêt à être utilisé.