Quotas & limites
Limites par token
Qu'est ce qu'un token ?
Comment sont comptabilisés les tokens ?
{ "model": "openweight-large", "messages": [ { "role": "system", "content": "Tu es un assistant de chat qui répond à des questions." → 12 tokens }, { "role": "user", "content": "Bonjour, comment allez-vous ?" → 6 tokens } { "role": "assistant", "content": "Je vais bien, merci pour votre question." → 9 tokens } { "role": "user", "content": "Quel est votre nom ?" → 5 tokens } { "role": "assistant", "content": "Je m'appelle Albert." → 5 token } ] }{ "model": "openweight-embeddings-large", "input": [ "Albert API est un outil de IA open source.", → 10 tokens "Il est développé par la communauté de l'IA open source." → 13 tokens ] }{ "model": "openweight-rerank-large", "query": "Albert API est un outil de IA open source.", → 10 tokens "documents": [ "Albert API est un outil de IA open source.", → 10 tokens "Il est développé par la communauté de l'IA open source." → 13 tokens ] }
Limites par requête
Qu'est ce qu'une requête ?
Consulter sa consommation
Dépassement de limites
Quotas “tarifs” (par famille de modèles)
Famille de modèles (ex.)
Accès
RPM
RPD
TPM
TPD
Budget (UserInfo.budget)
Qui configure les limites ?
Last updated
Was this helpful?