> For the complete documentation index, see [llms.txt](https://guides.ia.numerique.gouv.fr/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://guides.ia.numerique.gouv.fr/albert-api/modeles/available-models.md).

# Modèles disponibles

Albert API offre l’accès à une large gamme de modèles fondation open source d’IA générative. Nous mettons à jour régulièrement les modèles disponibles pour vous permettre d’utiliser les modèles qui font l’état de l’art.

{% hint style="info" %}
Chaque modèle est associé à un type de modèle. Pour en savoir plus sur les types de modèles, voir [Types de modèles](/albert-api/modeles/model-types.md).
{% endhint %}

Les recommandations d'usage ci-dessous proviennent de l'expérience des utilisateurs et ne sont pas garanties. Nous vous recommandons de tester différents modèles et leurs paramètres pour trouver ceux qui s'adapteront le mieux à vos besoins.

Vos retours nous sont précieux pour améliorer les modèles et les recommandations d'usage. N'hésitez pas à nous les partager sur notre canal Tchap ou par mail (voir la page [Contact](https://ia.numerique.gouv.fr/outils-ia/albert-api/albert-api-contact/)).

<details>

<summary>bge-m3</summary>

Model d'embeddings de référence pour la vectorisation de texte.

<a href="https://huggingface.co/BAAI/bge-m3" class="button secondary">Model card</a>

|                                     |                                        |
| ----------------------------------- | -------------------------------------- |
| **Nombre de paramètres**            | 568M                                   |
| **Type**                            | `text-embeddings-inference`            |
| **Aliases**                         | `BAAI/bge-m3`, `openweight-embeddings` |
| **Licence**                         | MIT                                    |
| **Fenêtre de contexte**             | 8192                                   |
| **Dimension maximale des vecteurs** | 1024                                   |
| **Maximum de texte par batch**      | 64                                     |

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Text vectorisation</strong></td><td>/v1/embeddings</td><td><a href="/pages/LbydQJgYBBO7rdUe58mx">/pages/LbydQJgYBBO7rdUe58mx</a></td><td><a href="/files/0iVLlMVCem7q4Lw4nzaM">/files/0iVLlMVCem7q4Lw4nzaM</a></td></tr></tbody></table>

</details>

<details>

<summary>bge-reranker-v2-m3</summary>

Modèle de reranking multilingue basé sur `bge-m3`. Il est le modèle de référence pour le reranking sur Albert API.

<a href="https://huggingface.co/BAAI/bge-reranker-v2-m3" class="button secondary">Model card</a>

|                                |                                                |
| ------------------------------ | ---------------------------------------------- |
| **Nombre de paramètres**       | 568M                                           |
| **Type**                       | `text-classification`                          |
| **Licence**                    | MIT                                            |
| **Aliases**                    | `BAAI/bge-reranker-v2-m3`, `openweight-rerank` |
| **Fenêtre de contexte**        | 8192                                           |
| **Maximum de texte par batch** | 64                                             |

{% hint style="success" icon="lightbulb" %}
La limite architecturale est de 8192 tokens, toutefois le modèle a été finetuné pour être utilisé avec des textes de longueur maximale de 1024 tokens. Nous recommandons de ne pas dépasser cette longueur lors de la construction des chunks pour le reranking.
{% endhint %}

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Reranking</strong></td><td>/v1/reranking</td><td><a href="/pages/TQ5TxG7AZWHzeprIQztb">/pages/TQ5TxG7AZWHzeprIQztb</a></td><td><a href="/files/bQyJQ5DV7HICQYCnd1uQ">/files/bQyJQ5DV7HICQYCnd1uQ</a></td></tr></tbody></table>

</details>

<details>

<summary>deepseek-v4-flash <img src="https://img.shields.io/badge/mod%C3%A8le_en_exp%C3%A9rimentation-green" alt="modèle en expérimentation"></summary>

MoE spécialisé pour les tâches de code.

{% hint style="warning" %}
Ce modèle est en phase d'expérimentation du 26 juillet 2026 au 1er octobre 2026. Candidat au remplacement du modèle `openweight-code` à l'issue de cette période.

Ce modèle extra-européen peut présenter certaines formes de censure des réponses. Nous recommandons de l'utiliser uniquement pour les cas d'usage de génération de code et non comme un modèle conversationnel généraliste.

Cette phase d'expérimentation a notamment pour objectif d'évaluer l'impact de ces limitations afin de déterminer si elles sont compatibles avec une intégration pérenne dans Albert API. Vos retours sur ce sujet seront particulièrement précieux.
{% endhint %}

<a href="https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash" class="button secondary">Model card</a> <a href="https://albert.playground.etalab.gouv.fr" class="button primary">Essayer dans Playground</a>

|                                 |                                      |
| ------------------------------- | ------------------------------------ |
| **Nombre de paramètres**        | 284B                                 |
| **Nombre de paramètres actifs** | 13B                                  |
| **Licence**                     | MIT                                  |
| **Type**                        | `text-generation`                    |
| **Aliases**                     | `deepseek-ai/DeepSeek-V4-Flash-0731` |
| **Fenêtre de contexte**         | 393216                               |
| **Température recommandée**     | 1.0                                  |

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Code</strong></td><td>/v1/chat/completions</td><td><a href="/pages/8tjN7kdd7kRpzlNlPJ5O">/pages/8tjN7kdd7kRpzlNlPJ5O</a></td><td><a href="/files/Duw7IH4xAEQhElL2S3x0">/files/Duw7IH4xAEQhElL2S3x0</a></td></tr><tr><td><strong>Reasoning</strong></td><td>/v1/chat/completions</td><td><a href="https://github.com/betagouv/doc.albert-api/tree/main/guides/reasoning.md">https://github.com/betagouv/doc.albert-api/tree/main/guides/reasoning.md</a></td><td><a href="/files/55xNigdE1dWPbg5plV7N">/files/55xNigdE1dWPbg5plV7N</a></td></tr><tr><td><strong>Function calling</strong></td><td>/v1/chat/completions</td><td><a href="/pages/OhzjWruOdgzEzmBLrCvn">/pages/OhzjWruOdgzEzmBLrCvn</a></td><td><a href="/files/xD4DhCaJREZJzUQ3PLIS">/files/xD4DhCaJREZJzUQ3PLIS</a></td></tr></tbody></table>

{% hint style="info" icon="screwdriver-wrench" %}
**Comportement du function calling**

Le paramètre `tool_choice` doit être explicitement défini à `auto` dans la requête pour que les appels d'outils fonctionnent avec ce modèle. Sans cela, le modèle n'émet pas de `tool_calls`, même si des `tools` sont fournis.

Sans le streaming, modèle renvoie un tool call avec un content non vide. En streaming, les arguments sont fragmentés sur plusieurs chunks SSE, et le finish\_reason: "tool\_calls" arrive dans un chunk distinct qui ne contient plus de tool\_calls.
{% endhint %}

</details>

<details>

<summary>lightonocr-2-1b</summary>

Modèle multimodal spécialisé pour l'OCR. Il est le modèle de référence pour l'OCR sur Albert API.

<a href="https://huggingface.co/lightonai/LightOnOCR-2-1B" class="button secondary">Model card</a> <a href="https://albert.playground.etalab.gouv.fr" class="button primary">Essayer dans Playground</a>

|                          |                                              |
| ------------------------ | -------------------------------------------- |
| **Nombre de paramètres** | 1B                                           |
| **Licence**              | Apache 2.0                                   |
| **Type**                 | `image-text-to-text`                         |
| **Aliases**              | `lighton/LightOn-OCR-2-1B`, `openweight-ocr` |
| **Fenêtre de contexte**  | 16384                                        |

{% hint style="success" icon="lightbulb" %}
Nous observons certaines latences lorsque certains patterns de pixels sont présents dans l'image (un QR code par exemple). Si vous observez des latences élevées, essayez de supprimer ces patterns avant d'envoyer l'image au modèle.
{% endhint %}

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>OCR (chat)</strong></td><td>/v1/chat/completions</td><td><a href="/pages/Yf70ud6wbQ5M1BmunToj">/pages/Yf70ud6wbQ5M1BmunToj</a></td><td><a href="/files/OKoYDNOnQmDV26MvVG4a">/files/OKoYDNOnQmDV26MvVG4a</a></td></tr></tbody></table>

</details>

<details>

<summary>ministral-3-8b-instruct-2512</summary>

Modèle multimodal généraliste de petite taille, idéal pour des tâches simples comme de la classification ou de correction de texte.

<a href="https://huggingface.co/mistralai/Ministral-3-8B-Instruct-2512" class="button secondary">Model card</a> <a href="https://albert.playground.etalab.gouv.fr" class="button primary">Essayer dans Playground</a>

|                             |                                                              |
| --------------------------- | ------------------------------------------------------------ |
| **Nombre de paramètres**    | 8.9B                                                         |
| **Type**                    | `text-generation`                                            |
| **Licence**                 | Apache 2.0                                                   |
| **Aliases**                 | `mistralai/Ministral-3-8B-Instruct-2512`, `openweight-small` |
| **Format d'entrées**        | `text`, `image`                                              |
| **Fenêtre de contexte**     | 262144                                                       |
| **Température recommandée** | 0.1                                                          |

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Chat</strong></td><td>/v1/chat/completions</td><td><a href="/pages/3acxJLpbqGiB6WyVxzAt">/pages/3acxJLpbqGiB6WyVxzAt</a></td><td><a href="/files/SesZhxIhNTk7H6sTC8LV">/files/SesZhxIhNTk7H6sTC8LV</a></td></tr><tr><td><strong>Analyse d'image</strong></td><td>/v1/chat/completions</td><td><a href="/pages/3acxJLpbqGiB6WyVxzAt">/pages/3acxJLpbqGiB6WyVxzAt</a></td><td><a href="/files/SdJhTgDjiodb5fffxr9H">/files/SdJhTgDjiodb5fffxr9H</a></td></tr><tr><td><strong>Function calling</strong></td><td>/v1/chat/completions</td><td><a href="/pages/OhzjWruOdgzEzmBLrCvn">/pages/OhzjWruOdgzEzmBLrCvn</a></td><td><a href="/files/xD4DhCaJREZJzUQ3PLIS">/files/xD4DhCaJREZJzUQ3PLIS</a></td></tr></tbody></table>

{% hint style="info" icon="screwdriver-wrench" %}
**Comportement du function calling**

Sans le streaming, modèle renvoie un tool call avec un content vide. En streaming, les arguments sont fragmentés sur plusieurs chunks SSE, et le finish\_reason: "tool\_calls" arrive dans un chunk distinct qui ne contient plus de tool\_calls.
{% endhint %}

</details>

<details>

<summary>mistral-small-3-2-24b-instruct-2506</summary>

<a href="https://huggingface.co/mistralai/Mistral-Small-3.2-24B-Instruct-2506" class="button secondary">Model card</a> <a href="https://albert.playground.etalab.gouv.fr" class="button primary">Essayer dans Playground</a>

|                             |                                                                      |
| --------------------------- | -------------------------------------------------------------------- |
| **Nombre de paramètres**    | 24B                                                                  |
| **Type**                    | `text-generation`                                                    |
| **Licence**                 | Apache 2.0                                                           |
| **Aliases**                 | `mistralai/Mistral-Small-3.2-24B-Instruct-2506`, `openweight-medium` |
| **Format d'entrées**        | `text`, `image`                                                      |
| **Fenêtre de contexte**     | 131072                                                               |
| **Température recommandée** | 0.15                                                                 |

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Chat</strong></td><td>/v1/chat/completions</td><td><a href="/pages/3acxJLpbqGiB6WyVxzAt">/pages/3acxJLpbqGiB6WyVxzAt</a></td><td><a href="/files/SesZhxIhNTk7H6sTC8LV">/files/SesZhxIhNTk7H6sTC8LV</a></td></tr><tr><td><strong>Analyse d'image</strong></td><td>/v1/chat/completions</td><td><a href="/pages/3acxJLpbqGiB6WyVxzAt">/pages/3acxJLpbqGiB6WyVxzAt</a></td><td><a href="/files/SdJhTgDjiodb5fffxr9H">/files/SdJhTgDjiodb5fffxr9H</a></td></tr><tr><td><strong>Function calling</strong></td><td>/v1/chat/completions</td><td><a href="/pages/OhzjWruOdgzEzmBLrCvn">/pages/OhzjWruOdgzEzmBLrCvn</a></td><td><a href="/files/xD4DhCaJREZJzUQ3PLIS">/files/xD4DhCaJREZJzUQ3PLIS</a></td></tr></tbody></table>

{% hint style="info" icon="screwdriver-wrench" %}
**Comportement du function calling**

Sans le streaming, modèle renvoie un tool call avec un content vide. En streaming, les arguments sont fragmentés sur plusieurs chunks SSE, et le finish\_reason: "tool\_calls" arrive dans un chunk distinct qui ne contient plus de tool\_calls.
{% endhint %}

</details>

<details>

<summary>mistral-medium-2508 <img src="https://img.shields.io/badge/mod%C3%A8le_partenaire-red" alt="modèle partenaire"></summary>

{% hint style="warning" %}
Ce modèle accessible uniquement aux ministères partenaires qui en font la demande. Pour en savoir plus, consultez la page [Tarifs et limites](https://ia.numerique.gouv.fr/outils-ia/albert-api/tarifs-et-limites/) de notre site.

Vous pouvez utiliser le modèle `gpt-oss-120b` comme alternative à ce modèle.
{% endhint %}

<a href="https://docs.mistral.ai/models/model-cards/mistral-medium-3-1-25-08" class="button secondary">Model card</a>

|                          |                       |
| ------------------------ | --------------------- |
| **Nombre de paramètres** | 123B                  |
| **Type**                 | `text-generation`     |
| **Licence**              | `propriétaire`        |
| **Aliases**              | `mistral-medium-2508` |
| **Format d'entrées**     | `text`, `image`       |
| **Fenêtre de contexte**  | 131072                |

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Chat</strong></td><td>/v1/chat/completions</td><td><a href="/pages/3acxJLpbqGiB6WyVxzAt">/pages/3acxJLpbqGiB6WyVxzAt</a></td><td><a href="/files/SesZhxIhNTk7H6sTC8LV">/files/SesZhxIhNTk7H6sTC8LV</a></td></tr><tr><td><strong>Analyse d'image</strong></td><td>/v1/chat/completions</td><td><a href="/pages/3acxJLpbqGiB6WyVxzAt">/pages/3acxJLpbqGiB6WyVxzAt</a></td><td><a href="/files/SdJhTgDjiodb5fffxr9H">/files/SdJhTgDjiodb5fffxr9H</a></td></tr><tr><td><strong>Tool calling</strong></td><td>/v1/chat/completions</td><td><a href="/pages/OhzjWruOdgzEzmBLrCvn">/pages/OhzjWruOdgzEzmBLrCvn</a></td><td><a href="/files/xD4DhCaJREZJzUQ3PLIS">/files/xD4DhCaJREZJzUQ3PLIS</a></td></tr></tbody></table>

{% hint style="info" icon="screwdriver-wrench" %}
**Comportement du function calling**

Sans le streaming, modèle renvoie un tool call avec un content vide. En streaming, quand le tool call est valide, le tool call arrive en un seul chunk qui porte aussi la finish\_reason.
{% endhint %}

</details>

<details>

<summary>mistral-ocr-2512 <img src="https://img.shields.io/badge/mod%C3%A8le_partenaire-red" alt="modèle partenaire"></summary>

Modèle d'OCR compatible avec la pile Document AI de Mistral (`/v1/ocr`) permettant d’extraire du texte et des images entremêlés.

{% hint style="warning" %}
Ce modèle accessible uniquement aux ministères partenaires qui en font la demande. Pour en savoir plus, consultez la page [Tarifs et limites](https://ia.numerique.gouv.fr/outils-ia/albert-api/tarifs-et-limites/) de notre site.

Vous pouvez utiliser le modèle `lightonocr-2-1b` comme alternative à ce modèle.
{% endhint %}

<a href="https://mistral.ai/news/mistral-ocr-3/" class="button secondary">Model card</a> <a href="https://albert.playground.etalab.gouv.fr" class="button primary">Essayer dans Playground</a>

|                          |                    |
| ------------------------ | ------------------ |
| **Nombre de paramètres** | 3B                 |
| **Type**                 | `image-to-text`    |
| **Licence**              | `propriétaire`     |
| **Aliases**              | `mistral-ocr-2512` |
| **Fenêtre de contexte**  | 16384              |

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Mistral Document AI</strong></td><td>/v1/ocr</td><td><a href="https://github.com/betagouv/doc.albert-api/tree/main/guides/mistral-document-ai.md">https://github.com/betagouv/doc.albert-api/tree/main/guides/mistral-document-ai.md</a></td><td><a href="/files/QQJ42DkGyVMBXPFShTsO">/files/QQJ42DkGyVMBXPFShTsO</a></td></tr></tbody></table>

</details>

<details>

<summary>gpt-oss-120b</summary>

MoE généraliste de grande taille pour des tâches de complexes.

<a href="https://huggingface.co/openai/gpt-oss-120b" class="button secondary">Model card</a> <a href="https://albert.playground.etalab.gouv.fr" class="button primary">Essayer dans Playground</a>

|                                 |                                           |
| ------------------------------- | ----------------------------------------- |
| **Nombre de paramètres**        | 117B                                      |
| **Nombre de paramètres actifs** | 5.1B                                      |
| **Type**                        | `text-generation`                         |
| **Licence**                     | Apache 2.0                                |
| **Aliases**                     | `openai/gpt-oss-120b`, `openweight-large` |
| **Fenêtre de contexte**         | 131072                                    |

{% hint style="success" icon="lightbulb" %}
Les tokens de raisonnement consomment le budget `max_tokens` : prévoyez une marge confortable même pour des réponses courtes (> 1024 tokens).
{% endhint %}

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Chat</strong></td><td>/v1/chat/completions</td><td><a href="/pages/3acxJLpbqGiB6WyVxzAt">/pages/3acxJLpbqGiB6WyVxzAt</a></td><td><a href="/files/SesZhxIhNTk7H6sTC8LV">/files/SesZhxIhNTk7H6sTC8LV</a></td></tr><tr><td><strong>Reasoning</strong></td><td>/v1/chat/completions</td><td><a href="https://github.com/betagouv/doc.albert-api/tree/main/guides/reasoning.md">https://github.com/betagouv/doc.albert-api/tree/main/guides/reasoning.md</a></td><td><a href="/files/55xNigdE1dWPbg5plV7N">/files/55xNigdE1dWPbg5plV7N</a></td></tr><tr><td><strong>Function calling</strong></td><td>/v1/chat/completions</td><td><a href="/pages/OhzjWruOdgzEzmBLrCvn">/pages/OhzjWruOdgzEzmBLrCvn</a></td><td><a href="/files/xD4DhCaJREZJzUQ3PLIS">/files/xD4DhCaJREZJzUQ3PLIS</a></td></tr></tbody></table>

{% hint style="info" icon="screwdriver-wrench" %}
**Comportement du function calling**

Sans le streaming, modèle renvoie un tool call avec un content vide. En streaming, les arguments sont fragmentés sur plusieurs chunks SSE, et le finish\_reason: "tool\_calls" arrive dans un chunk distinct qui ne contient plus de tool\_calls.
{% endhint %}

</details>

<details>

<summary>whisper-large-v3</summary>

<a href="https://huggingface.co/openai/whisper-large-v3" class="button secondary">Model card</a> <a href="https://transcripts.numerique.gouv.fr/" class="button primary">Essayer dans Transcripts</a>

|                          |                                               |
| ------------------------ | --------------------------------------------- |
| **Nombre de paramètres** | 1.55B                                         |
| **Type**                 | `automatic-speech-recognition`                |
| **Licence**              | Apache 2.0                                    |
| **Aliases**              | `openai/whisper-large-v3`, `openweight-audio` |
| **Fenêtre de contexte**  | Fichier audio jusqu'à 20 MB                   |

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Transcription</strong></td><td>/v1/audio/transcriptions</td><td><a href="https://github.com/betagouv/doc.albert-api/tree/main/guides/audio-transcriptions.md">https://github.com/betagouv/doc.albert-api/tree/main/guides/audio-transcriptions.md</a></td><td><a href="/files/a1Z1gRHaoAxhtUNn8qe5">/files/a1Z1gRHaoAxhtUNn8qe5</a></td></tr><tr><td><strong>Diarization</strong></td><td>/v1/audio/transcriptions</td><td><a href="https://github.com/betagouv/doc.albert-api/tree/main/guides/audio-transcriptions.md">https://github.com/betagouv/doc.albert-api/tree/main/guides/audio-transcriptions.md</a></td><td><a href="/files/9I9VKIpiOqr8uZpkHfJL">/files/9I9VKIpiOqr8uZpkHfJL</a></td></tr></tbody></table>

</details>

<details>

<summary>qwen3-vl-embedding-8b <img src="https://img.shields.io/badge/mod%C3%A8le_en_exp%C3%A9rimentation-green" alt="modèle en expérimentation"></summary>

Embeddings multimodaux (texte, images, captures d’écran, vidéos).

{% hint style="warning" %}
Ce modèle est en phase d'expérimentation du 26 juillet 2026 au 1er octobre 2026. A l'issue de cette phase d'expérimentation nous évaluarons a l'aide de vos retours si le modèle est viable pour une intégration pérenne dans Albert API.
{% endhint %}

<a href="https://huggingface.co/Qwen/Qwen3-VL-Embedding-8B" class="button secondary">Model card</a>

|                                     |                              |
| ----------------------------------- | ---------------------------- |
| **Nombre de paramètres**            | 8B                           |
| **Type**                            | `text-embeddings-inference`  |
| **Licence**                         | Apache 2.0                   |
| **Aliases**                         | `Qwen/Qwen3-VL-Embedding-8B` |
| **Fenêtre de contexte**             | 32768                        |
| **Dimension maximale des vecteurs** | 4096\*                       |

\*La dimension des vecteurs n'est pas modifiable avec ce modèle.

{% hint style="warning" %}
Ne mélangez pas les vecteurs générés par ce modèle avec un autre modèle d'embeddings : ils ne sont pas comparables.
{% endhint %}

### Capacités

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Text vectorisation</strong></td><td>/v1/embeddings</td><td><a href="/pages/LbydQJgYBBO7rdUe58mx">/pages/LbydQJgYBBO7rdUe58mx</a></td><td><a href="/files/0iVLlMVCem7q4Lw4nzaM">/files/0iVLlMVCem7q4Lw4nzaM</a></td></tr></tbody></table>

</details>

<details>

<summary>qwen3-coder-30b-a3b-instruct</summary>

<a href="https://huggingface.co/Qwen/Qwen3-Coder-30B-A3B-Instruct" class="button secondary">Model card</a> <a href="https://albert.playground.etalab.gouv.fr" class="button primary">Essayer dans Playground</a>

|                                 |                                                        |
| ------------------------------- | ------------------------------------------------------ |
| **Nombre de paramètres**        | 30.5B                                                  |
| **Nombre de paramètres actifs** | 3.3B                                                   |
| **Type**                        | `text-generation`                                      |
| **Licence**                     | Apache 2.0                                             |
| **Aliases**                     | `Qwen/Qwen3-Coder-30B-A3B-Instruct`, `openweight-code` |
| **Fenêtre de contexte**         | 262144                                                 |

MoE orienté code / agentic coding (function calling).

### Capacités

{% hint style="info" icon="screwdriver-wrench" %}
**Comportement du function calling**

Sans le streaming, modèle renvoie un tool call avec un content non vide. En streaming, quand le tool call est valide, les arguments sont fragmentés sur plusieurs chunks SSE, et le finish\_reason: "tool\_calls" arrive dans un chunk distinct qui ne contient plus de tool\_calls.
{% endhint %}

<table data-view="cards"><thead><tr><th></th><th></th><th data-hidden data-card-target data-type="content-ref"></th><th data-hidden data-card-cover data-type="files"></th></tr></thead><tbody><tr><td><strong>Code</strong></td><td>/v1/chat/completions</td><td><a href="/pages/8tjN7kdd7kRpzlNlPJ5O">/pages/8tjN7kdd7kRpzlNlPJ5O</a></td><td><a href="/files/Duw7IH4xAEQhElL2S3x0">/files/Duw7IH4xAEQhElL2S3x0</a></td></tr><tr><td><strong>Function calling</strong></td><td>/v1/chat/completions</td><td><a href="/pages/OhzjWruOdgzEzmBLrCvn">/pages/OhzjWruOdgzEzmBLrCvn</a></td><td><a href="/files/xD4DhCaJREZJzUQ3PLIS">/files/xD4DhCaJREZJzUQ3PLIS</a></td></tr></tbody></table>

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://guides.ia.numerique.gouv.fr/albert-api/modeles/available-models.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
