Catalogue de modèles
Un catalogue mis à jour au fil des sorties et des évolutions de spécifications. Les analyses de fond sont dans les guides de décision : choisir un modele et deployer des modeles.
Catalogue
Le palier raisonnement intensif : meilleure cohérence d'objectif sur les longues exécutions agentiques et le code le plus difficile. Son prix le réserve aux étapes qui en ont vraiment besoin, pas au nœud par défaut.
Le workhorse de production : sortie structurée fiable et cohérence soutenue sur de longues tâches, à une fraction du coût frontier. Notre choix par défaut pour la plupart des nœuds d'agent.
Le routeur rapide et bon marché : latence sous la seconde à une fraction du prix du workhorse. Idéal pour la classification, le tri et le volet économique d'une stratégie de routing.
Un modèle frontier à accès restreint, capacité cybersécurité exceptionnelle, ouvert aux seuls défenseurs vérifiés (Project Glasswing). Cas d'école : ce modèle justifie sa propre page.
La principale alternative frontier à Claude : sortie structurée et tool calling très fiables, large capacité généraliste. Azure offre un hébergement en région EU.
Multimodal natif et la plus longue fenêtre de contexte du tier fermé. Vertex AI offre des régions EU pour les charges sensibles à la résidence des données.
La référence open-weight, avec le plus grand écosystème et l'outillage le plus riche. La licence n'est pas open-source OSI : plafond d'utilisateurs actifs et conditions EU, à lire avant tout projet.
La ligne open-weight permissive la plus forte : Apache-2.0, excellent en code, couverture linguistique très large, des tailles du frontier au small. Le choix commercial sans accroc.
Leader open-weight du raisonnement et du coding agentique sous licence MIT, les termes les plus nets pour un usage commercial sans restriction. Solide sur les tâches type SWE-bench.
L'option EU-native : modèles ouverts sous Apache-2.0 et flagships hébergés, hébergement EU sans transfert vers un pays tiers. Le choix naturel quand la souveraineté prime.
Une licence MIT propre et un faible nombre de paramètres actifs en font l'une des options self-hosted entièrement ouvertes les moins chères en charge continue.
Un sérieux candidat open-weight agentique et long-contexte, en tête d'indices de capacité neutres. Lourd à auto-héberger, souvent consommé en managé.
La petite famille open-weight de Google, remarquablement économe en RAM. La référence pour l'on-device et le multimodal mobile, quand quelques gigaoctets sont tout le budget.
De petits modèles qui surpassent leur taille en raisonnement, sous licence MIT. Quantisés à quelques gigaoctets, ils font tourner un assistant compétent sur un laptop ou un téléphone, hors ligne.