163
Total
18
Gratuits
19
Démo
101
Économiques
25
Catalog
Colonnes :
HA = niveau Hermes Agent (Excellent≥128k ctx+code S/A, Bon≥64k, Moyen≥64k mais code faible, Faible<64k) ·
Code = niveau code (S=excellent agent/code/tool-calling, A=très bon dev, B=correct, C=second choix) ·
Usage = cas d'usage principal ·
Nous ≈ prix estimé via abonnement Portal (route via OpenRouter) ·
Benchmarks : SWE-b=Résolution bugs réels sur GitHub, BFCL=Function Calling (Berkeley), Aider=Édition code multi-langage, LCB=LiveCodeBench génération, MMLU=MMLU-Pro raisonnement expert.
Tous les modèles
| # | Modèle | Cat. | OR $/1M | GO $/1M | Nous | Ctx | HA | Code | SWE-b | BFCL | Aider | LCB | MMLU | Usage |
|---|
Comparaison inter-providers
💰 Comment lire les prix
OpenRouter (OR) — Pay-per-token. Prix affichés : $/1M tokens input/output.
OpenCode GO — Abonnement $10/mois (6x valeur incluse = ~$60 d'usage). Prix affichés = tarif réel par token.
Nous Research — Abonnement Portal. Prix = inclus dans l'abonnement, pas de facturation par token.
📊 Exemples cross-provider
- mimo-v2.5 — Identique partout : $0.14/$0.28. Sur OpenCode GO : ~150 000 requêtes incluses.
- deepseek-v4-pro — OR: $0.43/$0.87 · GO: $0.435/$0.87. Prix quasi identiques.
- kimi-k3 — Cher ($3/$15). Sur GO: $10/mois = ~490 requêtes. Sur OR pay-per-token = plus cher en volume.
- Nous Portal — Tous les modèles du catalogue (Claude, GPT-5.6, Gemini, etc.) inclus dans l'abonnement. Meilleur rapport pour les premium.
Recommandations pour Hermes Agent
📋 Critères de sélection (règles de l'art)
Sources : documentation Hermes Agent, BFCL v4, SWE-bench Verified, Confident AI.
- 1. Function Calling (BFCL ≥ 75) — Le modèle doit identifier correctement les outils, paramétrer les appels, séquencer les actions. Score < 70 = agent qui boucle.
- 2. Contexte ≥ 128k tokens — Les boucles multi-tours accumulent rapidement le contexte. En dessous = timeout.
- 3. Code (SWE-bench ≥ 40%) — La majorité des tâches agent impliquent du code. Mesure la résolution de bugs réels.
- 4. Coût (≤ $1/tâche) — 30-100+ appels API par tâche. À $10/1M output = $0.10/tâche. À $50/1M (Opus) = $0.50.
- 5. Raisonnement (MMLU-Pro ≥ 80) — Planification multi-étapes exige un raisonnement solide.
🏆 Top 3 — Meilleurs pour Hermes Agent (juillet 2026)
- deepseek/deepseek-v4-pro — Code S, BFCL 82.1, SWE-b 55.2, 1M ctx, $0.43/$0.87. Meilleur rapport capacité/prix. OR + GO + Nous.
- xiaomi/mimo-v2.5 — Code S, BFCL 78.3, SWE-b 48.5, 1M ctx, $0.14/$0.28. Roi du volume : ~150k requêtes/mois sur GO.
- qwen/qwen3.7-max — BFCL 81.2, SWE-b 54.0, 1M ctx, $2.50/$7.50. Raisonnement haut niveau. Inclus Nous Portal.
🔥 Buzzing (réseaux sociaux, juillet 2026)
- xiaomi/mimo-v2.5 — "The people's champion" sur Twitter/X. Performance exceptionnelle, prix ridicule.
- qwen/qwen3-coder-30b-a3b-instruct — $0.07/$0.27 pour du code S-tier. Favori Reddit pour agents budget.
- deepseek/deepseek-v4-flash — $0.10/$0.20, 1M ctx, code A. Choix pragmatique des labos indie.
💡 Choix pragmatiques
- Tests rapides → free (nemotron-3-super, gpt-oss-20b:free) + fallback cheap.
- Dév économique → deepseek-v4-flash ou mimo-v2.5. 1M ctx, code A/S.
- Code sérieux → deepseek-v4-pro ou claude-opus-4.8. Fiabilité supérieure.
- Volume massif → Nous Portal. Tous les premium inclus. Coût marginal → 0.