Rapport de performance de Raven Flash : vélocité inférieure à la seconde et n°1 sur AutomationBench
Raven Flash prend le n°1 sur AutomationBench (49,2), mène le palier de vélocité sur Terminal Bench 4.0 (34,1) et égale le n°1 à l'Intelligence Index, à 0,50 $ US / 1 M de jetons d'entrée.
Raven Flash est notre modèle de pointe à haute vélocité : conçu pour une faible latence, des agents autonomes réactifs et une exécution de code à haute fréquence, sans compromis sur la précision. Ce rapport présente son évaluation empirique, menée avec l'effort de raisonnement maximal activé, face aux modèles de pointe actuels.
n°1 sur AutomationBench
Sur AutomationBench, qui mesure l'accomplissement autonome de tâches de bout en bout, Raven Flash obtient 49,2, devançant Claude Opus 4.8 de 8,2 points :
n°1 du palier de vélocité sur Terminal Bench 4.0
Sur Terminal Bench 4.0, Raven Flash obtient 34,1 dans le palier de vélocité, devant GPT-5.6 Terra à 24,6 et Claude Opus 4.8 à 21,7 :
Résultats marquants
| Banc d'essai | Raven Flash | Meilleur pair | Marge |
|---|---|---|---|
| AutomationBench | 49,2 (n°1) | Claude Opus 4.8 · 41,0 | +8,2 |
| Terminal Bench 4.0 (palier de vélocité) | 34,1 (n°1) | GPT-5.6 Terra · 24,6 | +9,5 |
| Intelligence Index | 43 (égalité n°1) | Claude Opus 4.8 · 43 | égalité |
Pourquoi Flash gagne en vélocité
Raven Flash partage l'exécution d'outils native et les flux de raisonnement inspectables de la famille Raven, accordés pour des premiers jetons en moins d'une seconde. Son avantage se voit dans les boucles agentiques : planifier, appeler un outil, lire le résultat, réviser et continuer, sans que le modèle perde le fil entre les étapes. Sur les charges à haute fréquence, ce rythme se cumule jusqu'aux marges ci-dessus.
Économie de production
La vélocité n'est utile que si elle est abordable. Raven Flash facture 0,50 $ US / 1 M de jetons d'entrée, 0,05 $ US / 1 M en cache et 2,50 $ US / 1 M en sortie, avec escomptes automatiques de mise en cache à la passerelle. Les tarifs complets sont sur la page des tarifs.
Toutes les évaluations sont menées avec l'effort de raisonnement maximal activé. La méthodologie complète et les autres bancs d'essai figurent sur la fiche du modèle Raven Flash et sur la page des modèles.
Pour commencer
Essayez ce que nous venons de lancer.
Les vrais modèles, gratuitement dans votre navigateur, ou téléchargez DCode et mettez-les au travail.
Articles connexes
Présentation de la cohorte des membres fondateurs : accélérer l'intelligence autonome
La cohorte de lancement limitée pour les membres fondateurs est ouverte : des prix annuels de première année verrouillés sur Pro, Ultra et DCode, plus un badge doré permanent.
Raisonnement inspectable et confidentialité sans rétention : au coeur du système Raven
Une plongée technique dans le système qui entoure la famille de modèles Raven : flux de raisonnement transparents, rétention de données nulle, chiffrement DEK côté client et défense contre l'injection de requête.
La passerelle API de Dipole ML : double compatibilité native pour les SDK OpenAI et Anthropic
L'API DipoleML sur api.dipoleml.com parle nativement les deux formats de SDK, OpenAI et Anthropic : migrer se résume à changer une ligne d'URL de base, sans réécrire de code.