Raven Model Family · Vélocité de pointe
Raven Flash
L'intelligence de pointe à la vitesse de production
Raven Flash est le modèle de pointe à haute vélocité de la famille Raven, conçu pour une faible latence, des agents autonomes réactifs et une exécution de code à haute fréquence, sans compromis sur la précision. Il diffuse un raisonnement inspectable et des complétions en temps réel.
Caractéristiques
| API model ID | raven-flash |
| Modalities | Texte + vision |
| Context window | 1 M de jetons |
| Output limit | 128 K de jetons |
| Tool use | Appel de fonctions natif |
| Input price | 0,50 $ US / 1 M de jetons (0,05 $ US en cache) |
| Output price | undefined |
| Release date | 1er octobre 2026 |
| Reasoning controls | reasoning_effort low ou high, valeur par défaut si omis, avec un flux de raisonnement inspectable |
Les prix sont par 1 M de jetons, en dollars US. Consultez la page des tarifs pour les plans et les paquets de crédits.
Charges de travail clés
Codage autonome dans DCode · Clavardage interactif · Pipelines CI/CD · Classification à haut volume
De la même famille
Raven Max ajoute un raisonnement profond à long horizon pour les décisions où la précision est critique.
Découvrir Raven MaxÉvaluation empirique
Résultats de bancs d'essai, tels que publiés.
Évaluée avec l'effort de raisonnement maximal activé sur les bancs d'essai standards de l'industrie. Source : rapport technique de Dipole ML (octobre 2026).
| Banc d'essai | Raven Flash | Rang | Meilleur pair |
|---|---|---|---|
| Terminal Bench 4.0 | 34.1 | #1 | GPT-5.6 Terra · 24.6 |
| Agent's Last Exam | 26.6 | #2 | Claude Opus 4.8 · 27 |
| AutomationBench | 49.2 | #1 | Claude Opus 4.8 · 41 |
| GDPVal-AA | 1651 | #2 | Claude Opus 4.8 · 1731 |
| DeepSWE v1.1 | 65.4 | #2 | GPT-5.6 Terra · 69.6 |
| Intelligence Index | 43 | tied #1 | Claude Opus 4.8 · 43 |
| HLE w/ Tools | 55.8 | #2 | Claude Opus 4.8 · 57.9 |
| AA-Briefcase v1.1 | 1462 | #2 | Claude Opus 4.8 · 1480 |
Lisez l'évaluation complète dans le rapport de performance, ou voir toute la famille comparée.
Mettez Raven Flash au travail.
Disponible dans l'application Raven, dans DCode et par l'API DipoleML compatible OpenAI.