Aller au contenu
WorkBench.ai

Modèle

Muse Spark 1.3 évalué sur le seul benchmark du hub

Sorti le 2 septembre 2026, Muse Spark 1.3 (Meta) entre dans les classements du hub : son rang à l'indice métier, ses métiers forts et faibles, son coût et son taux d'hallucinations.

Compte rendu rédigé par le hub à partir des classements publiés : chaque phrase est calculée, aucune n'est une opinion.

  • 5e sur 27 à l'indice métier, avec 100,0 % (marge d'erreur à 95 % : ± 0,0 point).
  • 1,7 point d'indice de plus que Llama 4 Maverick, son prédécesseur chez Meta, sorti le 5 avril 2025. L'écart est inférieur à la marge d'erreur : les deux modèles ne sont pas départagés.
  • Coût moyen par test : 0,013 $, le 18e moins cher des 27 modèles dont le tarif est connu.
  • Taux d'hallucinations moyen : 0,0 %, la part des éléments absents de la source pour lesquels il a inventé une valeur.
  • Il a passé le seul benchmark publié du hub.

Scores par métier

Exactitude moyenne du modèle sur les benchmarks de chaque métier qu'il a passés.

MétierScore
FinanceNon testé
Comptabilité100,0 %
Ressources humainesNon testé
JuridiqueNon testé
CommercialNon testé
MarketingNon testé
Service clientNon testé
Achats & logistiqueNon testé
InformatiqueNon testé
DirectionNon testé
Indice métier100,0 %