Aller au contenu
WorkBench.ai

Modèle

Kimi K3 évalué sur le seul benchmark du hub

Sorti le 16 juillet 2026, Kimi K3 (Moonshot AI) entre dans les classements du hub : son rang à l'indice métier, ses métiers forts et faibles, son coût et son taux d'hallucinations.

Compte rendu rédigé par le hub à partir des classements publiés : chaque phrase est calculée, aucune n'est une opinion.

  • 6e sur 27 à l'indice métier, avec 99,8 % (marge d'erreur à 95 % : ± 0,7 point).
  • 0,2 point d'indice de moins que Kimi K2.6, son prédécesseur chez Moonshot AI, sorti le 20 avril 2026. L'écart est inférieur à la marge d'erreur : les deux modèles ne sont pas départagés.
  • Coût moyen par test : 0,021 $, le 22e moins cher des 27 modèles dont le tarif est connu.
  • Taux d'hallucinations moyen : 1,0 %, la part des éléments absents de la source pour lesquels il a inventé une valeur.
  • Il a passé le seul benchmark publié du hub.

Scores par métier

Exactitude moyenne du modèle sur les benchmarks de chaque métier qu'il a passés.

MétierScore
FinanceNon testé
Comptabilité99,8 %
Ressources humainesNon testé
JuridiqueNon testé
CommercialNon testé
MarketingNon testé
Service clientNon testé
Achats & logistiqueNon testé
InformatiqueNon testé
DirectionNon testé
Indice métier99,8 %