Appearance
← Back to Benchmarks
Model Detail

Claude Sonnet 4.6

Perfect messaging score and strong external benchmark presence suggest a very solid general-purpose model.

100/100 Benchmark score
Safe strong all-rounder
Rank
#1 of 13
Source
Messaging benchmark + external canon
Run date
01 · Benchmark score 100/100
02 · Source Messaging benchmark + external canon
03 · Role Safe strong all-rounder
Per-suite breakdown

Scorecard

Operator board #1

100/100 operator score

Messaging 100/100

Messaging Tool Planning v2

External canon 79.6 SWE-bench

Public benchmark references

Cost $9.00/M blended

Strong all-rounder, needs full internal operator-suite run.

Strengths
  • Perfect messaging benchmark score
  • Strong external coding benchmarks
  • Good likely all-round fit
Weaknesses
  • Still missing hard operator-suite run in this recovered data set
Operator read

Perfect messaging score and strong external benchmark presence suggest a very solid general-purpose model.

Comparison

Where Claude Sonnet 4.6 lands

OperatorIndex
Source artifacts

Raw machine-readable files for anyone who wants to dig deeper or run their own analysis.

  • internal artifact memory/model-benchmark-reference.md