Benchmark menu

Model detail

LongCat 2.0

A static, shareable model page that remains complete without JavaScript.

LongCat 2.0

Provider: Other · Public slug: meituan-longcat-2-0

Rank
Partial average — 1/3
Rank movement
Baseline
Score
49.6
Last measured
2026-07-26
Coverage
Intensive not supported; Missing Balanced

Reasoning profile

Available reasoning settings

NoneEnabled

Checked on 2026-07-24 · provider source

Tested reasoning settings

Provider settingScoreEvidenceFilter bracket
None49.6Retained request evidence; eligibleBaseline
Enabled38.9Retained request evidence; eligibleBalanced

Filter assignment status

  • Baseline: None — tested and eligible
  • Balanced: Enabled — tested and eligible
  • Intensive: Unavailable

Generation health

None: 50% / 38% / 12% · n 16 Intensive not supportedMissing Balanced

Cost summary

Mean standard list-price equivalent
$0.02
Median unique-cell cost
$0.02
Unique-cell range
$0.0044–$0.05
Coverage
16 unique cells / 32 observed runs
Observed-run total
$0.78
Evidence basis
Provider-reported
Mean output
18k tok
Output range
2.1k–40k tok
Token samples
32

Cost means equal-weight unique model/game/reasoning cells.

Run setup

  • Overall Models: combines public reasoning variants
  • Standard GameBench code-generation prompt