Docs
Search
Ctrl K
Models
Chat
Compare
Providers
Apps
Rankings
BrowseComp Long Context 256k Benchmark Leaderboard | Phaseo
BrowseComp Long Context 256k
BrowseComp Long Context 256k
AI benchmark results and model performance
Summary
▼
Summary
▼
Type: numerical
Reasoning
Recorded Results
1
Average Score
0.90
Score Range
0.90 - 0.90
Leading Model (lowest score)
0.90 - GPT 5.2 Chat
Scores Over Time
Individual benchmark scores plotted by date.
Models Using This Benchmark
Organisation
Model
Reported
Top Score
Info
Self Reported
Source
OpenAI
GPT 5.2 Chat
11 Dec 2025
0.90
inferred alias from gpt-5.2-2025-12-11
Yes
Source
Sign Up
Sign Up