Corollary

Research

  • Ask

Library

  • Catalog

Account

  • Overview
  • Jobs
  • Usage
  • Billing
Settings
Corollary
  1. Catalog
  2. Datasets
  3. SAIRfoundation/equational-theories-benchmark

SAIRfoundation

equational-theories-benchmark

Full benchmark suite of equational theory problems spanning algebraic structures, designed to evaluate formal reasoning capabilities of AI models.

Original source
Rows
120,185
On disk
615 MB
Downloads
129

Last 30 days

Updated
Apr 5

Explore

Read the real rows without downloading anything

Reading rows…

LiveRead from SAIRfoundation/equational-theories-benchmark at the moment you asked. Nothing is cached or stored — every row above came from that request.

Column statistics

How the columns are distributed

Over 6 rows of benchmarks/train

benchmark_id

string_label
  • normal_200_common_25_default_reason17%
  • hard_200_common_25_default_reason17%
  • hard_200_common_25_low_reason17%

cheatsheet_mode

string_label

Splits

6
  • benchmarks/train
  • cells/train
  • leaderboard/train
  • models/train
  • prompt_templates/train
  • runs/train

Query support

  • Row preview
  • Paginated browse
  • Full-text search
  • SQL filter
  • Column statistics

Provenance

Licence
—
Likes
9
  • none100%

model_count

int
min
25
median
25
mean
25
max
25

problem_count

int
min
200
median
200
mean
200
max
200

problem_source_dataset

string_label
  • SAIRfoundation/equational-theories-selected-problems100%

problem_subset

string_label
  • hard233%
  • normal33%
  • hard33%

reasoning_mode

string_label
  • low_or_none50%
  • default50%

repeat_count

int
min
3
median
3
mean
3
max
3

temperature_mode

string_label
  • low50%
  • default50%

template_id

string_label
  • evaluation100%

template_path

string_label
  • prompts/evaluation.jinja2100%

Fields

MathematicsScientific ReasoningBenchmark