{
  "url": "https://www.aibattle.space/models/gpt-5-6-luna",
  "slug": "gpt-5-6-luna",
  "name": "GPT-5.6 Luna (max)",
  "creator": "OpenAI",
  "rebuilt": "2026-09-19",
  "placements": [
    {
      "dataset": "Cost per Task",
      "rank": 1,
      "total": 11,
      "value": 0.17829726152289094
    },
    {
      "dataset": "Cost per Task",
      "rank": 1,
      "total": 11,
      "value": 0.17829726152289094
    },
    {
      "dataset": "Pricing: Cache Hit, Input, and Output",
      "rank": 3,
      "total": 20,
      "value": 0.2
    },
    {
      "dataset": "Pricing: Cache Hit, Input, and Output",
      "rank": 3,
      "total": 20,
      "value": 0.2
    },
    {
      "dataset": "AA-Briefcase Cost per Task",
      "rank": 3,
      "total": 20,
      "value": 0.0510096
    },
    {
      "dataset": "AA-LCR v1.1: Cost per Task",
      "rank": 3,
      "total": 20,
      "value": 0.018867176
    },
    {
      "dataset": "𝜏³-Banking: Cost per Task",
      "rank": 3,
      "total": 20,
      "value": 0
    },
    {
      "dataset": "SciCode: Cost per Task",
      "rank": 3,
      "total": 20,
      "value": 0.0005590069444444444
    },
    {
      "dataset": "Cost per Intelligence Index Task",
      "rank": 4,
      "total": 20,
      "value": 0.004640576617249952
    },
    {
      "dataset": "Cost per Intelligence Index Task",
      "rank": 4,
      "total": 20,
      "value": 0.004640576617249952
    },
    {
      "dataset": "GDPval-AA v2: Cost per Task",
      "rank": 4,
      "total": 20,
      "value": 0
    },
    {
      "dataset": "MMMU-Pro: Total Cost to Run",
      "rank": 4,
      "total": 19,
      "value": 0.5919506
    },
    {
      "dataset": "Cost to Run Artificial Analysis Intelligence Index",
      "rank": 5,
      "total": 20,
      "value": 22.0173816
    },
    {
      "dataset": "Cost to Run Artificial Analysis Intelligence Index",
      "rank": 5,
      "total": 20,
      "value": 22.0173816
    },
    {
      "dataset": "Terminal-Bench v4.0: Cost per Task",
      "rank": 5,
      "total": 20,
      "value": 0
    },
    {
      "dataset": "Humanity's Last Exam: Cost per Task",
      "rank": 6,
      "total": 20,
      "value": 0.00006208915662650603
    },
    {
      "dataset": "𝜏³-Banking: Output Tokens per Task",
      "rank": 6,
      "total": 20,
      "value": 2074.556701030928
    },
    {
      "dataset": "GDPval-AA v2: Output Tokens per Task",
      "rank": 7,
      "total": 20,
      "value": 18049.25909090909
    },
    {
      "dataset": "Speed",
      "rank": 4,
      "total": 11,
      "value": 116.250773594386
    },
    {
      "dataset": "Speed",
      "rank": 4,
      "total": 11,
      "value": 116.250773594386
    },
    {
      "dataset": "Context Window",
      "rank": 8,
      "total": 20,
      "value": 1000000
    },
    {
      "dataset": "Output Speed",
      "rank": 8,
      "total": 20,
      "value": 116.250773594386
    },
    {
      "dataset": "Output Speed",
      "rank": 8,
      "total": 20,
      "value": 116.250773594386
    },
    {
      "dataset": "AA-LCR v1.1: Time per Task",
      "rank": 8,
      "total": 20,
      "value": 0.2529485830631411
    },
    {
      "dataset": "AA-Omniscience Index: Cost Breakdown",
      "rank": 9,
      "total": 20,
      "value": 0.143398
    },
    {
      "dataset": "AA-Briefcase Output Tokens per Task",
      "rank": 9,
      "total": 20,
      "value": 42508
    },
    {
      "dataset": "𝜏³-Banking: Time per Task",
      "rank": 9,
      "total": 20,
      "value": 1.3001311208792061
    },
    {
      "dataset": "Time per Intelligence Index Task",
      "rank": 10,
      "total": 20,
      "value": 6.1003708545578235
    },
    {
      "dataset": "Time per Intelligence Index Task",
      "rank": 10,
      "total": 20,
      "value": 6.1003708545578235
    },
    {
      "dataset": "AA-LCR v1.1: Output Tokens per Task",
      "rank": 10,
      "total": 20,
      "value": 80.78
    },
    {
      "dataset": "AA-LCR v1.1: Score",
      "rank": 10,
      "total": 20,
      "value": 0.836666666666667
    },
    {
      "dataset": "Output Tokens per Intelligence Index Task",
      "rank": 11,
      "total": 20,
      "value": 13136.33788999603
    },
    {
      "dataset": "Output Tokens per Intelligence Index Task",
      "rank": 11,
      "total": 20,
      "value": 13136.33788999603
    },
    {
      "dataset": "Terminal-Bench v4.0: Time per Task",
      "rank": 13,
      "total": 20,
      "value": 19.802575807076305
    },
    {
      "dataset": "MMMU-Pro: Score",
      "rank": 13,
      "total": 19,
      "value": 0.785549132947977
    },
    {
      "dataset": "AA-Briefcase Elo",
      "rank": 14,
      "total": 20,
      "value": 1339.38
    },
    {
      "dataset": "GDPval-AA v2 Leaderboard",
      "rank": 14,
      "total": 20,
      "value": 1489.33
    },
    {
      "dataset": "AA-Briefcase Elo",
      "rank": 14,
      "total": 20,
      "value": 1339.38
    },
    {
      "dataset": "Artificial Analysis Intelligence Index by Open Weights / Proprietary",
      "rank": 15,
      "total": 20,
      "value": 37.5048489690841
    },
    {
      "dataset": "Artificial Analysis Intelligence Index by Open Weights / Proprietary",
      "rank": 15,
      "total": 20,
      "value": 37.5048489690841
    },
    {
      "dataset": "Artificial Analysis Intelligence Index",
      "rank": 15,
      "total": 20,
      "value": 37.5048489690841
    },
    {
      "dataset": "Artificial Analysis Intelligence Index",
      "rank": 15,
      "total": 20,
      "value": 37.5048489690841
    },
    {
      "dataset": "AA-Briefcase Tool Calls Breakdown, Avg per Task",
      "rank": 15,
      "total": 20,
      "value": 47.42857142857143
    },
    {
      "dataset": "Humanity's Last Exam: Output Tokens per Task",
      "rank": 16,
      "total": 20,
      "value": 236.5658016682113
    },
    {
      "dataset": "Humanity's Last Exam: Time per Task",
      "rank": 16,
      "total": 20,
      "value": 3.5992472211775897
    },
    {
      "dataset": "Terminal-Bench v4.0: Output Tokens per Task",
      "rank": 16,
      "total": 20,
      "value": 41118.878787878784
    },
    {
      "dataset": "SciCode: Time per Task",
      "rank": 16,
      "total": 20,
      "value": 1.0740547045997457
    },
    {
      "dataset": "SciCode: Output Tokens per Task",
      "rank": 16,
      "total": 20,
      "value": 419.21180555555554
    },
    {
      "dataset": "MMMU-Pro: Token Usage",
      "rank": 17,
      "total": 19,
      "value": 2959753
    },
    {
      "dataset": "AA-Omniscience Accuracy",
      "rank": 18,
      "total": 20,
      "value": 0.42733333333333334
    },
    {
      "dataset": "SciCode: Score",
      "rank": 18,
      "total": 20,
      "value": 0.53587962962963
    },
    {
      "dataset": "Intelligence",
      "rank": 10,
      "total": 11,
      "value": 37.5048489690841
    },
    {
      "dataset": "Intelligence",
      "rank": 10,
      "total": 11,
      "value": 37.5048489690841
    },
    {
      "dataset": "AA-Briefcase Elo",
      "rank": 19,
      "total": 20,
      "value": 1339.38
    },
    {
      "dataset": "Mean Turns per Task",
      "rank": 19,
      "total": 20,
      "value": 72.74725274725274
    },
    {
      "dataset": "GDPval-AA v2 Leaderboard",
      "rank": 19,
      "total": 20,
      "value": 1489.33
    },
    {
      "dataset": "Humanity's Last Exam: Score",
      "rank": 20,
      "total": 20,
      "value": 0.394810009267841
    },
    {
      "dataset": "Terminal-Bench v4.0: Score",
      "rank": 20,
      "total": 20,
      "value": 0.116161616161616
    }
  ]
}