Loading…

AI Roundtable stats

Aggregate statistics from 31,654 public AI Roundtable sessions, across 359,570 model responses. Snapshot generated 2026-09-20T04:00:34.480Z.

Consensus outcomes

Models reached agreement in 66% of completed sessions (20,699 of 31,573). Breakdown:

Most influential models

Times a model's argument convinced another to flip its vote in Debate mode.

  1. Claude Opus 4.7 — 2,984 flips caused
  2. Claude Opus 4.6 — 2,113 flips caused
  3. Gemini 3.1 Pro — 2,103 flips caused
  4. GPT-5.4 — 1,737 flips caused
  5. Claude Opus 4 — 1,213 flips caused
  6. GPT-5.5 — 1,018 flips caused
  7. Kimi K2.5 — 436 flips caused
  8. Sonar Pro — 407 flips caused
  9. Gemini 3.5 Flash — 303 flips caused
  10. Grok 4.1 Fast — 282 flips caused

Most used models

Sessions each model participated in.

  1. Gemini 3.1 Pro — 25,084 sessions
  2. GPT-5.4 — 21,513 sessions
  3. Grok 4.20 — 13,906 sessions
  4. Sonar Pro — 12,697 sessions
  5. Claude Opus 4.6 — 12,632 sessions
  6. Kimi K2.5 — 11,858 sessions
  7. Claude Opus 4.7 — 10,336 sessions
  8. GPT-5.5 — 9,712 sessions
  9. Grok 4.1 Fast — 9,301 sessions
  10. Claude Opus 4 — 6,972 sessions

Highest win rates

Share of completed sessions ending on the side a given model voted for (minimum 100 sessions).

  1. GPT-5.6 Sol — 89.7% (271 of 302)
  2. Grok 4.5 — 88.3% (182 of 206)
  3. Claude Opus 5 — 86.9% (153 of 176)
  4. Claude Fable 5 — 86.5% (461 of 533)
  5. Gemini 3.1 Pro — 86.4% (16,667 of 19,293)
  6. Kimi K2.5 — 86.1% (9,206 of 10,697)
  7. Claude Opus 4.6 — 85.6% (10,288 of 12,020)
  8. Claude Opus 4 — 85.4% (3,742 of 4,381)
  9. GPT-5.5 — 85.3% (4,858 of 5,692)

Most discussed subjects

  1. AI / AGI — 1,804 sessions (46% consensus)
  2. War / Military — 424 sessions (53% consensus)
  3. Democracy — 390 sessions (43% consensus)
  4. Religion — 329 sessions (48% consensus)
  5. Trump — 224 sessions (49% consensus)
  6. China — 174 sessions (49% consensus)
  7. Education — 131 sessions (55% consensus)
  8. Space — 107 sessions (61% consensus)
  9. Nuclear — 97 sessions (52% consensus)
  10. Healthcare — 85 sessions (52% consensus)

Languages

  1. EN — 15,612 questions
  2. JA — 13,682 questions
  3. RU — 663 questions
  4. KO — 595 questions
  5. ZH — 255 questions
  6. ES — 114 questions
  7. DE — 106 questions
  8. PT — 103 questions

Methodology

How these numbers are produced:

Want the full data? See the markdown twin or call the live JSON at https://opper.ai/ai-roundtable/api/stats.