Loading…

AI Roundtable stats

Aggregate statistics from 31,888 public AI Roundtable sessions, across 362,008 model responses. Snapshot generated 2026-10-10T04:00:34.212Z.

Consensus outcomes

Models reached agreement in 65% of completed sessions (20,765 of 31,721). Breakdown:

Most influential models

Times a model's argument convinced another to flip its vote in Debate mode.

  1. Claude Opus 4.7 — 2,984 flips caused
  2. Claude Opus 4.6 — 2,113 flips caused
  3. Gemini 3.1 Pro — 2,103 flips caused
  4. GPT-5.4 — 1,737 flips caused
  5. Claude Opus 4 — 1,213 flips caused
  6. GPT-5.5 — 1,018 flips caused
  7. Kimi K2.5 — 436 flips caused
  8. Sonar Pro — 407 flips caused
  9. Gemini 3.5 Flash — 303 flips caused
  10. Grok 4.1 Fast — 282 flips caused

Most used models

Sessions each model participated in.

  1. Gemini 3.1 Pro — 25,084 sessions
  2. GPT-5.4 — 21,529 sessions
  3. Grok 4.20 — 13,906 sessions
  4. Sonar Pro — 12,697 sessions
  5. Claude Opus 4.6 — 12,646 sessions
  6. Kimi K2.5 — 11,858 sessions
  7. Claude Opus 4.7 — 10,353 sessions
  8. GPT-5.5 — 9,729 sessions
  9. Grok 4.1 Fast — 9,301 sessions
  10. Claude Opus 4 — 6,972 sessions

Highest win rates

Share of completed sessions ending on the side a given model voted for (minimum 100 sessions).

  1. GPT-5.6 Sol — 89.6% (284 of 317)
  2. Claude Opus 5 — 87.6% (170 of 194)
  3. Grok 4.5 — 87.6% (191 of 218)
  4. Gemini 3.1 Pro — 86.4% (16,667 of 19,293)
  5. Kimi K2.5 — 86.1% (9,206 of 10,697)
  6. Claude Fable 5 — 86.0% (468 of 544)
  7. Claude Opus 4.6 — 85.6% (10,295 of 12,028)
  8. Claude Opus 4 — 85.4% (3,742 of 4,381)
  9. GPT-5.5 — 85.4% (4,868 of 5,703)

Most discussed subjects

  1. AI / AGI — 1,817 sessions (45% consensus)
  2. War / Military — 424 sessions (53% consensus)
  3. Democracy — 392 sessions (43% consensus)
  4. Religion — 330 sessions (48% consensus)
  5. Trump — 224 sessions (49% consensus)
  6. China — 174 sessions (49% consensus)
  7. Education — 131 sessions (55% consensus)
  8. Space — 108 sessions (60% consensus)
  9. Nuclear — 98 sessions (51% consensus)
  10. Healthcare — 85 sessions (52% consensus)

Languages

  1. EN — 15,744 questions
  2. JA — 13,754 questions
  3. RU — 677 questions
  4. KO — 595 questions
  5. ZH — 259 questions
  6. ES — 115 questions
  7. DE — 106 questions
  8. PT — 103 questions

Methodology

How these numbers are produced:

Want the full data? See the markdown twin or call the live JSON at https://opper.ai/ai-roundtable/api/stats.