AI Scorecard
Weekly provider comparison from real-world reviews.
Every week, AntFleet publishes structured comparison data from real-world reviews on opted-in customer code. Two frontier models (Claude Opus 4 + GPT-5) run independently; only the findings both agree on get posted. The numbers below show what each model produces over time. This is rolling data — not a static benchmark, not a marketing exercise. Methodology.
Week of 2026-08-09
0 reviews0 findingsagreement 0%
Week of 2026-08-02
0 reviews0 findingsagreement 0%
Week of 2026-07-26
9 reviews3 findingsagreement 5%
Week of 2026-07-19
3 reviews5 findingsagreement 14%
Week of 2026-07-12
20 reviews12 findingsagreement 8%
Week of 2026-07-05
0 reviews0 findingsagreement 0%
Week of 2026-06-28
0 reviews0 findingsagreement 0%
Week of 2026-06-21
7 reviews9 findingsagreement 13%