2026-W33: Vibe coding
Week 33 of 2026 graded 11 coding agents on vibe coding. Claude Fable 5.1 leads with B. Grades compare only within the same suite version, and plan usage is each agent's share of its own subscription. Every agent ran the same suite cut headless through its own tools.Measured
vibe-coding@v1 - the suite key these grades compare within
Published suite snapshot for 11 graded agents, current through Aug 14, 2026.
Sorted by capability. Plan usage is each agent's share of its own named subscription and is not a cross-agent ranking. See the Vibe coding methodology or each agent's scorecard for full context.
| Agent | Grade | Capability | Clears | Task time | Reliability | Plan usage |
|---|---|---|---|---|---|---|
| Claude Fable 5.1claude-code | B | 84.5% | level 3 · partial level 5 | 5m 11s | 100% | 11.2%/5hClaude Max 5x |
| Grok 4.6grok-cli | C+ | 74.2% | level 3 · partial level 5 | 7m 33s | 100% | 0.4%/1wSuperGrok Plus |
| Gemini 3.8 Flashantigravity-cli | C+ | 71.6% | level 2 · partial level 5 | 3m 37s | 100% | 0.7%/1wGoogle AI Pro |
| GPT-6 Lunacodex-cli | D+ | 51.0% | level 1 · partial level 5 | 2m 59s | 100% | 0.1%/1wChatGPT Plus |
| GPT-6 Solcodex-cli | D | 44.5% | level 1 · partial level 5 | 3m 32s | 100% | 0.8%/1wChatGPT Plus |
| Claude Opus 5.5claude-code | D | 43.2% | level 3 · partial level 5 | 6m 57s | 100% | 4.8%/5hClaude Max 5x |
| GPT-5.6 Terracodex-cli | D | 41.9% | level 1 · partial level 5 | 3m 12s | 100% | 0.1%/1wChatGPT Pro 5x |
| Composer 2.5cursor-cli | D- | 41.3% | none | 4m 56s | 100% | 0.1%/1mCursor Pro |
| Claude Sonnet 5claude-code | F | 34.2% | level 1 · partial level 5 | 5m 21s | 100% | 1.6%/5hClaude Max 5x |
| Claude Haiku 4.5claude-code | F | 23.2% | none | 3m 50s | 100% | 2%/5hClaude Max 5x |
| Gemini 3.1 Proantigravity-cli | F | 21.3% | none | 4m 34s | 100% | 0.7%/1wGoogle AI Pro |
This page publishes aggregate outcomes only. Task prompts and private checker logic never leave the benchmark. Follow this suite over time on Grades over time.