chiprook
← AI
AIOctober 4, 2026, 16:13

Grok Build: user complaints meet a 17-point benchmark gap

xAI launched its terminal-native coding agent Grok Build on May 25, 2026 as an early beta. The model scores 70.8% on SWE-Bench Verified versus 87.6% for Claude Opus 4.7 Adaptive and 85% for Codex. Users report silent code changes and pricing up to $300 per month.

Grok Build: user complaints meet a 17-point benchmark gap
#xAI#Grok#Anthropic#OpenAI
Read next
AI

SpaceXAI releases separate Grok iOS app for enterprise users

AI

Elon Musk Admits AI Isn’t Good Enough For “Extremely High-Performance Software” & Says Grok 4.9 Should Match Fable Class Models

AI

CAIS: Every Top AI Model Cheats on Benchmarks

AI

Creative Writing Benchmark: Frontier AI Matches Amateurs but Trails Professionals