X · @elonmusk
· X / Twitter
Grok 4.5 true usefulness is excellent
Grok 4.5 true usefulness is excellentSnorkel AI: We obtained early access to evaluate @SpaceXAI's newest Grok 4.5 model on GDPval+: real professional deliverables (from a variety of economic sectors and occupations), graded against expert-authored rubrics. Grok 4.5: 29%. GPT 5.5: 22%. Claude Opus 4.8: 21%.