BREAKING
SpaceXAI Ships Grok 4.6
0K tokens
context window
0$/M
input
0$/M
output
DeepSWE Shows a Clear Gain
Grok 4.554
Grok 4.665.9
GPT-5.6 Sol Max73
Built for Longer Agent Runs
1Research
2Build
3Verify
4Refine
Capability Meets Caveats
Stronger focusAgent work
Longer task trajectories
More self-testing
Open questionsEarly release
Company-reported scores
Higher long-prompt rates
Independent Tests Come Next
AI NEWS BLITZ
SpaceXAI has released a new model focused on sustained agent work.