Special · Claude Haiku 5.5
Haiku 5.5 beats GPT-6 Luna on OSWorld, 72.4% to 48.9%
First seen on X 1 hour ago@claudeai ♥ 32,238
In Anthropic's own table, Haiku 5.5 scored 72.4% on OSWorld 2.1 (offline subset). GPT-6 Luna scored 48.9%, and Haiku 4.5 scored 15.7%. On the Terminal-Bench 4.0 coding test, Haiku 5.5 scored 39.2%, ahead of Luna's 16.4%.
Sonnet 5.5 is still higher, at 83.9% on OSWorld and 70.6% on Terminal-Bench. Every score here is the company's own number.