Global AI News Aggregator
About
By
–
GLM-5 benchmark results are out – 77.8 on SWE-bench verified – 50.4 on HLE with Tools – 75.9 on BrowseComp
→ View original post on X — @testingcatalog