Been testing GLM5.3-flash and Qwen3.8-flash-next locally on 2 DGX Sparks on multiple SoA projects, each project has at least 20 services, 20 DBs, and combination of frontends (VueJS/Android/iOS).
GLM5.3 did far worse than qwen3.8-flash-next. never had to correct qwen!