阿里开源Qwen3.8-27B模型,作者实测显示标准部署下vLLM和SGLang吞吐均超40 token/s,量化至3bit仍保持质量;但Agent测试中完成9个任务消耗近1400万token,约为DeepSeek的14.6倍,表明Agent任务拆分与边界控制仍需优化。