资讯动态
首页 > 资讯动态 > 小模型Agent能力评估:Qwen3.8-27B-UD-Q4_K_XL表现最佳

小模型Agent能力评估:Qwen3.8-27B-UD-Q4_K_XL表现最佳

2026-09-01

根据作者的研究,小模型在作为Agent时的表现如何?他提供了一张能力天梯图,并得出结论:Qwen3.8-27B-UD-Q4_K_XL是当前最推荐的版本。在关键配置方面,针对不同场景的推理强度,作者建议在Agent任务时将reasoning_effort设置为低,而在编写代码时提高到中等或高。这一细节对小模型在有限计算资源下的表现至关重要。值得注意的是,Mac用户可以看到,作者实测MLX在使用MTP时比llama.cpp更快,因此在苹果设备上更倾向于选择MLX。

为了确保测试结果的可靠性,所有模型都在统一的环境下使用单卡H100 NVL与最新版本的llama.cpp进行评估,这种基准设置使得天梯排名具备可比性,而非随意拼凑的数据。最后,作者表示如果有其他模型评测的需求,欢迎留言,他会继续进行测试。目前这条动态的浏览量达到了1600次。

国际篮联发布中国女篮世界杯定妆照幕后花絮

降级阴影下,刘军帅的未来成谜

联系我们
  • 电话:13594780287
  • 邮箱:devilish@mac.com
  • 地址:兰州市商密坊352号
留言

Copyright © 球友会(中国)官方网站-千亿球友会 版权所有 网站地图

WeChat
WeChat

留言框-

球友会(中国)官方网站-千亿球友会

13594780287