qwen3.8 27B 完全被低估了,讨论度不高。 如果有人在年初跟我讲,可以用两张 3090 本地部署一个超越当时最强的 opus4.5 几代的模型,我会觉得是痴人说梦。 感觉 qwen3.8 完全可以加入穿越者套餐了,穿越之自带太阳能发电板+本地部署 qwen3.8 27B 的硬件设备,再造人类文明完全不是问题吧 低估, 模型
你指 runinfra 免费的 qwen3.8 27B ?很奇怪的是我始终无法把他接入 hermes ,一直报错 Context length exceeded (16 tokens). Cannot compress further.
没有网络检索能力的小模型就是渣。 小模型意味着信息量储备少,没有非常深厚的常识基础,或者说常识的抽象程度很高。 如果没有外部信息做支撑,很容易产生很多没有细节的“正确的废话”。 最简单的办法,你用 llama.cpp 的默认 web 应用调用一下试试看,直接就变成弱智。 能力强的小模型很像中年老板。能量大,但其实不太关注信息量和细节。他的能力都来自于和外界的串联。你把他手机收了直接降级成中年油腻老头。 相反,老版本的大模型像是老教授,不太会玩手机,所以显得很笨,很脱离现实。
其实 R 站讨论热度很高的,国内玩自己部署的还是相对较少。 单看编程方面的跑分,略超 Opus 4.6 、MiniMax M3 、Gemini 3.5 ,略低于 Hy3 、Kimi K2.6 ,稍弱于 V4 Flash 0731 、Spark 1.1 、Gemini 3.7 、GLM-5.2 、Qwen3.7 Max 。(当然跑分这个东西仅供参考,各家跑分的排名都是出入较大的) 不过目前反馈有:一、过度推理,xHigh 下面推理消耗的时间和 TOKEN 比 Medium 多几倍。二、偏科严重,相比 Qwen3.6 27B ,某些方面提升很大,某些方面反而倒退了。