我这四个多月来一直只用本地模型,基本就是 Qwen 的 3.6-27B、35B,还有 3.8 以及它们的微调版。前阵子收到电费单,比平时高了不少,我就去查了下这段时间大模型用得有多频繁。结果一看记录真的挺震惊——Qwen3.8 的改进从数据里暴露得太明显了。能清楚看到会话次数变多了,而且每次平均时长也拉长了一大截。这不算什么定性分析,但很明显它跑的时间更久、能做完的任务也更多。我设了个钩子,每条消息发完后会先把算力拉到 xhigh,马上又降回 low,所以推理时长会直接反映在这些数据上。
分享快讯到朋友圈