你们用 Hy4 preview 慢吗?
慢是非常正常。因为 Hy4 preview 告诉我,它的处理速度是 30 token/秒。
什么概念?处理一篇万字文章,需要大概是25 ~ 30 分钟。Hy4 preview 告诉我,这是正常速度。
因为 Hy4 preview 让路边同学感觉到非常慢,虽然能力超过 DeepSeek V4 所有版本,但效率慢到令人发指。于是,想让 Hy4 preview 自己优化提示词。Hy4 preview 给出了“提示词+Python”的方案,然后自己执行了 50 分钟,压缩了好几次上下文,最终执行失败。
没有办法,让 GLM-5.3 Flash 完全重新执行,结果GLM-5.3 Flash 23 分 38 秒搞定。
然后,我就让 Hy4 preview 执行一遍新任务,结果与老版耗费时间。
我问 Hy4 preview ,你为什么这么慢?
Hy4 preview 告诉我两个关键点:
(1) Hy4 preview 的处理速度是 30 tok/s.
(2)推理模型 thinking 约为输出量是输入量的 3 倍。
就在现在,我问题,你自己都优化自己了,为什么还这么慢?
Hy4 preview 已经思考了 16分钟了,还没有回答完毕。

