马斯克喊出「全球第三」,我把账单放大三倍马斯克的 Grok 4.7 确实变强了,但“全球第三”的水分挺大。
跑分滤镜厚:综合智能指数只涨了2分。编程能排第三,全靠套了自家框架。换到中立榜单直接跌到第24名。
便宜是假象:单价看着只有竞品的零头。但它废话太多,输出长度是别人的三倍。算上废话,总账单优势直接腰斩。实测跑一道题甚至比对手还贵。
真正该警惕的套路:各家都在搞“模型+私有框架”捆绑。以后看跑分别光看排名,得先问用了啥框架测的。
别看单价看总账,别看跑分看实测。




马斯克喊出「全球第三」,我把账单放大三倍马斯克的 Grok 4.7 确实变强了,但“全球第三”的水分挺大。
跑分滤镜厚:综合智能指数只涨了2分。编程能排第三,全靠套了自家框架。换到中立榜单直接跌到第24名。
便宜是假象:单价看着只有竞品的零头。但它废话太多,输出长度是别人的三倍。算上废话,总账单优势直接腰斩。实测跑一道题甚至比对手还贵。
真正该警惕的套路:各家都在搞“模型+私有框架”捆绑。以后看跑分别光看排名,得先问用了啥框架测的。
别看单价看总账,别看跑分看实测。



