用 J-Space 中的“元标记”揭示模型内部算法网页链接“我们使用J-lens技术对Qwen3.6-27B模型进行了分析,以寻找"元标记"(meta-tokens):即那些能揭示模型非显式计算过程的标记。当模型读取含歧义文本时,"什么意思"会在J空间中激活,若将其引导偏离,模型就会用营养成分信息来回答"每天早上吃一个煮鸡蛋很难被超越",而非理解其中的双关语。在处理最小公倍数(LCM)问题时,"gcd"(最大公约数)标记会被激活,指向乘积除以最大公约数的算法:将模型中的GCD向量从9替换为3后,模型对27和90的最小公倍数答案从270变成810。此外,在模型进行模棱两可的表述之前,"大概率"标记会被激活,抑制该标记后模型会明确选择单一选项(例如,"约翰可能去了几个地方"会变成"他去了文具店")。尽管由于J-lens单标记约束的限制,元标记难以被发现,但未来多标记J-lens方法的发展,有望为深入理解模型内部算法提供宝贵洞见。”
