黄仁勋曾把算力砍掉80%的H20芯片卖给中国,没想到被中国工程师成功破解,结果发现芯片竟暗藏 “追踪定位” 和 “远程关闭” 后门!
这话听着像谍战片里的桥段,却是过去一年国内AI行业实打实经历的震荡。
很多人都有印象,前两年美国攥着高端AI芯片收紧出口,H100、A100这些能支撑大模型训练的旗舰卡,说禁运就禁运,国内做人工智能、云计算的企业一下子被掐住了算力脖子。
黄仁勋就在这时候拿出了H20,美其名曰为中国市场定制的 “合规特供款”,表面是照顾需求,实则对着核心算力狠狠砍了一刀——FP16算力连原版H100的十分之一都不到,算下来正好砍掉了八成还多。
那时候行业里的心态很矛盾:嘴上都骂这是 “残血智商税”,下单却一点没犹豫。
没办法,AI行业不等人,大模型训练、推理业务都等着算力下锅,有总比没有强。阿里、腾讯这些头部厂商一批批地采购,英伟达靠着这张阉割卡,单一年就能从中国市场卷走上百亿美元。
当时没人往更深处想,只当是花钱买个能用的工具,直到国内工程师团队拿着芯片做底层性能优化,想尽量挖一挖剩余潜力,才在固件层摸到了不对劲的地方。
最开始大家的目标很纯粹:H20算力砍得狠,但96GB显存和4.0TB/s的带宽留得不算小气,能不能通过算法调度、多卡互联优化,让实际跑任务的有效算力再提一截?结果在逆向排查固件代码、做深度适配的时候,翻出了几段从未在公开技术文档里标注的隐秘程序。
顺着代码往下追,整个团队都出了一身冷汗:只要芯片接入网络,就会定时向境外服务器发送加密数据包,里面不光打包了芯片的运行日志、算力调度数据,连设备的精确物理位置信息都在其中。
更致命的是,代码底层还埋着远程熔断触发机制,只要远端下发指令,单片芯片甚至整集群服务器都能被直接锁死,瞬间彻底瘫痪。
消息传开之后,整个国内算力圈都炸了锅。有人调侃说,这哪是买算力,这是花钱请了个远程监工,还带一键熄火功能。
几个亿投下去的数据中心,控制权却攥在别人手里,哪天局势一变,人家动动手指就能让所有业务停摆,这风险谁扛得住?很快国家网信办就此事约谈英伟达,要求就H20芯片的安全风险作出说明并提交材料。
英伟达也反应很快,没多久就由首席安全官出面发了长文声明,一口咬死自家芯片不存在后门、没有终止开关,还说硬编码这种控制机制反而会给黑客留漏洞,违背网络安全的基本逻辑。
但这番解释并没打消行业的顾虑。懂技术的人都清楚,英伟达的驱动和核心固件全是闭源黑箱,有没有隐藏功能、什么时候激活,外界根本没法完全验证。
更何况美国早有过 “芯片留后门” 的先例,三十年前的Clipper芯片事件,就是美国政府强制企业在加密设备里植入监听后门,方便官方获取信息。
后来还有行业报告披露过美国的 “片上治理机制” 思路,本质就是要在先进芯片中预留管控能力,英伟达的产品本就符合大部分技术条件,只是从来不会明说而已。
谁也没想到的是,这场由 “挖算力” 引出的安全风波,反倒成了国产算力替代的催化剂。之前很多企业抱着 “能用就行” 的惰性,宁愿多花钱用英伟达的方案,也不愿花精力适配国产芯片。
如今看清了 “卡脖子还留后手” 的现实,转头就加速了国产替代的脚步。华为昇腾、寒武纪、平头哥这些国产算力芯片,之前在生态适配、场景优化上还有差距,现在企业愿意投入资源联合调优,实际落地效果提升极快。
加上国内团队在模型压缩、混合精度调度、算力池化上的技术积累,很多业务场景下,国产方案的实际表现并不比阉割版的H20差,单位功耗的算力输出甚至更划算。
说到底,这件事给整个行业上了最现实的一课:数字时代的核心技术,买不来、讨不来,靠别人永远站不稳脚跟。人家既能砍你性能赚你的钱,还能在背地里留着手笔攥着你的命脉。
反倒是一次次的封锁和算计,逼着咱们把自主可控的路走得越来越实。从芯片硬件到软件生态,从底层框架到上层应用,每一步都攥在自己手里,才是真正的安全感。
这不是赌气,是所有科技从业者都明白的道理——自己的饭碗,得自己端牢。

