7月27号晚上11点,月之暗面干了件事。把Kimi K3的完整权重扔上了Hugging Face。2.8万亿参数,三十分钟,登顶趋势榜。
HF的CEO自己发帖说了一句,我们平台这么多年,没见过涨这么快的;然后,我往下扫了一眼第二名,百度的Unlimited OCR,在上面挂了一个多月了,今天还在。
前两名,全是中国的,你再看看这俩名字,它俩根本不是一类东西,一大一小。
Kimi K3,2.8万亿参数,你我下载不动,绝大多数人点进去,围观一下天花板长什么样。Unlimited OCR呢?几个B的量级,一张消费级显卡就能跑,GitHub一万九千多颗星,HF下载量265万次。
你感受一下这个同框,第一名靠开源征服全球,第二名被人拆开,装进个人工作流,它解决了一个特别不性感的问题,所有做文档处理的开发者都被恶心过:
以前OCR模型啃一本几十页的书,只能一页一页来,解析完第一页再接第二页,越往后,显存里堆的历史信息越多,速度越慢,成本越高。
百度的方案叫R-SWA,思路不复杂,就是人抄书的方式。
眼睛盯着原文,手里只留最近抄的几行当工作记忆,不把前面几十页全背脑子里,于是一次推理能从第一页连贯跑到最后一页,显存不随长度膨胀。
顺带说一句,它不藏师承,我特意查了下,仓库里明写着,沿的是DeepSeek-OCR的路子,再往前推一步。
更值得说的,是时间线,开源项目多了去了,今天你上榜,明天我上榜的。但是,这个东西热度回落一个月之后,它又爬上了总榜第一。
没有新版本、发布会,就靠开发者下载、部署、口口相传,你看,这绝对是刚需啊。
这轮回榜还有个有意思的事,杨立昆转发了。
卷积网络之父,当年就是靠OCR起家的,他九十年代做的支票识别系统,读过全美超过一成的支票;三十年后,老爷子转发的是一个中国团队的OCR模型,哈哈。
要我说,榜单明天会换人,重要的是那265万次的下载。被人用起来的东西,才是好东西;你可以在GitHub上下载试试,然后,百度智能云API也可以调用。