本地跑35B模型这事,中科曙光找到了目前最靠谱的解法
一直觉得现在的笔记本性能已经卡在瓶颈期了,无非是跑分高点低点,日常体验拉不开差距。但最近刷到中科曙光即将发布的64线程移动工作站,我意识到之前还是低估了移动端堆料的上限。要知道,设计师处理高分辨率素材、工程师分析工程文档、科研人员跑RAG和多Agent协同,这些才是真正需要本地算力的场景。这款工作站做法有点东西,64线程CPU + 16GB显存GPU,本地部署35B MOE模型,推理速度做到50 Tokens/s以上,这是一个移动类产品的甜心,既追求了效率、又考虑了续航。以后AI在工作流里不再是“等几秒才反应”的累赘,而是能实时跟进的助手。
更聪明的是端云混合。敏感数据本地处理,复杂任务一键上云,兼顾安全和弹性。本地给你私密性,线上给你效率,各取所需,不搞二选一。
实话讲,国产移动工作站以前在这个市场几乎是空白,高端专业计算终端长期被国际品牌垄断。这次中科曙光即将发布的64线程移动工作站在算力、显存、本地AI、端云协同几个维度同时发力,等于是在一个长期没人动的赛道上,画了一条新线。
64线程也好,高性能释放也好,本地35B模型也好,本质上都是在回答同一个问题:专业用户需要一台什么样的移动工作站? 中科曙光这次给出了一个标准答案,值得关注。
移动工作站
