正文:
用4台DGX Spark(GB10,每台128G统一内存)搭了TP4集群跑DeepSeek-V4.1-Flash(552B参数)。不做跑分,直接测你每天真正会做的任务💪
💻 代码类(单并发实测):
· Python LRU缓存实现 → 73 tok/s
· CSV→建表+INSERT SQL → 93.5 tok/s(20行表5秒出)
· JS→Python代码迁移 → 81.5 tok/s
· SQL复杂查询 → 65 tok/s
· 给Python加docstring → 78 tok/s
📝 翻译/概括类:
· 字幕SRT翻译 → 75.5 tok/s
· 论文摘要提炼 → 74.2 tok/s
· 会议纪要整理 → 59.2 tok/s
💼 Office类:
· 表格重排 → 68.7 tok/s
· Excel公式 → 61.3 tok/s
· 周报邮件起草 → 44.2 tok/s
4路并发混合负载→ 聚合 98 tok/s
4路并发代码域→ 聚合 124 tok/s
写一个成绩管理系统 ≈ 15秒✅
20行CSV变建表SQL ≈ 5秒✅
翻译3000字合同 ≈ 40秒✅
512K上下文,21/21全项通过,启动9分钟。
#DGXSpark #DeepSeek #AI编程 #代码生成 #大模型部署 #本地部署 #工作提效 #SQL #deepseek #vllm#dgxspark #榨干设备howto #glm #howto入门codex #大模型 #高科技配置
