AiNews
⚡ 速览 🧠 模型
返回首页
V2EX

两台 DGX-Spark 本地部署 DeepSeek V4 Flash 实战

基于两台 NVIDIA DGX-Spark 硬件(总价 6.8 万元,含并连线)本地部署 DeepSeek V4 Flash 0731 版本的完整记录。实测单流推理速度在 60 到 70 tok/s 之间,满足日常开发需求,可作为主力开发机稳定运行。该方案主要用于本地隐私保护,解决机密信息处理的合规痛点。相关配置与实现细节已开源至 GitHub(maliubiao/dgx-spark-2-deepseek-flash-0731),供具备相同硬件条件的开发者参考。

获取每日 AI 情报与羊毛福利

加入 Telegram 频道 @ainews_Go,第一时间接收精选资讯推送。

立即加入

相关阅读