AiNews
⚡ 速览 🧠 模型
返回首页
V2EX

DeepSeek V4.1 Flash 部署讨论

开源社区近期热议 DeepSeek V4.1 Flash 模型。据透露,该模型参数规模达 485B,文件体积约为 510GB。硬件部署方面,常规配置下即使量化,也很难在两台 DGX Spark 上直接跑通。不过,该模型在架构上优化了 KV 缓存开销,单 token 占用降至原来的五分之一。经过适当量化并预留约 15GB KV 缓存空间后,使用四台 Spark 设备可以获得流畅的运行体验,这对关注本地部署和硬件成本的团队具有较高参考价值。

获取每日 AI 情报与羊毛福利

加入 Telegram 频道 @ainews_Go,第一时间接收精选资讯推送。

立即加入

相关阅读