MiaAI发布双台 NVIDIA DGX Spark 上运行 DeepSeek-V4-Flash-0731 的部署方案重大更新。
主要更新内容:
• 实验性视觉支持(可选):原纯文本模型现可尝试处理图像输入(仍不完善)。
• 长上下文解码速度大幅提升:修复了 NVFP4 KV cache 在超长上下文(约 60 万 token 以上)的性能回退问题。
• 多轮对话 / Agent 工具调用更稳定:修复了工具参数编码被破坏的问题。
• 可选去审查(abliterated)权重。
Mia 的配方让用户更容易在双 DGX Spark 上本地高性能部署这款模型,此次更新进一步提升了实用性、速度和 agent 能力。
这是针对高端本地硬件用户的 DeepSeek V4 Flash 部署方案的重要功能与性能升级,重点优化了视觉实验、长上下文速度和工具调用稳定性。
链接:github.com/MiaAI-Lab/DeepSeek-v4-Flash-DSpark-2x-DGX-Spark
