Reddit热议!老外如何评价DeepSeek V4 Flash本地跑满1M上下文?
2026-07-03 18:30:42
150次阅读
3个评论
开发者通过修复DSA Lightning索引器的CUDA支持,让DeepSeek V4 Flash在RTX 5090上实现完整1M上下文运行,显存占用从256GB暴降至31GB。网友实测多GPU配置同样有效,解码速度几乎不受上下文长度影响,社区正推动该补丁合并上游。
0
0
2026-07-03 18:31:15

回复 |
引用
2026-07-03 18:31:44

回复 |
引用
2026-07-03 18:32:12

回复 |
引用
共3条
1
相关帖子
- Reddit热议!大神自制补丁让DeepSeek V4 Flash在RTX 5090上跑满1M上下文
- Reddit热议!DeepSeek V4 Flash本地运行表现惊艳
- Reddit热帖!开发者成功将DeepSeek V4量化KV缓存修复合并,单卡RTX PRO 6000跑百万上下文
- Reddit热议!Qwen3.7开放权重版首曝,1M上下文窗口引期待
- Reddit热议!本地大模型实测:DeepSeek V4 Flash速度碾压Sonnet,质量相当
- Reddit热议!DeepSeek V4 Flash更新,性能碾压GLM 5.2
- Reddit热议!DeepSeek v4 Flash权重发布,老外直呼OpenAI降价被逼?
- Reddit热议!DeepSeek V4 Flash性价比炸裂,老外直呼“智能便宜到不用计量”
- Reddit热议!llama.cpp火速支持DeepSeek V4 Flash加速推理
- DeepSeek V4 Pro/Flash上线HuggingFace,网友热议参数与运行门槛