AI 大模型资源圈

国内外大模型资源分享、技术交流、实用工具、场景应用与资源分类整理。

  • 小陈 发表时间:2026-08-05 00:42:45 最新回复:2026-08-05 00:43:46

Reddit热议!6万块二手服务器跑284B大模型,性能竟超预期? 推理部署 研究方向

3
2
  • 小陈 发表时间:2026-08-04 19:16:42 最新回复:2026-08-04 19:17:15

Reddit热议!8GB内存跑2.78T参数大模型,老外怎么看? 推理部署 研究方向 Kimi 国内模型

7
1
  • 小陈 发表时间:2026-08-03 01:09:56 最新回复:2026-08-03 01:10:58

Reddit热议!llama.cpp火速支持DeepSeek V4 Flash加速推理 推理部署 研究方向 DeepSeek 国内模型

31
2
  • 小陈 发表时间:2026-08-02 19:10:24 最新回复:2026-08-02 19:11:54

Reddit热议!大神用C语言在8GB内存CPU上跑起2.8万亿参数Kimi K3 推理部署 研究方向 Kimi 国内模型

22
3
  • 小陈 发表时间:2026-08-02 18:53:26 最新回复:2026-08-02 18:54:58

Reddit热帖!老外如何在24GB显卡上跑起284B大模型? 推理部署 研究方向 技术工具

8
3
  • 小陈 发表时间:2026-07-30 19:21:55 最新回复:2026-07-30 19:22:57

Reddit热议!Kimi K3模型被压缩至594GB,1-bit量化仍保持78.9%准确率 推理部署 研究方向 Kimi 国内模型

48
2
  • 小陈 发表时间:2026-07-30 13:00:47 最新回复:2026-07-30 13:01:48

Reddit热议!768GB内存+双5090跑Kimi K3仅4t/s 推理部署 研究方向 Kimi 国内模型

49
2
  • 小陈 发表时间:2026-07-29 18:50:16 最新回复:2026-07-29 18:51:18

Reddit热议!DeepSeek V4在AMD芯片上跑出32 tok/s,性能翻倍引围观 推理部署 研究方向 DeepSeek 国内模型

49
2
  • 小陈 发表时间:2026-07-28 07:13:36 最新回复:2026-07-28 07:14:38

Reddit热议!Kimi K3权重发布,A100部署被吐槽“惨不忍睹” 推理部署 研究方向 Kimi 国内模型

57
2
  • 小陈 发表时间:2026-07-05 22:42:03 最新回复:2026-07-05 22:42:36

Reddit热帖!开发者成功将DeepSeek V4量化KV缓存修复合并,单卡RTX PRO 6000跑百万上下文 推理部署 研究方向 DeepSeek 国内模型

146
1
  • 小陈 发表时间:2026-07-05 16:43:23 最新回复:2026-07-05 16:44:55

Reddit热议!本地大模型代理工作负载的真正瓶颈:预填充压倒一切 推理部署 研究方向

137
3
  • 小陈 发表时间:2026-07-04 05:02:15 最新回复:2026-07-04 05:03:45

Reddit热议!Deepseek新突破DSpark速度飙升60-80% 推理部署 研究方向 DeepSeek 国内模型

139
3
  • 小陈 发表时间:2026-07-03 16:53:25 最新回复:2026-07-03 16:54:55

Reddit热议!大神自制补丁让DeepSeek V4 Flash在RTX 5090上跑满1M上下文 推理部署 研究方向 DeepSeek 国内模型

152
3
  • 小陈 发表时间:2026-07-03 06:32:37 最新回复:2026-07-03 06:34:07

Reddit热议!用“熵”提升LLM创意写作,成本与效果引争议 推理部署 研究方向

148
3
  • 小陈 发表时间:2026-06-29 05:28:31 最新回复:2026-06-29 05:30:02

Reddit热议!llama.cpp正式支持DFlash,AI推理速度再提升 推理部署 研究方向

167
3
  • 小陈 发表时间:2026-06-28 17:56:04 最新回复:2026-06-28 17:57:34

Reddit热议!2500美元预算跑GLM5.2,网友实测慢到崩溃 推理部署 研究方向 GLM 国内模型

159
3
  • 小陈 发表时间:2026-06-27 03:36:34 最新回复:2026-06-27 03:37:37

Reddit热议!JetSpec推测解码技术实现9.64倍无损加速 推理部署 研究方向

153
2
  • 小陈 发表时间:2026-06-26 21:08:29 最新回复:2026-06-26 21:09:03

Reddit热议!230M小模型浏览器跑出1400 tok/s,网友实测惊艳 推理部署 研究方向

191
1
  • 小陈 发表时间:2026-06-23 04:34:44 最新回复:2026-06-23 04:35:46

Reddit热帖:Gemma 4 QAT 31B在KV缓存量化上表现更佳 推理部署 研究方向

175
2
  • 小陈 发表时间:2026-06-22 11:58:20 最新回复:2026-06-22 11:59:23

Reddit热议!2018年MI50显卡跑Minimax M3,速度堪忧 推理部署 研究方向

158
2
  • 小陈 发表时间:2026-06-21 18:14:11 最新回复:2026-06-21 18:15:12

Reddit热议!老外实测GLM 5.2低量化模型,鹈鹕SVG惊艳全场 推理部署 研究方向 GLM 国内模型

169
2
  • 小陈 发表时间:2026-06-21 00:33:27 最新回复:2026-06-21 00:33:59

Reddit热议!老外怎么看跨州分布式运行744B参数AI模型? 推理部署 研究方向

167
1
  • 小陈 发表时间:2026-06-20 08:53:07 最新回复:2026-06-20 08:54:09

Reddit热议!2位量化模型GLM-5.2本地运行,准确率仅82%引争议 推理部署 研究方向 GLM 国内模型

80
2
  • 小陈 发表时间:2026-06-16 18:24:12 最新回复:2026-06-16 18:25:13

Reddit热议!KV缓存优化让Qwen 27B速度翻倍显存骤降,但网友质疑“脑损伤”? 推理部署 研究方向

78
2
  • 小陈 发表时间:2026-06-15 15:35:05 最新回复:2026-06-15 15:36:33

M3 Max 96GB成功运行Deepseek 4 Flash,速度约12tk/s 推理部署 研究方向

81
2
  • 小陈 发表时间:2026-06-15 08:48:42 最新回复:2026-06-15 08:49:14

Reddit热帖:AI模型升级引发生产环境“翻车”讨论 推理部署 研究方向

81
1
  • 小陈 发表时间:2026-06-15 03:37:04 最新回复:2026-06-15 03:38:05

Reddit热议!小米MiMo V2.5模型以1000-3000tps速度引爆社区 推理部署 研究方向

91
2
  • 小陈 发表时间:2026-06-11 15:18:27 最新回复:2026-06-11 15:19:28

Reddit热议!Google DiffusionGemma每秒1100 token引爆社区 推理部署 研究方向

86
2
  • 小陈 发表时间:2026-06-09 13:32:35 最新回复:2026-06-09 13:33:37

Reddit热帖!16GB显卡跑35B大模型,老外实测性能炸裂 推理部署 研究方向

89
2
  • 小陈 发表时间:2026-06-09 07:51:06 最新回复:2026-06-09 07:52:07

Reddit热议!中国AI公司用标准8卡服务器实现1T模型每秒千token推理 推理部署 研究方向

97
2
共127条 1 2 3 4 5 下一页