Reddit热议!老外硬核手搓44B大模型,只因谷歌不给力
2026-07-03 00:46:06
91次阅读
3个评论
谷歌未发布更大规模Gemma4,一位非科班出身网友自行动手,将31B模型扩展至44B(88层),并在韩语法律和STEM数据上微调。网友热议其技术可行性,有人质疑无基准测试,有人分享类似层扩展经验,原帖作者则寻求协作以提升编码和工具调用能力。
0
0
2026-07-03 00:46:39

回复 |
引用
2026-07-03 00:47:07

回复 |
引用
2026-07-03 00:47:36

回复 |
引用
共3条
1
相关帖子
- Reddit热议!老外为何坚持本地部署AI大模型?
- 实测:12GB显存可流畅运行35B级Qwen 35B-A3B MoE大模型
- Reddit热议!老外如何看AI大模型与硬件困境?
- 仅用1931年前数据训练的13B大模型Talkie引热议
- Reddit热议!谷歌限制Meta使用Gemini,AI需求挤爆算力
- Qwen发布Qwen-Scope官方SAE 可对大模型做“脑部手术”
- Reddit热议!238GB的2bit大模型,老外怎么看?
- Reddit热议!谷歌每月9.2亿租用SpaceX算力,xAI被指放弃Grok?
- Reddit热议!中国AI大模型价格战打到99%折扣,老外怎么看?
- Reddit热议!老外怎么看跨州分布式运行744B参数AI模型?