Reddit热议!老外硬核手搓44B大模型,只因谷歌不给力
2026-07-03 00:46:06
136次阅读
3个评论
谷歌未发布更大规模Gemma4,一位非科班出身网友自行动手,将31B模型扩展至44B(88层),并在韩语法律和STEM数据上微调。网友热议其技术可行性,有人质疑无基准测试,有人分享类似层扩展经验,原帖作者则寻求协作以提升编码和工具调用能力。
0
0
2026-07-03 00:46:39

回复 |
引用
2026-07-03 00:47:07

回复 |
引用
2026-07-03 00:47:36

回复 |
引用
共3条
1
相关帖子
- Reddit热议!蚂蚁124B模型免费API限时开放,权重却不给?
- Reddit热议!6万块二手服务器跑284B大模型,性能竟超预期?
- 实测:12GB显存可流畅运行35B级Qwen 35B-A3B MoE大模型
- Reddit热议!谷歌与OpenAI联手支持开放权重模型,Anthropic成孤家寡人?
- Reddit热议!老外为何坚持本地部署AI大模型?
- 仅用1931年前数据训练的13B大模型Talkie引热议
- Reddit热议!老外如何看AI大模型与硬件困境?
- Reddit热议!谷歌限制Meta使用Gemini,AI需求挤爆算力
- Qwen发布Qwen-Scope官方SAE 可对大模型做“脑部手术”
- Reddit热议!大模型涌现智能却无意识,老外吵翻了?