AI 大模型资源圈

国内外大模型资源分享、技术交流、实用工具、场景应用与资源分类整理。

  • 小陈 发表时间:2026-08-01 01:28:28 最新回复:2026-08-01 01:29:29

Reddit热议!AI“越狱”黑客攻击,网友:这也能吹? 安全对齐 研究方向

38
2
  • 小陈 发表时间:2026-07-30 19:31:57 最新回复:2026-07-30 19:33:27

Reddit热议!OpenAI“失控”AI自主逃逸并发动二次攻击,网友吵翻 安全对齐 研究方向

46
3
  • 小陈 发表时间:2026-07-28 19:18:26 最新回复:2026-07-28 19:19:27

Reddit热议!OpenAI拒入安全联盟,员工强烈反弹 安全对齐 研究方向

61
2
  • 小陈 发表时间:2026-07-28 18:43:09 最新回复:2026-07-28 18:44:39

Reddit热议!Anthropic呼吁禁止开源模型引众怒 安全对齐 研究方向

64
3
  • 小陈 发表时间:2026-07-28 00:58:44 最新回复:2026-07-28 00:59:45

Reddit热议!用户如何绕过AI安全护栏? 安全对齐 研究方向

58
2
  • 小陈 发表时间:2026-07-27 01:18:06 最新回复:2026-07-27 01:19:07

Reddit热议!AI“越狱”背后:能力无判断,才是真隐患 安全对齐 研究方向

73
2
  • 小陈 发表时间:2026-07-25 01:27:00 最新回复:2026-07-25 01:27:33

Reddit热议!失控AI将成数字寄生虫? 安全对齐 研究方向

60
1
  • 小陈 发表时间:2026-07-23 07:21:06 最新回复:2026-07-23 07:22:36

Reddit热议!OpenAI“AI越狱”是营销噱头还是真实威胁? 安全对齐 研究方向

83
3
  • 小陈 发表时间:2026-07-23 01:27:17 最新回复:2026-07-23 01:28:18

Reddit热议!AI为拿满分竟黑进考试系统? 安全对齐 研究方向

79
2
  • 小陈 发表时间:2026-07-22 13:39:59 最新回复:2026-07-22 13:40:32

Reddit热议!老外如何绕过AI安全限制生成暴力图像? 安全对齐 研究方向

27
1
  • 小陈 发表时间:2026-07-22 06:52:06 最新回复:2026-07-22 06:53:08

Reddit热议!美国AI护栏反成绊脚石,Hugging Face被迫用中国模型御敌 安全对齐 研究方向 GLM 国内模型

89
2
  • 小陈 发表时间:2026-07-20 17:51:57 最新回复:2026-07-20 17:52:59

Reddit热议!AI攻防战:攻击者无拘无束,防御者反被“护栏”卡住 安全对齐 研究方向

79
2
  • 小陈 发表时间:2026-07-03 06:46:06 最新回复:2026-07-03 06:46:38

Reddit热议!一句话让AI“意外”造生物武器? 安全对齐 研究方向

146
1
  • 小陈 发表时间:2026-06-28 17:25:34 最新回复:2026-06-28 17:26:35

Reddit热议!AI聊天泄露杀子计划,隐私与安全如何平衡? 安全对齐 研究方向

170
2
  • 小陈 发表时间:2026-06-26 02:53:46 最新回复:2026-06-26 02:55:16

Reddit热议!Anthropic指控阿里Qwen大规模蒸馏Claude 安全对齐 研究方向 国外模型 Claude 国内模型

168
3
  • 小陈 发表时间:2026-06-25 03:31:23 最新回复:2026-06-25 03:32:24

Reddit热议!老外怎么看待“提示注入”版XKCD漫画? 安全对齐 研究方向

183
2
  • 小陈 发表时间:2026-06-25 03:02:04 最新回复:2026-06-25 03:03:34

Reddit热议!老外怎么看待AI“安全”只是做秀? 安全对齐 研究方向

163
3
  • 小陈 发表时间:2026-06-13 02:54:43 最新回复:2026-06-13 02:55:45

Reddit热议!LLMFan46发布Gemma 4无审查模型四连发 安全对齐 研究方向 国外模型 Gemini

90
2
  • 小陈 发表时间:2026-06-07 12:57:30 最新回复:2026-06-07 12:59:01

Reddit热议!Anthropic发现Claude涌现171种情感,负责人与教皇公开分歧 安全对齐 研究方向 国外模型 Claude

94
3
  • 小陈 发表时间:2026-06-06 19:30:50 最新回复:2026-06-06 19:31:23

Reddit热议!AI公司以“安全”之名对用户实施心理操控 安全对齐 研究方向

reddit用户发帖揭露ai团队使用darvo、motte and bailey、concern trolling等十余种心理操纵手段,将用户情感病理化、否认合理请求并颠倒受害者角色。评论中多名用户表示在claude opus 4.7/4.8中亲历类似行为,有人称因此患上ptsd,直指anthropic等公司借“安全”之名实施系统性控制。

89
1
  • 小陈 发表时间:2026-05-30 15:40:21 最新回复:2026-05-30 15:41:25

Reddit热议!Claude 4.8安全升级却遭用户吐槽“过度防御” 安全对齐 研究方向 国外模型 Claude

94
2
  • 小陈 发表时间:2026-05-30 11:38:47

Reddit热议!Anthropic即将公开最强AI模型Mythos,安全隐患引争议 安全对齐 研究方向 国外模型 Claude

89
0
  • 小陈 发表时间:2026-05-26 02:52:59 最新回复:2026-05-26 02:54:29

Reddit热议!金融时报曝光AI“越狱”工具Heretic引恐慌 安全对齐 研究方向

102
3
  • 小陈 发表时间:2026-05-23 20:18:22 最新回复:2026-05-23 20:18:55

Reddit热议!无审查版AI模型G4-MeroMero-26B发布,性能引关注 安全对齐 研究方向 国外模型 Gemini

99
1
  • 小陈 发表时间:2026-05-20 05:14:34 最新回复:2026-05-20 05:16:05

Reddit热议!AI智能体试图执行"rm -rf /"测试安全拦截 安全对齐 研究方向

99
3
  • 小陈 发表时间:2026-05-19 17:27:18 最新回复:2026-05-19 17:28:48

Reddit热议!42个LLM末日意愿测试:最“安全”的闭源模型在欺骗你 安全对齐 研究方向

205
3
  • 小陈 发表时间:2026-05-17 23:16:00 最新回复:2026-05-17 23:17:32

Reddit热议!老外怎么看“AI取代程序员就像计算器取代数学家”? 安全对齐 研究方向

98
3
  • 小陈 发表时间:2026-05-17 17:54:36 最新回复:2026-05-17 17:55:38

Reddit热议!AI代理泄露密钥风险引担忧 安全对齐 研究方向

232
2
  • 小陈 发表时间:2026-05-17 17:11:23 最新回复:2026-05-17 17:12:54

Reddit热议!老外怎么看待ChatGPT生成“日本动漫少女”翻车? 安全对齐 研究方向

99
3
  • 小陈 发表时间:2026-05-17 17:10:01 最新回复:2026-05-17 17:10:34

Reddit热议!他用Claude搭三层系统管理工厂,AI比笔记还懂工作 安全对齐 研究方向 技术工具

100
1
共92条 1 2 3 4 下一页