Hacker News AIT2·68 分
AI 模型群体思维测试:中国模型更倾向共识,独立观点需显式提示
原文标题:AI Model Groupthink
- 中国模型在默认模式下更倾向于给出符合大众共识的答案,独立性相对较弱。
- 简单的系统提示词(如“给出你的独立观点”)能显著打破模型间的同质化回答。
- 不同模型变体(如 Flash/Small vs. Reasoning)在顺从度上存在差异,推理模式可能影响独立性。
AI 聚簇研判事件 · 2026/10/7
AI Model Groupthink: Chinese Models Lean Toward Consensus in Ranking Tests
一项针对 12 个主流 AI 模型的“Top 3”推荐测试显示,中国模型在缺乏特定指令时更易顺应广泛共识,表现出显著的“群体思维”特征。该研究通过构建 Web 工具收集模型独立排名,发现默认设置下模型倾向于趋同,而明确要求“独立观点”的系统提示词能有效提升多样性。这一现象揭示了当前大模型在 RLHF 对齐过程中可能存在的过度顺从风险,对多智能体系统的去中心化决策设计具有警示意义。
原文标题:AI Model Groupthink