Aleph Alpha发布中国AI模型政治倾向基准测试结果
热点事件持续更新
Aleph Alpha发布中国AI模型政治倾向基准测试结果
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
2026年10月4日,人工智能公司Aleph Alpha发布了一项基准测试结果。该测试评估了阿里巴巴(Qwen)、深度求索(DeepSeek)和月之暗面(Kimi)等中国AI模型在涉及天安门、台湾、新疆等967个敏感话题上的回答。结果显示,这些中国模型仅有17%至41%的回答被系统评为“平衡”,其余回答则重复国家立场、回避或拒绝回答。作为对比,在相同测试中,Claude Sonnet 5和Mistral Small模型分别有70%和92%的回答是平衡的。研究还指出,这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。
AI 根据报道生成 · 3 小时前更新
最新进展10月4日 16:47
中国 AI 模型在敏感话题上遵循国家立场或拒绝回答报道时间线
沿着报道,了解事件的不同侧面。
10月4日
- The Decoder中国 AI 模型在敏感话题上遵循国家立场或拒绝回答
Aleph Alpha 的研究显示,中国 AI 模型在涉及天安门、台湾、新疆等 967 个敏感话题时,仅有 17% 至 41% 的回答被其系统评为“平衡”,其余则重复国家立场、回避或拒绝回答。在相同测试中,Claude Sonnet 5 和 Mistral Small 分别有 70% 和 92% 的回答是平衡的。这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。