跳到正文
热点事件持续更新

Aleph Alpha发布中国AI模型政治倾向基准测试结果

1 篇报道1 个报道来源4 小时前更新

先了解这件事

AI 综述

2026年10月4日,人工智能公司Aleph Alpha发布了一项基准测试结果。该测试评估了阿里巴巴(Qwen)、深度求索(DeepSeek)和月之暗面(Kimi)等中国AI模型在涉及天安门、台湾、新疆等967个敏感话题上的回答。结果显示,这些中国模型仅有17%至41%的回答被系统评为“平衡”,其余回答则重复国家立场、回避或拒绝回答。作为对比,在相同测试中,Claude Sonnet 5和Mistral Small模型分别有70%和92%的回答是平衡的。研究还指出,这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月4日
  1. The Decoder
    中国 AI 模型在敏感话题上遵循国家立场或拒绝回答

    Aleph Alpha 的研究显示,中国 AI 模型在涉及天安门、台湾、新疆等 967 个敏感话题时,仅有 17% 至 41% 的回答被其系统评为“平衡”,其余则重复国家立场、回避或拒绝回答。在相同测试中,Claude Sonnet 5 和 Mistral Small 分别有 70% 和 92% 的回答是平衡的。这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。