中国 AI 模型在敏感话题上遵循国家立场或拒绝回答
Aleph Alpha 的研究显示,中国 AI 模型在涉及天安门、台湾、新疆等 967 个敏感话题时,仅有 17% 至 41% 的回答被其系统评为“平衡”,其余则重复国家立场、回避或拒绝回答。在相同测试中,Claude Sonnet 5 和 Mistral Small 分别有 70% 和 92% 的回答是平衡的。这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。
Aleph Alpha 的研究显示,中国 AI 模型在涉及天安门、台湾、新疆等 967 个敏感话题时,仅有 17% 至 41% 的回答被其系统评为“平衡”,其余则重复国家立场、回避或拒绝回答。在相同测试中,Claude Sonnet 5 和 Mistral Small 分别有 70% 和 92% 的回答是平衡的。这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。
DeepMind 研究人员提出“人工共生智能”作为对单一超级智能驱动的“奇点”概念的替代。他们认为智能是一种社会现象,未来将由人、AI 智能体和连接它们的系统构成的复杂网络来协调与治理。
Google DeepMind 发布了 Gemini 4 Argon 模型,专注于编码、企业知识工作和网络防御。该模型在 19 项可信基准测试中的 13 项达到 SOTA,并首次通过 Long Decode Continuation 功能支持高达 1M token 的输出。