跳到正文
今天10月4日周日1 条
  1. The Decoder49

    中国 AI 模型在敏感话题上遵循国家立场或拒绝回答

    Aleph Alpha 的研究显示,中国 AI 模型在涉及天安门、台湾、新疆等 967 个敏感话题时,仅有 17% 至 41% 的回答被其系统评为“平衡”,其余则重复国家立场、回避或拒绝回答。在相同测试中,Claude Sonnet 5 和 Mistral Small 分别有 70% 和 92% 的回答是平衡的。这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。

10月3日周六
10月1日周四
9月30日周三
9月29日周二
  1. Hugging Face Blog60

    NVIDIA Kumo Tabular 开源表格预测基础模型

    NVIDIA 开源了用于表格分类和回归的基础模型 Kumo Tabular,无需训练、微调或特征工程即可对新行进行预测。该模型在 TabArena、BeyondArena、TALENT 和 ScoringBench 四个基准测试中均排名第一,并提供三种参数量版本(28M 至 215M)。

    推荐理由:原文给出了模型在多个基准测试中的领先表现和无需训练即可预测的能力,读者可以据此判断它在表格预测任务上的潜力。

8月17日周一
8月10日周一
  1. Import AI37

    Import AI 468:23 项应对 RSI 的政策建议、PostTrainBench+ 以及信任与透明度如何影响 AI 竞赛

    智库 IFP 提出了 23 项应对 AI 研发自动化(RSI)风险的具体政策建议,涵盖提升透明度、增强国家能力等七个类别。MIT 与哥伦比亚大学的研究则表明,在 AI 竞赛中实现协调减速的关键在于技术发展的透明度以及对竞争对手作为理性、可信赖行为体的信任。