跳到正文
10月3日周六
10月2日周五
  1. MIT Technology Review · AI45

    别被误导——大语言模型并不具备真正的推理能力

    当前的大语言模型缺乏类似 AlphaGo 所具备的、独立的推理机制。它们的“链式推理”本质上仍是基于下一个 token 预测的过程,无法维护明确、可检查的认知状态,也无法清晰分离知识与推理过程。这导致模型难以在科学、医学等高风险应用中提供可信的结论和可追溯的推理路径。

  2. Latent Space58

    Latent Space 访谈 MIT Alex Zhang:RLM、智能体系统与学术研究品味

    Latent Space 播客访谈了 MIT 博士生 Alex Zhang,深入探讨了其提出的递归语言模型(RLM)、智能体系统设计以及学术研究品味。RLM 是一种将代码作为唯一工具的智能体框架,旨在解决长上下文处理和任务组合泛化问题。访谈还涉及 GPU 内核优化、Jev 等新型模型架构、智能体群实验,以及博士生应如何选择看似琐碎或怪异但潜力巨大的研究方向。