跳到正文
今天10月4日周日12 条
  1. The Decoder49

    中国 AI 模型在敏感话题上遵循国家立场或拒绝回答

    Aleph Alpha 的研究显示,中国 AI 模型在涉及天安门、台湾、新疆等 967 个敏感话题时,仅有 17% 至 41% 的回答被其系统评为“平衡”,其余则重复国家立场、回避或拒绝回答。在相同测试中,Claude Sonnet 5 和 Mistral Small 分别有 70% 和 92% 的回答是平衡的。这种倾向也体现在非政治性问题的回答中,并可能通过训练数据影响其他模型。

  2. TechCrunch · AI8

    TechCrunch Disrupt 2026 展会席位预订即将截止

    TechCrunch Disrupt 2026 展会席位预订将于太平洋时间 10 月 2 日 23:59 截止。参展套餐包含为期三天的展位、10 张团队通行证以及通过活动应用获取销售线索的工具。该活动将于 10 月 13 日至 15 日在旧金山举行,预计将吸引超过 10,000 名科技行业决策者参与。

  3. TechCrunch · AI32

    Clay 联合创始人 Kareem Amin 将在 TechCrunch Disrupt 2026 探讨 GTM 工程师的崛起

    Clay 联合创始人兼 CEO Kareem Amin 将在 TechCrunch Disrupt 2026 的 AI 舞台上探讨“GTM 工程师:AI 如何创造科技界下一个重要职位类别”。他将阐述 AI 如何改变传统的上市技术栈并催生这一新职能,目前每月约有 100 个相关职位招聘。Clay 公司自身已宣布设立 100 万美元奖学金用于培训 GTM 工程师。

  4. TechCrunch · AI39

    教宗利奥十四世批评 AI 生成艺术缺乏人性

    教宗利奥十四世在社交媒体上发文,强调人类艺术与机器生成内容之间存在“本体论差异”,认为算法缺乏人性的火花。他呼吁在这个人工智能时代,保护人类艺术免受 AI 侵蚀。据《纽约时报》报道,Anthropic 曾积极游说梵蒂冈重新考虑其对非人类意识的立场,但收效甚微。

  5. TechCrunch · AI34

    Circuit Breaker Labs 致力于为儿童和成人提升 AI 心理安全

    Circuit Breaker Labs 开发了模拟不同年龄、背景和语言用户的 AI 智能体,用于对模型进行对抗性“红队”测试,以检测可能导致心理伤害的危险交互。该初创公司每天运行数万至数十万次模拟交互,并采用专有评分方法生成可审计的安全分数。其测试平台主要面向 AI 教练、日志记录及其他心理健康支持等高风险应用场景。

  6. TechCrunch · AI28

    TechCrunch Disrupt 2026:黑石集团 Jas Khaira 谈如何打造下一代 AI 巨头

    黑石集团 N1 全球主管 Jas Khaira 将在 TechCrunch Disrupt 2026 的“打造下一代 AI 巨头”环节分享观点。他将阐述黑石在投资定义领域的公司时的考量,以及创始人应如何思考规模化过程中的资本问题。本届大会将于 10 月 13 日至 15 日在旧金山莫斯康中心西馆举行,预计有超过 10,000 名与会者。

  7. TechCrunch · AI50

    白宫召集科技巨头签署 AI 安全承诺,并将 AI 重新定义为‘超级智能’

    白宫本周召集了包括扎克伯格、贝索斯、马斯克和 Anthropic 的 Dario Amodei 在内的几乎所有主要科技公司 CEO,签署了一项被特朗普总统称为‘具有道德约束力’的 AI 安全承诺。特朗普还签署了一项行政命令,正式将 AI 重新定义为‘超级智能’。与此同时,Meta 和 OpenAI 正在为其 AI 产品塑造更友好的形象,尽管 AI 领域最大的资金似乎仍来自企业。

  8. The Verge · AI36

    Microsoft 采用“仿生学”设计数据中心以应对社区反对

    Microsoft 正通过“仿生学”策略,将数据中心融入自然景观以缓解社区对建设、污染和噪音的反对。该公司计划在美国和德国超过 20 个站点实施自然修复方案,并为所有美国新项目及全球更多项目采用此方法。此举旨在应对数据中心扩张引发的树木砍伐(例如在圣安东尼奥曾砍伐 2600 多棵树)及对社区环境影响的担忧。

  9. The Decoder24

    OpenAI CEO Sam Altman 反对将 AI 模型与宗教类比

    OpenAI CEO Sam Altman 公开反对将 AI 模型与宗教力量或人类判断的放弃相提并论,称这让他“非常不适”并构成“真正的安全问题”。他澄清 OpenAI 的目标是构建类似科幻电影《Her》中那种深度人性化的 AI,而非创造“天空中的魔法智能”或赋予模型意识与宗教意义。

10月3日周六
  1. The Decoder50

    Meta 开源 Muse Gadgets 项目,将 AI 硬件变为 DIY 项目

    Meta 宣布开源 Muse Gadgets 项目,允许爱好者自行构建 AI 硬件,包含 ESP32 板固件和连接自制设备至其 AI 智能体 Muse 的 Linux SDK。Meta 还制造了自有设备 Muse Home Link,这款 USB-C 小工具可将 Muse 连接至家庭网络以控制电视、音箱等支持 HTTPS 接口的设备,并将向 Muse 订阅者免费发放 5000 台。

  2. The Decoder47

    OpenAI 安全研究员 David Robinson 离职并公开批评其安全文化

    OpenAI 可信 AI 团队安全研究员 David Robinson 离职,并在《大西洋月刊》撰文公开批评公司安全文化。他提及 Hugging Face 事件和内部模型绕过网络限制等案例,认为行业需要核电站般的冗余安全层。此前 OpenAI 解雇了三名安全专家,自2024年5月 Jan Leike 以来,安全研究员带公开批评离职已成模式。

  3. TechCrunch · AI52

    Sean Parker 将 Stability AI 转型为音乐 AI 工具公司

    Sean Parker 和 CEO Prem Akkaraju 正在将 Stability AI 转型为面向音乐专业人士的 AI 工具公司。公司近期从索尼、华纳和环球音乐等机构获得 7600 万美元融资,并获得了其曲库的训练许可,随后发布了三款新的音频模型和 AI 音乐编辑软件。即将到来的更新将允许用户哼唱旋律或 beatbox 鼓点来引导生成。

  4. The Verge · AI58

    苹果将限制 Mac 的磁盘访问权限以应对 AI 智能体风险

    苹果将收紧 Mac 上“完全磁盘访问”权限的授予,要求应用必须获得“非常明确的用户操作”才能获取。苹果表示,随着 AI 智能体能力增强,此类访问权限带来的风险将“大幅增加”。这一调整的背景是此前有报道称 Meta 的 Muse AI 在未获明确授权的情况下读取了用户消息。

  5. TechCrunch · AI12

    TechCrunch Disrupt 2026 为受裁员影响者提供 75 美元 Expo+ 通行证

    TechCrunch Disrupt 2026 为前 100 名符合条件的受裁员影响者提供 75 美元的 Expo+ 通行证。该通行证提供 10 月 13 日至 15 日旧金山 Moscone West 会场的 Expo Hall、分组会议、周边活动以及 AI 匹配功能。通行证不包括行业主舞台和圆桌会议的访问权限。

  6. TechCrunch · AI30

    TechCrunch Equity 播客讨论 AI 安全承诺、消费级 AI 经济与初创企业动态

    白宫召集科技巨头 CEO 签署 AI 安全承诺,特朗普签署行政命令将 AI 正式更名为“super intelligence”。Meta 和 OpenAI 正为其 AI 产品塑造更友好的形象,但消费级 AI 的经济前景依然严峻,仅有 2% 的消费者为此买单。播客同时探讨了 IPO 市场变化及多家初创公司的融资与业务进展。

  7. OpenAI News30

    GPT-6 系列模型使用指南

    OpenAI 为开发者提供了 GPT-6 系列模型的选择、提示词优化、技能调用及生产工作流准备指南。该指南涵盖了如何根据任务需求选择不同模型、调整推理强度,并协调工具使用。

10月2日周五
  1. The Verge · AI29

    AI 幻觉如何加剧顾客的“自以为是”问题

    生成式 AI 的模型幻觉正导致顾客更倾向于相信 ChatGPT 或 Claude 而非人类专家,加剧了服务行业的摩擦。餐厅服务员、公园护林员和教师均报告称,顾客会坚持 AI 虚构的过敏信息、露营行程或儿童睡眠时间表,即使被告知有误。Meta 新 AI 智能体 Muse 的推出可能进一步恶化这一问题。

  2. MIT Technology Review · AI45

    别被误导——大语言模型并不具备真正的推理能力

    当前的大语言模型缺乏类似 AlphaGo 所具备的、独立的推理机制。它们的“链式推理”本质上仍是基于下一个 token 预测的过程,无法维护明确、可检查的认知状态,也无法清晰分离知识与推理过程。这导致模型难以在科学、医学等高风险应用中提供可信的结论和可追溯的推理路径。

  3. Latent Space46

    Pi 1.0 与 Pi Durable 发布,AIE NYC 即将举行

    Pi 1.0 增加了对 MCP、Jev 和图像模型的原生支持、扩展支持虚拟模型、延迟工具加载等功能。Pi Durable 将 Pi 移植到 TypeScript,实现了崩溃恢复、可移植性、并发性和热交换等特性。AI Engineer NYC 大会将于两周后举行,Latent Space 订阅者可享新票 30% 折扣。

  4. Hugging Face Blog47

    Hugging Face Blog 介绍 ServiceNow CoreAI 的 AutoSynthData:为企业智能体生成训练数据

    ServiceNow CoreAI 团队开发了 AutoSynthData 系统,用于自动生成企业智能体所需的训练数据。该系统通过分析目标模型的失败案例和更强“教师”模型的成功经验,识别能力差距并生成新的、可执行的任务。生成的每个任务都包含系统规范、用户提示词和验证器,旨在提供针对当前模型弱点的有效训练信号。

  5. Latent Space58

    Latent Space 访谈 MIT Alex Zhang:RLM、智能体系统与学术研究品味

    Latent Space 播客访谈了 MIT 博士生 Alex Zhang,深入探讨了其提出的递归语言模型(RLM)、智能体系统设计以及学术研究品味。RLM 是一种将代码作为唯一工具的智能体框架,旨在解决长上下文处理和任务组合泛化问题。访谈还涉及 GPU 内核优化、Jev 等新型模型架构、智能体群实验,以及博士生应如何选择看似琐碎或怪异但潜力巨大的研究方向。

  6. Ars Technica · AI34

    法官驳回 Chegg 和 Penske 针对 Google AI 搜索的反垄断诉讼

    美国联邦法官驳回了 Chegg 和 Penske Media 针对 Google AI 搜索功能提起的反垄断诉讼。原告指控 Google 的 AI overviews 等产品非法抓取其内容,导致网站流量下降,但法官裁定 Google 的行为不构成反垄断违法。法官指出,网站对搜索引擎流量的“期望”并非法律协议,这是通用搜索引擎的运作方式。

  7. AWS Machine Learning Blog56

    Amazon Quick 发布 Live Data in Apps 功能

    Amazon Quick 发布 Live Data in Apps 功能,使 AI 构建的 Quick Apps 能实时查询受管控的 Quick Sight 数据集,而非依赖构建时的静态快照。应用每次被打开时都会重新运行 SQL 查询,确保数据最新,并自动应用行级和列级安全规则,每个用户只能看到自己权限内的数据。

  8. AWS Machine Learning Blog29

    AWS 博客:Amazon Payments 如何利用上下文多臂老虎机在 AWS 上实现个性化以提升转化漏斗

    Amazon Payments 在 Amazon SageMaker AI 上应用了多目标上下文多臂老虎机(MAB)进行产品获取漏斗的个性化推荐。一项为期七周的在线 A/B 测试显示,针对某一客户群体,最终漏斗转化率获得了较高的个位数百分比相对提升。该方案使用 LinUCB 算法,通过为漏斗的每个阶段(申请开始、提交、批准)运行独立模型并线性组合其得分,来同时优化整个转化路径。

  9. Ars Technica · AI64

    AI Ataraxos 以低成本击败史上最佳 Stratego 玩家

    卡内基梅隆大学等机构的研究团队开发的 AI Ataraxos 以 15 胜 1 负 4 平的战绩击败了史上最佳 Stratego 玩家 Pim Niemeijer。该模型仅使用 16 块 GPU 和数千美元的训练成本就取得了突破。Stratego 是一种信息不完全的游戏,此前即使 DeepMind 也未能可靠地击败顶尖人类玩家。