Garry Tan wants US open-weight AI labs to 'distill' frontier models, too
402 points • 1 day agoArticle Link

Y Combinator 的 CEO Garry Tan 反对监管机构打击 AI 蒸馏(distillation)的做法。所谓蒸馏,是指开发者通过对一个 AI 模型的提示,诱导其暴露信息处理方式,再利用这些输出训练另一个模型。

尽管包括 Anthropic 的 CEO Dario Amodei 在内的一些行业领袖呼吁政府介入,以防他们所称的非法蒸馏攻击,Tan 认为不应实施这样的监管。相反,他主张美国应当建立并鼓励自己的蒸馏体系,支持规模较小的美国开放权重(open-weight)AI 实验室对前沿模型采用这些训练方法,从而形成更有竞争力的格局。通过此举,美国可以培育起强大的开放权重替代生态,以挑战大型专有 AI 提供商的主导地位。

Tan 强调,他并不鼓励使用被盗凭证或欺诈手段访问模型;他认为前沿 AI 实验室无权限制客户如何利用通过 API 交互获得的信息。他还指出,用知识产权为由反对蒸馏具有讽刺意味——这些专有机构在训练自身系统时,往往未经许可就吸收了大量受版权保护的人类知识。

在 Tan 看来,该行业面临的最大危险是权力被某个单一巨头垄断。他警告,如果一家拥有雄厚资本和顶尖研究人才的专有供应商被允许一枝独秀,市场将走向对创新和公众访问极为不利的局面。支持开放权重模型,是他希望确保人工智能的强大能力保持可访问性与平衡、而不是被限制性服务条款锁死的一条路径。

223 comments • Comments Link

- AI 的基本伦理存在争议。有人认为 frontier models 主要建立在对受版权保护作品的未经授权"掠夺式开采"之上,因此开发者关于限制这些模型使用的道德主张显得站不住脚。

- 对 intellectual property 安全的担忧很高。许多用户对 "Zero Data Retention" (ZDR) 政策持怀疑态度,认为这不过是来自曾有绕过 copyright 倾向的机构的、难以执行的口头承诺。

- 把公司称作 "labs" 的行业做法越来越受批评:这被视为一种营销策略,用来塑造科学与亲社会发现的形象,而实际上是通过大量挖掘公共数据来生产 proprietary 产品。

- Model distillation(用一个模型的输出去训练另一个模型)被一些人视作必要的竞争手段和一种 "fair use",尤其是在原始模型本身建立在未经授权使用人类集体知识的基础之上时。

- Regulatory capture 是一项重大关切:人们担心现有的 frontier labs 正在借助 "safety" 叙事寻求政府干预,以阻止竞争对手获得他们首创的技术。

- Open-weights models 的支持者认为,让 AI 获取更加民主化对长期创新至关重要,这可防止少数实体垄断主要的 intellectual production 引擎。

- 人们对当前 AI 商业模式的可持续性仍持怀疑:高额训练成本和模型的商品化表明现行融资策略在结构上可能存在问题。

- 对 closed-weight models 的不信任正在上升。有声音警告,隐藏的偏见、潜在后门或强势实体的意识形态篡改,可能使 open-weights 比 proprietary 服务的 "mystery-box" 特性更受欢迎。

- AI 开发的经济模式受到质疑:如果公司的商业模式依赖于从公共资源中提取价值却不作公平补偿,那么它们就没有权利要求保证的投资回报。

- 有人提议将领先的 AI laboratories 国有化,或强制为 distillation 提供 "fair-price" 的获取渠道,作为潜在保障,以确保 AI 能力成为公共产品而非被锁定的 proprietary 资产。

这种讨论反映出 pioneering AI labs 与更广泛开发者社区之间根深蒂固的紧张关系,主要源于对 intellectual property 被窃取和排他性市场策略的认知。公众明显更支持 open-weights models,视其为抵御垄断控制和 black box 系统不透明性的一种手段。尽管部分利益相关者担心持续对训练数据进行 distillation 会损害 AI 研究的经济可行性,越来越多的人认为,当前建立在不透明数据抓取和 regulatory gatekeeping 之上的路径在道德和运营层面上都是不可持续的。