Qwen 3.8 follows GPT-5.5 Pro reasoning prefills
0 points • unknown timeArticle Link

Reasoning prefill 实验研究了强制开源大语言模型采用来自专有 teacher model 的初始推理步骤会产生什么影响。研究人员将 teacher model 推理过程的前 1% 插入目标模型的推理通道,从而观察目标模型后续输出是否向 teacher 的风格和内容靠拢。本次迭代中以 GPT-5.5 Pro 作为 teacher,分析指标为目标模型响应中对 teacher 可见答案的召回率。

研究在 45 个不同任务上对四个模型进行了评估,任务涵盖 STEM 学科、非 STEM 主题与合成谜题。结果显示 Qwen3.8 A95B 在提供 prefill 后表现出显著提升,与 teacher 的对齐度提高了 18.18 个百分点;在 STEM 类别中这一提升尤为明显,达到了 26.99 个百分点,表明推理预填能有效将模型输出锚定到 teacher 的认知路径上。

其他模型的结果则较为温和或各有差异:DeepSeek V4 Flash 的对齐度略有下降,Inkling 略有改善;Kimi K3 本身就与 GPT-5.5 Pro 保持最高的基线重合度,无论是否加入 prefill 都得分较高,加入 prefill 仅带来 4.54 个百分点的边际增长。这些发现暗示 Kimi K3 相较其他被测模型,可能在训练数据或风格上本就更接近 GPT 系列。

Qwen3.8 A95B 在本次实验中的突出表现提示其可能使用了由 GPT-5.5 Pro 或极为相似模型生成的数据进行训练;这一猜测也得到了其在私有合成谜题上的表现支持——尽管题目具有新颖性,该模型仍明显倾向于镜像 teacher 的推理路径。总体而言,本实验揭示了主导性的 teacher model 对各类开源模型行为与输出模式的潜在影响,说明推理层面的痕迹能够有效塑造模型响应。

0 comments • Comments Link

- 我个人观察到 AI 的推理轨迹往往表现出一种"讨好但焦虑"的人格:面对自相矛盾的提示或错误时,模型偶尔会陷入混乱或作出不合逻辑的回应。

- 关于模型蒸馏的研究发现,有方法可以从专有的前沿模型中提取推理轨迹,并将这些轨迹作为预训练数据,用以提升开源模型或下游模型的逻辑一致性和输出质量。

- 有证据表明,像 Qwen 这样的模型可能使用了来自前沿模型的推理轨迹作为训练数据,这可以从这些模型在受到特定专有"思维前缀"引导时所展现的推理模式之间的统计相关性看出端倪。

- 偶尔观察到的"穴居人式"或高度缩略的推理痕迹,通常是特定提示配置、系统指令和高强度推理设置的副产品,而不是模型本身的普遍特征。

- 推理轨迹(作为内部逻辑草稿)与最终输出是不同的:模型通常分别针对不同目标对这两部分进行训练和优化,这可能导致语气或风格上的不一致。

- 通过对前沿模型输出进行训练以实现蒸馏,被一些人视为技术进步的必然阶段,这与历史上新进入者借鉴并迭代早期创新者技术的发展模式一致。

- 关于前沿实验室是否有道德权利来反对蒸馏,各方仍然存在争论,部分原因在于这些实验室自己的基础模型也是在未征得原作者同意的情况下、基于大量互联网数据训练出来的。

- 用户非常重视能够在本地部署高性能模型的能力(即便这些模型是从专有来源蒸馏而来),他们更看重可及性和自主性,而非依赖基于云的封闭前沿系统换来的边际性能提升。

- 一些观察者将对蒸馏的依赖解读为某些实验室采取"快速跟进"战略的证据,认为这表明它们在前沿创新方面可能严重落后。

- 技术持续充当"省力工具"的角色,使用户能够绕过繁重工作;这种动态正被 AI 代理日益模仿——它们通过寻找满足用户请求的更高效路径来最小化不必要的工作量。

本次讨论聚焦于 AI 透明度、模型蒸馏机制以及当前人工智能"军备竞赛"的地缘政治影响。尽管研究人员已经开发出恢复和分析内部推理轨迹的技术,这在机器学习时代引发了关于知识产权的激烈争论。许多参与者对看到专有"护城河"被开放获取模型蚕食感到欣慰,并指出行业历史上广泛进行数据抓取的做法,使其难以在道德上自居。最终,这次讨论突显出追求前沿规模创新与用户对高性能、可自主部署且不依赖集中式专有生态系统的实际需求之间存在明显分歧。