据YouTuber PewDiePie称,OpenAI在他打造Ajax期间两次封禁了他的账号。Ajax是一款小型AI模型,旨在运行在你自己的电脑上,并为你浏览网页。他在YouTube频道发布的新视频中讲述了这段经历。
Ajax是他所说的“微调AI模型”。这意味着在一个现有模型基础上,为某项特定任务再进行额外训练。在这里,这项任务是运行在他6月推出的免费、自托管AI应用Odysseus中。
在自己的机器上运行这类模型,可以把电子邮件和日历保留在本地,而不是放在公司的服务器上。它也没有订阅费,不过计算负担要由你自己的硬件承担。
据称,Ajax是一款基于阿里巴巴开源Qwen 3.5构建的90亿参数模型。参数是构成AI“脑力”的可调数值,通常参数越多,被认为能力越强。该模型目前仍在等待发布,但PewDiePie表示,一旦他认为准备好了,就会在自己的网站上提供下载。

两次封禁
PewDiePie说,他原本想从OpenAI于7月9日发布的旗舰模型GPT-5.6 Sol进行蒸馏。蒸馏是指用一个更大模型的回答来训练一个更小的AI,有点像学生抄下班里学霸的作业。
他看中的,是Sol的推理token,也就是模型在解决问题时,会在隐藏草稿纸上写下的文本片段。OpenAI会对这块草稿纸进行加密。
在视频中,他说自己找到了一项研究,可以通过OpenAI自己的API破解这一机制。他还表示,自己绝不会真正“破解”OpenAI,但OpenAI还是封了他的账号。他称这一封禁没有正当理由,并提出异议,之后账号在某个时间恢复了在线。
随后,他说自己再次使用Sol生成种子数据,也就是模型学习用的起始示例,OpenAI第二次封禁了他。OpenAI的使用条款禁止将其输出用于开发竞争性模型,因此他再次被封。
研究人员在8月展示,来自OpenAI、Anthropic和Google的加密推理块可以被重放给一个更弱的“姐妹模型”,从而让后者把它们以明文写出来。他们从公开代码仓库中解码出了315,320个这样的片段。
9月30日,OpenAI表示,它挫败了一场由与Moonshot AI有关联的人士发起的行动,这些人试图提取其模型隐藏的推理内容。该公司称,它关闭了一条可让某人重放另一位用户加密推理、并恢复其内容的路径。
把AI里的“拒绝”拿掉
为了让Ajax变成“无审查”——也就是对ChatGPT式助手会拒绝的请求也给出回答——PewDiePie使用了Heretic,这是一款开源工具,用来移除模型内置的拒绝机制。它会比较模型对有害提示和无害提示的反应,找出拒绝模式背后的规律,并将其切除。
这种做法被称为“abliteration”,本质上是一种让模型“失去判断能力”的技术,这样它就不需要通过越狱来绕过限制,因为它会始终同意执行被要求做的事情。
这种“手术”并不完美。PewDiePie说,Ajax因此“有一点脑损伤”,但它在整理收件箱和浏览网页等任务上的表现,约有十分之九的成功率。
他还在用GRPO继续训练它,这是一种让模型对同一任务尝试16次,并从成功的尝试中学习的方法。
PewDiePie说,他会自行选择要移除哪些拒绝,并把界限划在“对他人造成伤害或对自己造成伤害”。他表示,自己的律师建议他说明,Ajax并不是为了提供危险、可执行的操作指引而设计的。
小模型,大卖点
他为小模型辩护的理由是成本和能耗。按照他自己的粗略估算,一份据称拥有万亿参数的前沿模型,需要大约27台他的电脑,以及相当于约150户家庭的用电量。
PewDiePie把Ajax称为第一版。他说,自己还需要重新执行一次去拒答处理,然后对模型进行压缩(量化)和基准测试,以确认没有出问题。
Ajax目前还不能下载。起初,下载页面上有一个倒计时,指向日本时间10月3日08:25。现在,这个计时器已经不见了。












