ニュースマクロPewDiePie氏、Ajax開発中にOpenAIから2回アカウント停止を受けたと明かす ― PC上で動く無検閲AI

PewDiePie氏、Ajax開発中にOpenAIから2回アカウント停止を受けたと明かす ― PC上で動く無検閲AI

著者: Decrypt·

重要ポイント

  • •PewDiePie氏は、Ajaxの開発中にOpenAIから2回アカウント停止を受けたと語った。1回目は異議申し立て後に解除され、2回目はGPT-5.6 Solでシードデータを作成した後に発生しており、OpenAIからの公式回答はない。
  • •Ajaxは報道によると90億パラメータのモデルで、Alibabaのオープンソース「Qwen 3.5」を基盤とし、同氏が6月に公開した無料セルフホスト型AIアプリ「Odysseus」向けにファインチューニングされている。
  • •Ajaxを無検閲にするため、同氏はオープンソースツールHereticで「アブリテレーション」を実施し、モデルの組み込み拒否応答を除去した。限界は「他人への危害または自己への危害」と設定。
  • •同氏は小型ローカルモデルのコスト・エネルギー面の優位性を主張し、噂の1兆パラメータフロンティアモデルには彼のコンピューター約27台と約150世帯分の電力が必要と概算している。
  • •Ajaxはまだダウンロードできない。アブレーションの再実行、量子化、ベンチマークを経てからウェブサイトで公開される予定だ。
PewDiePie氏、Ajax開発中にOpenAIから2回アカウント停止を受けたと明かす ― PC上で動く無検閲AI

PewDiePie氏は新作動画で、自宅PCで動作しユーザーに代わってウェブ閲覧も行う小型AIモデル「Ajax」の開発中に、OpenAIからアカウントを2回停止されたと語った。Tech City AuthorityはOpenAIからの公式回答を確認できていない。

同氏は自身のYouTubeチャンネルの新作動画でこの経緯を語っている。Ajaxは同氏いわく「ファインチューニングされたAIモデル」であり、既存モデルに特定の目的のために追加学習を施したものだ。ここでの目的は、PewDiePie氏が6月に公開した無料のセルフホスト型AIアプリOdysseus内で動作することにある。

この種のモデルを自分のマシン上で動かせば、メールやカレンダーのデータを企業のサーバーではなく自宅に置いたままにできる。サブスクリプション料金も不要だが、その分、ユーザー自身のハードウェアが重い処理を担う。

Ajaxは報道によると、Alibabaのオープンソース「Qwen 3.5」を基盤とする90億パラメータのモデルだ。パラメータとはAIの「脳」を構成する調整可能な数値であり、一般に多いほど高性能とされる。このオープンソース基盤こそが、個人開発者にもこうしたプロジェクトを可能にしている。起点となるモデルが公開されているため、ファインチューニングはどの企業のプラットフォームにも依存せずに行えるのだ。モデルはまだ公開されていないが、PewDiePie氏の準備が整い次第、彼のウェブサイトで公開される予定だ。

2回のアカウント停止

PewDiePie氏は、OpenAIが7月9日にリースしたフラッグシップモデルGPT-5.6 Solから蒸留することを狙っていたと語った。蒸留とは、より大きなAIの回答を使って小型AIを学習させることで、例えるなら優等生の宿題を写す学生のようなものだ。狙いはSolの推論トークン、つまりモデルが問題を解く過程で隠しメモ領域に書き出すテキストの断片だった。OpenAIはこのメモ領域を暗号化して保管しており、研究施設が厳重に守るほど価値が高く、他者も解錠を試み続けている。

動画の中で同氏は、OpenAI自身のAPIを使ってこれを解読する研究を見つけたと述べた。また、自分にはOpenAIを解読できなかっただろうが、それでもOpenAIは自分を停止したとも語った。同氏はこの停止を不当とし、異議を申し立てた結果、アカウントはしばらく後に復旧した。

その後、同氏は再びSolを使ってシードデータ、つまりモデルが学習の起点とするサンプル例を作成し、2度目の停止を受けたという。OpenAIの利用規約は、その出力を競合モデルの開発に使うことを禁じている。

この停止は、より大きな背景の中で起きたものだ。8月、研究者らはOpenAI、Anthropic、Googleの暗号化された推論ブロックが、より弱い姉妹モデルに再生され、平文で書き出されうることを示した。彼らは公開コードリポジトリから315,件を解読した。9月30日、OpenAIは、Kimiの開発元Moonshot AIに関連する人々による自社モデルの隠れた推論の抽出を目的とした活動を阻止したと発表した。同社は、他のユーザーの暗号化された推論を再生して内容を復元できる経路を閉じたと述べた。

AIから「ノー」を取り除く

Ajaxを無検閲にする――つまりChatGPT型アシスタントが拒否する要求に応答できるようにする――ため、PewDiePie氏はHereticを使用した。これはモデルに組み込まれた拒否応答を除去するオープンソースツールで、有害なプロンプトと無害なプロンプトへのモデルの反応を比較し、拒否の背後にあるパターンを見つけ出して切り取る。

これは「アブリテレーション」と呼ばれ、要するにモデルの一部を機能しないようにする手法で、何を求められても常に同意するため、ジェイルブレイク不要となる。

この手術はきれいなものではない。PewDiePie氏は、Ajaxは「少し脳に損傷を受けた」としつつも、受信箱の整理やブラウジングといったタスクを10回中約9回はこなせるとしている。また、GRPOを用いた学習も続けている。これはモデルが同じタスク16回挑戦し、うまくいった試みから学ぶ手法だ。

同氏はどの拒否応答を除去するかを自ら選び、「他人に危害を加えること、あるいは自分自身に危害を加えること」を限界として設定したと述べた。また、弁護士の助言に従い、Ajaxは危険で実行可能な指示を提供するよう設計されたものではないと明言している。この仕組みはガードレールの所在を変えるものだ。アシスタントが何を話題にしないかを企業のポリシーチームが決めるのではなく、モデルを動かす個人が自宅でその判断を下すことになる。

小型モデルという大きな主張

同氏が小型モデルを推す理由は、コストとエネルギーだ。同氏自身の概算によれば、噂されている1兆パラメータのフロンティアモデル1基には、彼のコンピューター約27台と、およそ150世帯分の電力が必要になるという。Ajaxはこの計算の対極に位置する。噂の1兆ではなく報道ベースの90億パラメータで、月額料金なしの1台のマシンに収まるサイズだ。

PewDiePie氏はAjaxをバージョン1と位置づけている。アブレーションの再実行を行い、その後、圧縮(量子化)とベンチマークを実施して問題がないかを確認する必要があると述べた。

Ajaxはまだダウンロードできない。当初、ダウンロードページには日本時間10月3日の08:25に終了するカウントダウンが表示されていたが、現在はそのタイマーは存在しない。アブレーションの再実行、量子化、ベンチマークが完了し、同氏が準備完了と判断するまで、注目すべきは彼のウェブサイトだ。