AIxクリプトx投資をテック目線で観測🔭
「まだ言語化されていない心地よい隙間」を日々散策しています。
イケハヤさんの投稿から始まった、小さな違和感
きっかけはこちらのポストでした。
https://x.com/ihayato/status/2090047964106666135
最近、イケハヤさんが、Fable5(Claude Fable 5)を使ったゲームコンテンツ開発の中で「急に頭が悪くなった」という趣旨の投稿をされています。
しかもMaxプランで10アカウント以上、重課金で回されているとのことで。
これだけ本気で投入している方が「おかしくなった」と言っているのは、ちょっと見過ごせないなと思ったんですよね。
スクショも拝見したんですが、事実確認に何往復もさせられたり、すでに存在するものをまた一から作ろうとしたり。
「あなたが作ったやつやん」と指摘されても、まだ探そうとしている、という状況だったようです。
ここから、自分なりに2つの仮説を立てて、AIと一緒に深掘りしていきました。
目次
イケハヤさんの投稿から始まった、小さな違和感
仮説1:サイレントナーフ説(提供側がリソースを絞った)
仮説2:コンテキスト腐敗説(擦り続けた末の閾値超え)
重課金で挑んだ先にあった、避けられない壁
AIの整理は本当に人間より優秀なのか?
閾値を超えると"急に"崩壊するのはなぜか
オカルト気味の裏説…でも意外と筋が通ってる
フロンティアAIに全部委ねられない、という結論
エンジニアの生き残り方を、控えめに考えてみる
仮説1:サイレントナーフ説(提供側がリソースを絞った)
まず一つ目の仮説は、提供側(Anthropic)が計算資源を絞ったのではないか、というものです。
Fable5はもともと計算資源をかなり食うモデルだと言われていて、過去にも「復活後にガードレールが強くなりすぎてOpusに頻繁にフォールバックする」という報告が繰り返し出ています。
最近もX上で「計算資源が逼迫しているのでは」「サイレントナーフが起きているのでは」という指摘が散見されていたりします。
特にMaxプランを10アカウント以上重課金で回すという使い方は、提供側から見ると「単一ユーザーによる異常な高負荷」に映る可能性があるかもです💦
そういうケースでは、明示的な制限というより、品質を落としたルーティングやスロットリングがかかることがある、というのが一つ目の仮説です。
これはかなり有力だと感じました。
仮説2:コンテキスト腐敗説(擦り続けた末の閾値超え)
もう一つの仮説が、1つのゲームコンテンツを長期間・高密度で擦り続けたことによる、コンテキスト不足やハルシネーションです。
ゲーム開発、特に長期間にわたる高密度なコンテンツ作りでは、同じ世界観・同じ仕様・同じファイル群を何十、何百ターンも擦り続けることになります。
LLMはコンテキストが長くなるほど、あるいは同じパターンの対話が続くほど、以下のようなことが起きやすくなります。
過去の自分の出力を「既にある」と認識できなくなる
確認行動が増え、無駄な往復が増える
「もう分かってるはず」の情報を再提案してしまう
一定の複雑さやトークン量を超えると急に注意力が散漫になる
これ、「あなたが作ったやつやん」と言われてもまだ探している、というスクショの挙動とかなり整合的なんですよね。
純粋な能力低下というより、「この会話の文脈がすでに飽和しているサイン」に近いという可能性もあります。
そして重課金で複数アカウントを回していても、個々のセッション単位でのコンテキスト汚染は避けられません。
つまりこの2つの仮説は排他的ではなく、重なっている可能性が高いというのが、最初の考察の着地点でした。
重課金で挑んだ先にあった、避けられない壁
ここで一つ、実践的な問いを立ててみました。
イケハヤさんのように、構造の積み上げを全部Fable5に任せて、圧倒的なリソースを投じて突き進むスタイルだと、この劣化は起きやすいのか。
一定の人間の介入によってmdやナレッジの整理をしておけば、大規模開発でも耐えうるものなのか。
正直、Maxプランを10アカウント以上、しかも重課金で回すというのは、誰にでもできることではないです。
身銭を切って、自分の手でフロンティアの限界を試してくれている、という意味では、リスペクトしかありません。
その上で答えを聞いてみると、こうした本気の投入量であっても劣化は起きやすく、人間が定期的に整理・圧縮しておくとかなり耐えられるようになる、というものでした。
なぜ「AIにコンテキストを積み上げ続ける」形だと劣化が起きやすいかというと、以下のような構造的な問題があるからだそうです。
コンテキストの腐敗:失敗した試行や古い決定、重複情報が積み上がり続け、モデルはそれを「今も有効な知識」として扱ってしまう
知識の外部化不足:頭の中だけで仕様を積み上げると、セッションを跨いだ瞬間にほぼリセットされる
自己強化ループ:AIが自分で書いたものを自分で読み直して拡張していくうちに、初期の小さな誤解が増幅されていく
つまり、どれだけリソースを投じても、個々のセッション内のコンテキスト汚染そのものは解決しない、というのが正直な結論のようです。
これは重課金勢のやり方が間違っているという話では全くなくて、むしろ誰よりも早くこの壁を実体験で発見したという貴重なエビデンスだと考えています。
じゃあどうすればいいのかというと、CLAUDE.mdのようなルールファイルを「軽量で生きた契約書」にすること、階層化してプログレッシブ・ディスクロージャーを意識すること、そして何より人間による定期的な「圧縮とクリーンアップ」が一番効くとのことでした。
大きなタスクに入るときは思い切って/clearする、進捗は常に外部ファイルに残す、失敗したアプローチも明示的に書いておく。
地味ですけど、こういう規律が効くみたいです。
AIの整理は本当に人間より優秀なのか?
ここで一つ、自分の中でひっかかったことがありました。
ClaudeのハーネスとFable5なら、人間が積み上げるよりそこら辺の整理まで優秀なのでは
と思っていたんですよね。
これを聞いてみたところ、結論としては「整理の質と性質が根本的に違う」という答えが返ってきました。
AI側が優秀なのは事実で、速度と網羅性、一貫したフォーマット、疲労ゼロ、過去の失敗パターンの抽出などは人間を大きく上回るとのこと。
ただ、決定的に違う点がいくつかあるようで。
一つは「何が本質で、何がゴミか」の判断基準です。
AIは今ある情報を整合的にまとめるのは得意だけど、「この決定自体がもう時代遅れだから捨てる」という判断は弱いらしくて。
もう一つは、文脈の「重み」を持っていないこと。
人間は「この仕様は苦労して決めたから簡単に変えたくない」といった、数字に現れない重みを持っているけど、AIはそれをテキスト上の事実としてしか扱えない。
結果として、綺麗に整理されたドキュメントが「実態とズレた公式見解」になりやすいというのは、なかなか的を射ているなと思いました。
あと「捨てる」判断が苦手というのも印象的でした。
整理の本質は情報を減らすことなのに、AIは追加・構造化・詳細化の方向に働きやすい。
本当に不要なものをバッサリ切る勇気は、まだ人間の方に分があるようです。
つまり分業としては、AIに「整理の下書き・提案・網羅的な洗い出し」をさせて、人間が「最終的な取捨選択と方向性の決定」を行う、という形が一番安定するとのことでした。
閾値を超えると"急に"崩壊するのはなぜか
ここまでの整理で、仮説2のコンテキスト腐敗というのは、基本的には「じわじわ劣化していくもの」というイメージで捉えていました。
ただ、SNSの投稿を見る限り、劣化はなだらかというより、ある日を境に「急に」という肌勘ですよね。
だとすると、仮説2はそもそも今回の体感とは繋がらないのでは、という疑問が浮かびました。
仮説2のコンテキスト飽和でも「ある閾値を超えると急に」ということはあり得るのか、という疑問です。
結論、これも十分にあり得るとのことで、理由が3つ挙げられていました。
一つ目は、アテンション(注意力)の希釈です。
処理できるトークン量の限界に達した瞬間、注意力が極端に分散して、AとBの繋がりを突然見失う。
コップの水が表面張力で耐えていたのに、最後の一滴で一気に溢れる現象に似ている、という例えがしっくりきました。
二つ目は、矛盾とノイズの蓄積です。
ノイズがある程度まではジェンガのようにバランスを取ってカバーされるけど、限界を超えると突然論理が破綻する。
三つ目は、見えないシステムプロンプトの切り捨てです。
コンテキスト長の上限に近づくと、最も古い会話から順に内部で切り捨てられたり、雑な要約に置き換えられたりすることがあり、その結果、一番最初に設定した重要なルール(CLAUDE.mdの内容など)が突然消失することがあるそうです。
なだらかに劣化するというより、「崖から落ちる」ようなイメージなんですね。
オカルト気味の裏説…でも意外と筋が通ってる
ここで、自分の中で一つの仮説というか、裏説が浮かびました。
最近Fableがバカになったという声が他のポストでも散見されているので、文脈的には仮説1のサイレントナーフ説が強く見える。
ただ、Fableがリリースされてまだ数ヶ月しか経っていない。
だとすると、アーリーで飛びついた重課金勢が一定の負荷で何かのクリエイティブを擦り続けていて、たまたま仮説2の閾値に達するタイミングが同時にこの時期に起こった、という裏説もあり得るのでは、と。
AIもそれに賛同する形で、理由としては、こんな感じでした。
開発サイクルの同調:リリース直後に飛びついた重課金勢のコンテキスト肥大化ペースは似通いやすく、2〜3ヶ月というのはモデルの処理限界に一斉に到達するにはリアルなタイムスパンである
KVキャッシュの肥大化とサーバー負荷:長大な文脈を保持し続けるユーザーが同時期に急増すると、サーバー側のメモリを尋常でない規模で圧迫する
仮説2が仮説1を引き起こした可能性:重課金勢が一斉に限界トークン付近で複雑な推論を回し始めたことで、システム全体のリソースが逼迫し、結果として運営側が古い文脈の切り捨てや推論リソースの制限を急遽導入した、という因果関係
つまり、モデル自体が劣化したのではなく、ヘビーユーザーたちのプロジェクトの文脈サイズが一斉に実効的な認知限界の崖を超えたか、あるいは限界を迎えたユーザー群の負荷に耐えかねて運営側が一律の制限フィルターをかけたか。
ユーザー側の利用フェーズと、提供側のシステム制限が、最悪のタイミングで衝突した結果ではないか、という見方です。
これが正しいかどうかは正直分かりません。
ただ、単純に「ナーフされた」で終わらせるより、こういう視点を持っておくと構造の理解が一段深くなる気がしますね。
フロンティアAIに全部委ねられない、という結論
ここまでの考察を踏まえて、一つ辛辣な結論に行き着きました。
持続的なAIリソースの利用という観点においては、フロンティアモデル会社の信頼性と品質について、今回の事象は厳しく捉えるべきだと思います。
保証や責任を取る立場でフロンティアAIをどこまで許容して利用できるかを考えると、どうしても後発になってしまうし、正直手が出せない、という結論になってしまうんですよね。
提供側の都合で突然パフォーマンスが劣化したり、挙動が変わったりするブラックボックスなモデルに、コアシステムを丸投げすることは、ビジネスとして責任や品質保証を担う立場からすると到底許容できない。(そりゃそうだけど)
そういう意味でも一定足を踏み入れない領域を一定示してくれたというのは、いい意味で捉えるべきだと思います。
エンジニアの生き残り方を、控えめに考えてみる
ここで一つ、正直に書いておきたいことがあります。
最近SNSを見ていると、エンジニアが非エンジニアの成果に対して、使ってもいないのに知識と経験だけでケチをつけに行く、みたいな場面をよく見かけます。
それ、正直ダサいし、老害でしかないなと自分は感じていて。
イケハヤさんのように、実際に手を動かして、身銭を切って、フロンティアの限界まで試してくれている方に対して、外野から知識だけで文句を言うのは一番やってはいけないことだと思っています。
その上で、あえて自分の立場を正直に書くと、AIがここまで進化してくると、エンジニアという職業自体、今後一定は淘汰されていくんだろうなと感じています。
だからこそ「じゃあエンジニアはどこに行き場を見出すのか」というのは、他人事ではなく、自分にとっても切実な問いなんですよね。
そういう前提で考えたときに、生き残る道としてあり得るかもしれないと思った一つが、「AIの劣化や限界を前提とした、堅牢なシステムアーキテクチャの構築」という方向性です。
あくまで数ある可能性の中の一つで、これが正解だと言い切るつもりは全くないんですが、例えばこんなアプローチはヒントになるのかもしれません。
コンテキストの外部化と自律管理:AIの頭の中に文脈を積み上げるのではなく、外部のナレッジベースやMarkdownに状態を持たせ、必要な時だけクリーンなコンテキストを注入する仕組み
自律エージェントの分散とオーケストレーション:単一の巨大モデルに全部処理させるのではなく、役割を細分化した複数のエージェントを連携させ、ファシリテーター役が整理・検証する多段的な設計
ハイブリッドなインフラストラクチャ:常に最高性能のクラウドAPIに依存するのではなく、メモリやプロンプトキャッシュ、コンテキスト長を厳密に自前でコントロールできるローカルLLM環境を併用する
単なる「AIの利用者」として振る舞うのではなく、AIの特性と限界を理解した上で、構造化されたプロセスの中に安全に組み込んでいく側に回れないか。
そんな、ささやかな生存戦略の一つとして、こういう視点もあるのかなと思った次第です。
イケハヤさんの一つの投稿から始まった考察でしたが、掘っていくとフロンティアAI時代の構造的な課題と、その中で自分がどう立ち回れるかという問いにまで行き着きました。
まだ実践していない想像の部分も多いですし、偉そうなことを言える立場でもないんですが、この辺りの勘所、今後実際に手を動かしながら検証していきたいなと思っています。
最後までお読み頂き、ありがとうございます
kinamon♬







やりとりするたびに、CLAUDE.mdに書き込んでくれるので、どんどん長くなっていくのが気になっていたのですが、定期的に整理して軽くする方が良いのですね。(フォルダもどんどん増えて、管理が大変になるなあと感じています)
とても勉強になります🙂↕️