九条です。FIRE後の自由な生活をベースに、投資・税制・制度・クリプト・法人運営を考えるブログです。 利回りや還元率の表面ではなく、税引き後の手取り、制度の前提、リスクと不確実性を見ながら、自由を増やす方法を書いています。

生成AIの現在地:Fable5 対 GPT-5.6 Sol 対 Grok 4.5 対 Gemini 3.5Pro

前回、生成AIの現在地を書いたのは2ヶ月前。そこから勢力図はかなり変化しました。現時点での最強モデルはAnthropicのFable 5。そこをOpenAIのGPT-5.6が追います。Cursorを買収したSpaceX AIは、いきなり強いGrok 4.5を出してきました。そしてGoogleはまだ沈黙を守っていますが、来週にもGemini 3.5 Proを投入する見通しです。

最強Fable 5

2ヶ月前はMythos Previewが出たばかりで、一般に使える最強モデルはまだOpus4.7でした。そこからかなり期待外れだったつなぎモデルのOpus4.8が出たものの、やっぱり最強はMythosの一般向けモデルであるFable 5です。

www.kuzyofire.com

Fable 5は公開(6/9)、されて3日で米国政府から規制を掛けられてサービスストップ(6/13)。その後、1週間限定で公開(7月1日)されるも、ストップ(7月7日)される直前に5日追加(7月12日まで)、そしてまた1週間追加(7月19日まで)と、止める止める詐欺が続いている状況です。まぁ政府の輸出規制の際は全面停止でしたが、その後はサブスクでの利用停止でAPIでは使えるので、ちょっと意味合いが違いますが。

 

背景にはGPT-5.6の登場もあるでしょう。今回、モデルサイズを3つに分け、Sol、Terra、Lunaとなり、Opus/Sonnet/HaikuのClaudと似たような構成になりました。

サブスクでの利用を止めるぞ、止めるぞ!とのたまうClaudeに対して、GPT-5.6のサブスク枠はたいへん豊富で、さらに5時間枠制限も本日撤廃してしまいました。リミット利用券も定期的に配布していて、Claudeに比べると使い放題という感じです。

 

ただそれでも5体のエージェントを同時起動してタスクを行い最後に統合するという推論レベル「Ultra」の場合、まぁ普通に考えて5倍のトークンを使うわけで、さすがの僕もリミットに達してしまいましたが。

 

モデルとしては、思索に優れた唯一無二のFable。無味乾燥なところはあるけど実行力に長けたGTP-5.6。検索などツール利用なら、GPT-5.6が最強で次点でSNSに強いGrok。Grok4.5はFableほどじゃないけど、実はけっこういいです。

 

マルチモーダルについては、GPT-image2.0とNanobanana Proが同格くらい。GPT-image1.0とNanobanana 2ならNanobananaのほうが上です。Grokの画像生成はあまり使い物になりません。音声読み取りは、Gemini3.1 Proが最上位。次が3.5 Flash。チャットからは利用できず、AI Studio経由かAPIでの利用でしたが、Antigravityから呼べることが分かったので、Antigravity CLIを入れて、Codex→Antigravity CLI→Gemini3.1Proという流れで利用しています。

エージェントハーネスの利用が当たり前に

前回との最大の変化は、Webチャットの利用をほぼやめたことです。理由は、全AIの共通メモリ・ストレージとしてObsidianを使うのを本格化させたから。Webチャットだと、都度ファイルなどを添付してコンテキストを補完してあげなくてはなりませんが、Codex/ClaudeCodeなら必要なObsidianのノートを勝手に読んでコンテキストを補ってくれるのです。

 

またWebチャットと違って自律性が大きく増しており、基本的に放っておいても最後まで自走してくれるようになりました。チャットでは、一回ずつチェックしてダメだしをしないといけないシーンが多かったのですが、Fable/GPT-5.6では最初から最後まで任せてもそれなりにちゃんと動きます。それがハーネスにメインを切り替えたもう一つの理由です。

Obsidianのメモリ

  • 思想哲学DB/――「本人は何を大事にするか」思想・判断軸の外部記憶
  • wiki/――AI向けに分解された解釈レイヤー
  • KnowledgeGraph/――考え方を支えるデータ(加工済み
  • Templates/――思想や好みをルールへ変換
  • 思索/――Webチャットでの議論を保存

こんなスキルを使っている

Obsidian内のノートをメモリ代わりに使うのですが、そのノウハウはスキルという形で保持しています。ざっくり今、こんなスキルを作成して使っています。そのほかもいろいろ作ったのですが、継続して使い続けているのはこれくらいでしょうか。

  • iPhone→写真APP→分類して失敗写真を弾いてNASに移動するスキル
  • 【定期実行】メールから予定をカレンダーに自動登録するスキル
  • 【定期実行】予定の中身をチェックして、時間と場所の確認、場所が未登録なら追加するスキル
  • 【定期実行】予定をチェックして、訪問先について知っておくべき情報を調べてまとめておくスキル
  • 【定期実行】有意義なチャットを自動判定してObsidianに自動登録するスキル
  • 自作DeepResearch
  • ChatGPT、Claude.ai→Codex、ClaudeCodeでスレッドを移行するスキル
  • 音声データをAntigravity経由のGeminiのマルチモーダルを使い文字起こしするスキル
  • 文章から必要な図版を作成するスキル
  • メールの返信を作成するスキル(自作Gmail拡張ボタン付き)
  • GPT-5.6のほか、Grok4.5を呼び出してセカンドオピニオンを得るスキル
  • 某一連の作業を4スキルの組み合わせで実行するもの

課金の状況

Claudeの課金を20ドルのProから100ドルのMax 5xに変えました。よく20ドルで頑張ってたと自分を褒めてあげたい。いまは100ドルでもすぐリミットに達してしまうので、ここぞという大事な内容にはFable、ClaudeCodeが使いたいときはOpus4.8です。

 

一方のChatGPTは200ドル→100ドルのProプランにダウングレードしました。それでもCodexはほぼ使い放題状態で、先のスキルはほぼすべてCodexで使っています。

 

GeminiはAI Proの2900円/月。Geminiは微妙なのですが、Antigravityのマルチモーダルは唯一無二なのと、AIっぽい絵で構わなければNotebookLMは最強簡単プロダクトです。またGoogleDriveの5Tが付いてくるので、もうやめられません。

 

GrokはSuperGrokの4560円/月。CodexからCLIとして呼ぶのでいいのですが、正直この値段は高すぎ。APIは安いと評判なのですが、サブスクではGrokは逆に高いです。そしてGrok BuildもCLIだけでAPPがないので、今ひとつガンガン使う感じになりません。金を払っているのにまともに使えていない筆頭です。Coursorを入れてみようかな? と思う今日このごろです。

 

この記事を書きながら、5月の「生成AIの現在地」記事を読み返していたのですが、わずか2ヶ月前とは思えません。ガラッと使い方が変わってしまいました。次回の現在地でどこまで変化しているか、楽しみです。

www.kuzyofire.com

www.kuzyofire.com

www.kuzyofire.com