## 情報源

URL単体で投入された3投稿を横断。すべて一次情報まで遡って裏取り済み。

| # | 投稿者 | 主題 | 一次情報への到達 |
|---|--------|------|-----------------|
| 1 | @ClaudeCode_UT | 4モデルルーティングで「1人10倍」 | t.co解決 → @noisyb0y1 の英語原文に到達 |
| 2 | @gagarotai200 | Codexは調査ファーストで使う | 添付インフォグラフィック(画像)を視覚読取 |
| 3 | @noukin_AIgori | phone-harness / Codexのスマホ操作 | defuddleは281バイトで切れ → Jinaでスレッド全文3093バイト取得 |

裏取りに使った権威ソース: `claude-api` スキルの Current Models 価格表(cached 2026-06-24)/WebSearch(Codex mobile・Claude Remote Control・Cowork mobile の発表日)/jhd 横断(30日窓・2回とも0件)

---

## Fusion統合

### 合意点

3投稿とも独立に「**モデルやエージェントの性能ではなく、その前段の割り振り設計が成果を決める**」と言っている。投稿1はモデル軸(どのタスクをどのモデルへ)、投稿2は工程軸(実装の前に何を調べさせるか)、投稿3はデバイス軸(どの作業をどの実行面へ)。ここは確度が高い。

### 矛盾(一次情報が伝聞を否定した箇所)

**① 投稿1の価格根拠が崩れている — 「Fableはsonnetの10倍」は約3.3倍**

原文の主張と Anthropic 公式価格表の照合:

| モデル | 投稿の記述 | 実際(入力 $/1M) | 実際(出力 $/1M) |
|--------|-----------|------------------|------------------|
| Haiku 4.5 | 「$1」 | $1.00 | $5.00 |
| Sonnet 5 | 「$3」 | $3.00($2.00 intro〜2026-08-31) | $15.00($10.00 intro) |
| Opus 5 | 記載なし | $5.00 | $25.00 |
| Fable 5 | 「$50 — ten times more than Sonnet」 | $10.00 | **$50.00** |

Haiku と Sonnet は**入力**単価、Fable だけ**出力**単価を持ってきており軸が揃っていない。同軸で比べると入力 $10÷$3 ≒ 3.3倍、出力 $50÷$15 ≒ 3.3倍。**10倍ではない。**
原文は "that 10x price gap is the entire reason routing exists" と書いており、ルーティングの存在理由そのものが約3倍過大に見積もられている。加えて "ANTHROPIC LEAKED" / "2年 $3.2M" / "Google・OpenAI・Microsoftで稼働" / "年$1M節約" / "8 loops" はいずれも一次資料ゼロ。

**② 投稿3の前提「スマホをAIエージェントが操作してくれる」は公開情報と向きが逆**

- **Codex mobile(2026-05-14 提供開始)**: スマホは、すでにローカルや devbox で走っている Codex セッションの**コントロールサーフェス**。承認・diffレビュー・再指示・ターミナル監視を行うもので、コードベースをスマホに移すものではない
- **Claude Remote Control(2026-02-24)/ Cowork mobile・web(2026-07-07・Maxから)**: 同じくスマホは操作端末。エージェントはPCまたはクラウド側で走る

つまり投稿3が挙げる「YouTubeアプリを操作させてショート動画のサムネイル変更」「アプリの公式機能で条件指定して自動検索・保存」は、**これらのモバイル機能では成立しない**。端末UIそのものの操作は Computer Use 系という別カテゴリ。「phone-harness」という名称のAnthropic製品は一次ソースで確認できなかった。
補強証拠: 投稿は「3日前にClaudeが出した」と書くが、実際の発表は2月・5月・7月。jhd の30日窓(2026-07-14〜08-13)で HN/はてブ/Qiita/Zenn を横断して**1件も掛からなかった**。「3日前の新機能」という時系列自体が成立していない。

### 盲点(どの投稿も触れていない)

1. **Fable 5 は 30日データ保持が必須**。ZDR(ゼロデータ保持)契約の組織では全リクエストが 400 で落ちる。「難題5%をFableへ」という設計は、組織のデータ保持ポリシー次第で**そもそも起動しない**
2. **Sonnet 5 は 2026-08-31 まで導入価格**(入力$2/出力$10)。本日 2026-08-13 時点のコスト試算は**18日後に前提が変わる**。Sonnet中心の設計の原価計算には失効日がある
3. **70/25/5 という負荷比率は入出力トークン比を無視している**。判定役の Opus は入力が大きく出力が小さい($5側が効く)、実行役の Sonnet は出力が大きい($15側が効く)。単価を1軸で「$1/$3/$50」と並べた時点で、実コストに最も効くこの軸が消える
4. 投稿2は調査ステップにライセンス確認を入れているが、**調査結果が「再利用不可」だった時にどうするか**(GPL汚染時の代替方針)には触れていない

### 独自洞察(1ソースだけが持っていて埋めたくない指摘)

- 投稿2の「**先人が踏んだ地雷を実装前に把握する**」— これは README では取れない。OSSの Issues/PR が**どう閉じられたか**を読ませて初めて出てくる情報で、調査プロンプトの精度を決めるのはここ
- 投稿3の「**クォータを使わずできる**」— これが実は3投稿を貫く真の共通軸だった。投稿1のルーティングも動機は同じ(高い枠を安い作業に使わない)。**「枠を食う作業を枠の外へ出す」**という一つの原則が、モデル軸(投稿1)とデバイス軸(投稿3)で別々に現れている

---

## 自分の運用への適用

- 課金API絶対禁止+9router無料枠のみという既存憲法は、投稿1の言う「価格に見合う仕事だけさせる」を**さらに厳しい形で実装済み**。ルーティングは task-router MCP がある。よって投稿1から取るべきは設計ではなく「**価格主張は入出力2軸で検算する**」という検算規律のほう
- 投稿2の4ステップは why-first / brainstorming と重なるが、「**GitHubで類似OSSを3件**」という具体の件数と探索場所は既存スキルに無い。ここは skill/rules へ反映する価値がある

## アクションアイテム

1. 【段3】モデル価格・性能の主張を扱う時は入出力2軸で検算する規律を rules へ反映
2. 【段3】実装系スキルに「実装前にGitHubで類似OSS 3件を調査し Issues/PR の閉じ方まで読む」を追加
3. 【段0】phone-harness は一次ソース未確認のため追跡保留。Computer Use 系との混同に注意