## 情報源
- 形式: お姉様が貼った X の URL 13件(2026-09-23〜24 投稿)。本文は syndication API とログイン済み headless Chrome(shadow)で全文を取得。Jina は x.com 匿名ブロック中(403 AbuseAlleviation)
- クラスタ: Jev 8件 / Claude Code×Opus 5.5 2件 / Google AI Pro×Colab 3件 / その他 1件(TensorTrade)
## A. Jev(TypeSafe の System One モデル)
対象: @0xCarnagee「Opus 5.5 に送るプロンプト」+記事「Jev Engineering 10 steps」(14.3万view) / @eng_khairallah1 記事「How to Actually Build Your First AI Agent Brain」(4.6万view) / @tetumemo 紹介 / @1920web1080・@unicodef1wn「Grok Bot 12体+Jev で会社」/ @unicodef1wn「Jev 関連 GitHub 10本」/ @0xCVYH「Eikos」
### 合意点(複数ソース一致・確度高)
- 分担は「LLM=生成 / Jev=選択・点数・yes/no / コード=正確な規則・副作用・権限 / 人間=曖昧で高リスクなもの」。Carnage・Khairallah・unicode が同じ図を描いている
- 質問はまとめて1回で投げる(並列評価で遅延ほぼ不変)。9/21 の自前実測(5問 278ms ≒ 1問 294ms)と一致
- 確信度でゲートする(動作ごとに閾値。お金・送信・不可逆は高い閾値+人間)
- 入力 $0.042/MTok・出力無料(自前メモ jev-system-one-model と一致)
### 矛盾(どちらが一次か)
- 「Cannot hallucinate」(Carnage) vs 「スキーマ外は返さないが、正しくない有効値は返す。0%は実測でなく構造からの演繹」(Khairallah・TypeSafe 公式の注記) → 後者が一次に近い
- Carnage のコスト表で Claude Sonnet 5 を $3/$15 としているが、同梱 claude-api スキル(2026-06-24 時点のキャッシュ)では Sonnet 5 は $2/$10。$3/$15 は Sonnet 4.6 の単価。50k トークンの分類で「$0.15/回」→ 実際は約 $0.10/回。月額比較 $1,500 も約 $1,000 に下がる(それでも Jev の約50倍)
- ベンチ: Eikos 投稿は「JevBench 難: Jev 73.0%」、Khairallah は「TypeSafe 自社の4ワークフロー評価で約 67.8%」。別のベンチの数字で、比べられない
- GitHub スター数: unicode の記載(例 jev-ultrafast ~16.6k)は 2026-09-24 の gh api 実測(19,376★)より少ない。10本とも実在し、作成日はすべて 9/16〜9/18(公開の翌日〜3日後)
### 盲点(どのソースも触れていない)
- Carnage のプロンプトは「自前の Messages API ハーネス」向けで、Claude Code 向けではない。per-message effort・mid-conversation tool changes・clear_at は API の beta で、Claude Code のサブスク利用ではユーザーからは触れない。プロンプトの末尾自身が「Claude Code / Agent SDK が組むリクエストなら、どのノブが公開されているか先に教えろ」と書いている
- beta ヘッダの裏取り(同梱 claude-api スキル): thinking-display-updates-2026-08-18 / mid-conversation-system-clear-at-2026-08-21 / mid-conversation-output-config-2026-07-01 / mid-conversation-tool-changes-2026-07-01 は実在。**compact-2026-09-04 はスキルに無い**(スキル記載は compact-2026-01-12)→ 未確認として扱う
- 注意: per-message effort の対応モデルは、スキル内で「Fable 5.1 / Mythos 5.1 / Opus 5」と書く箇所と、Opus 5.5 の表で「supported」とする箇所がある。Opus 5.5 で使う前にドキュメントで確認する
- 許可判定の設計: jev_allow は「noul < 0.2 なら人に聞かずに実行」。外部の確率1つで承認を省く形で、自前の方針(Jev はゲートで、決定的な判定と OR で組む/赤ゾーンは確認)と合わない。コマンド文字列は外部 API(api.typesafe.ai)へ送られる
- 13件はすべて投稿者本人の記事の宣伝か、紹介の連鎖。TypeSafe の外で再現した評価はまだ無い(Khairallah 自身もそう書いている)
### 独自洞察(1ソースだけ・埋もれさせない)
- Khairallah の「失敗の型」: 字義どおりに読む(否定・暗黙の条件)/ 数えられない / 日付を順序として扱えない / 状態が長いと精度が落ちる / 外の知識を持たない / **state を敵対的に扱わない**(ユーザー入力を state に入れるなら注入の脅威モデルは自前で持つ)。対策: 数える・日付を比べるのはコード、1項目ずつ Noul に聞く、フィールドは絞ってから渡す
- バージョンを固定する: jev-latest は現在 jev-1.13.0 を指し、上がると閾値が黙ってずれる。応答の model を毎回ログに残す
- 質問のフィールド名は Jev に渡らない。要件は instructions と criteria に書く
- 確率が平らに返ったら、選択肢が state から区別できていない合図(モデルの迷いではない)
- Carnage の jev_allow は「判定はコマンドと引数だけで行い、ツール出力は渡さない」。注入対策として筋がよい(採用可能な部分)
- Eikos(MIT・4B/27B): HF に caiovicentino1/Eikos-27B が実在(2026-09-23 作成・DL 0・likes 7)。データは作者が合成したもので、ベンチは自己申告 → 未検証
## B. Claude Code × Opus 5.5
- @daniel_mac8(2,474 fav): `/claude-api prompt-audit` で skills・CLAUDE.md・AGENTS.md の古い書き方を掃除する。**実在を確認**: 同梱 claude-api スキルのサブコマンド表に prompt-audit があり、shared/prompt-audit.md(Step 0〜4: 範囲とモデル決定→棚卸し→出所→行ごとの削除判定→型別スキャン)に従って、報告と diff 案を確認なしで出す。編集の適用は依頼で明示されたときだけ
- @commte 節約チートシート: effort は普段 medium・詰まったら high / high で2回詰まれば Fable・解決したら Opus に戻す / 検索は Sonnet・Haiku・編集は Opus / API は5分空けると割高(キャッシュ TTL)・サブスクは1時間で枠を消費 / モデルと effort は区切りで変える・MCP を抜き差ししない(キャッシュが壊れる)/ 別件は /clear・区切りで /compact / CLAUDE.md は200行・詳細は別ファイル / /usage で実測・prompt-audit で点検
- 自前の CLAUDE.md は「100行未満」でより厳しい。Opus 5.5 の effort 既定は medium(スキルで確認)で、チートシートの「普段 medium」と一致
## C. Google AI Pro に Colab が同梱(公式 @GoogleColab 発表の引用あり)
- @tetumemo / @sora_biz / @studio_yebisu: Pro/Ultra 加入者は Colab の上位アクセラレータを優先利用。sora_biz は「月200CCU」「5TB の Drive に大型のオープン LLM を置いてマウント」「CPU ランタイムのままダウンロードすれば CCU を使わない」
- 自前はすでに AGENTS.md に colab-on-demand(残高確認つきランナー)あり。新しい知見は「重みを Drive に置き、ダウンロードは CPU ランタイムで行う」の1点
- 盲点: Drive からの 57GB 読み込みにかかる時間は誰も測っていない(返信の質問にも答えなし)。「200CCU」の数字はプランの一次情報で未確認
## D. その他
- @quantscience_「BREAKING: 新しい Python ライブラリ TensorTrade」→ 誤り。tensortrade-org/tensortrade は **2019-07-30 作成**(7,158★・最終 push 2026-02-19)。新しくない。宣伝の煽り
## アクションアイテム
1. Carnage のプロンプトは Claude Code には適用しない(API 用・自動承認の設計が方針と合わない)。自前の Messages API ハーネスを作るときに dry_run 部分だけを参考にする
2. `/claude-api prompt-audit` を ~/.claude(CLAUDE.md・rules・skills)に報告のみで実行する。ai-base#853 の棚卸しの続きとして別セッションで行う
3. 自前の Jev ゲートで jev-1.13.0 を固定し、応答の model をログに残しているか確認する(ai-base#858 の範囲)
4. Colab ジョブの重みは Drive に置き、ダウンロードは CPU ランタイムで行う(colab-on-demand スキルに1行足す候補)
Jev×Opus 5.5×Colab X学習 2026-09-24