omnilane 0.10.2 → 0.10.3

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
package/CHANGELOG.md CHANGED
@@ -6,6 +6,45 @@ semantic version tags.
6
6
 
7
7
  ## [Unreleased]
8
8
 
9
+ ## [0.10.3] - 2026-07-26
10
+
11
+ ### Changed
12
+
13
+ - Restructured all five localized READMEs for first-time readers: a plain
14
+ "what is this and why would I want it" section now opens the document,
15
+ version history is consolidated into a single section at the bottom instead
16
+ of interrupting the introduction, and a new FAQ answers the recurring
17
+ questions — whether every subscription is required, where code is sent, why
18
+ Claude Fable 5 is absent from the defaults, why the Claude lanes use `xhigh`
19
+ rather than `max`, what happens when a lane's first-choice CLI is missing,
20
+ and whether a dispatched worker can edit files.
21
+ - Documented the Claude Fable 5 routing decision with measurements rather than
22
+ cost alone: Artificial Analysis calls Opus 5 (61) and Fable 5 (60)
23
+ "effectively tied" on the Intelligence Index and Epoch AI ranks them the
24
+ other way, but Opus 5 leads AA-Briefcase by 146 Elo and GDPval-AA v2 by 114
25
+ Elo at 20% lower cost per task, so the top Claude tier stays a main-loop
26
+ choice rather than a dispatch target.
27
+
28
+ ### Fixed
29
+
30
+ - `plugin.json` and `.claude-plugin/plugin.json` still advertised `0.10.0`
31
+ after the 0.10.1 and 0.10.2 releases, so plugin installations reported a
32
+ stale version. Both now track `VERSION`, and the release version test that
33
+ covers them passes again.
34
+ - `routing.local.yaml.example` shipped starter profiles pinned to retired
35
+ models: seven `claude-opus-4-8` references now use `claude-opus-5` with
36
+ lane-appropriate effort, and the Gemini 3.5 Flash candidates move to 3.6
37
+ Flash, matching the defaults since 0.10.0.
38
+ - Corrected the Artificial Analysis Intelligence Index figures in
39
+ `docs/model-capabilities-2026-07.md` against the source article (index
40
+ points, not percentages; Fable 5 60 and GPT-5.6 Sol 59), added the
41
+ AA-Briefcase / GDPval-AA v2 comparison, and recorded the two results that
42
+ cut against the defaults: Fable 5 leads on factual knowledge, and GPT-5.6 Sol
43
+ leads on presentation quality.
44
+ - Replaced the stale "Anthropic positions Fable 5 above Opus 4.8" note in
45
+ `routing.yaml` and `skills/omnilane/SKILL.md`, which had not been updated
46
+ when Opus 5 shipped.
47
+
9
48
  ## [0.10.2] - 2026-07-26
10
49
 
11
50
  ### Changed
@@ -372,7 +411,8 @@ semantic version tags.
372
411
  - Initial shared routing table, cross-vendor dispatcher, runners, installer,
373
412
  and baseline lint fixes.
374
413
 
375
- [Unreleased]: https://github.com/Seraphim0916/omnilane/compare/v0.10.2...HEAD
414
+ [Unreleased]: https://github.com/Seraphim0916/omnilane/compare/v0.10.3...HEAD
415
+ [0.10.3]: https://github.com/Seraphim0916/omnilane/compare/v0.10.2...v0.10.3
376
416
  [0.10.2]: https://github.com/Seraphim0916/omnilane/compare/v0.10.1...v0.10.2
377
417
  [0.10.1]: https://github.com/Seraphim0916/omnilane/compare/v0.9.1...v0.10.1
378
418
  [0.10.0]: https://github.com/Seraphim0916/omnilane/compare/v0.9.1...1ea55e5
package/README.ja.md CHANGED
@@ -21,48 +21,30 @@
21
21
 
22
22
  ---
23
23
 
24
- ## 2026-07-25 更新
24
+ ## 🤔 omnilane とは
25
25
 
26
- - デフォルトルーティングに `claude-opus-5` を追加しました。`hard-judgment` と `taste-final` の第一候補となり、最難関のコーディング作業でもフォールバックとして利用できます。
27
- - `omnilane configure` を全 13 プロバイダーへ拡張しました。選択可能なモデルは 106 件で、CodexClaude Code、Grok Build、Antigravity の最新カタログに加え、検証済みの OpenRouter/OpenCode ショートカットを収録しています。`c` によるカスタムモデル ID の入力も引き続き利用できます。
26
+ **何が問題か。** すでに AI コーディングアシスタント——**Claude Code、Codex、
27
+ CursorGemini CLI** など——を使っていますよね。どれも一つのモデルファミリー
28
+ としかやり取りしません。つまり、頼んだ作業はすべて同じモデルで走ります。適任か
29
+ どうかに関係なく——使い捨てのファイル名変更が最も高価なモデルを消費し、本当に
30
+ 難しい設計上の問いは、たまたま開いていたモデルに当たります。
28
31
 
29
- ---
30
- ## 👋 はじめての方へ
31
-
32
- すでに AI コーディングアシスタント——**Claude Code、Codex、Cursor、Gemini
33
- CLI** など——を使っていますよね。どれも一度に一つの AI モデルとやり取りし、
34
- 「どのタスクにどのモデルが最適か」の判断はあなた任せです。
35
-
36
- **omnilane がその判断を代行します。** 一つひとつの作業を、それに最も強い(そして最も安い)
37
- モデルへ自動で振り分けます——難しいコーディングはトップコーダーへ、ちょっとした確認は
38
- 速くて安いモデルへ、長い文書は大コンテキストモデルへ——すべてあなたが既に契約している
39
- サブスクと API キーで。組み込みのデフォルトのまま使うも、小さな設定ファイルを一つ調整するも
40
- 自由。新しく面倒を見る対象は増えず(既存ツールの裏で動きます)、`./install.sh --uninstall`
41
- できれいに削除できます。
42
-
43
- **[⬇ 60 秒クイックスタートへ](#-60-秒クイックスタート)**
44
-
45
- ## v0.10.0 の新機能
32
+ **omnilane がすること。** アシスタントにルーティング表を渡します。作業は
33
+ **レーン**——最難関のコーディング、機械的な物量、トリアージ、難しい判断、
34
+ 最終的な仕上げ——に振り分けられ、各レーンにはそれに最も強く(そして最も安い)
35
+ モデルが指定されています。アシスタントは自分の得意なレーンを自分で処理し、
36
+ 残りは既存のログインを使って別ベンダーの CLI にバックグラウンドで渡します。
46
37
 
47
- - **Gemini 3.6 Flash を既定に** — `fast-agentic`・`triage`・`bulk-mechanical`
48
- の gemini 候補(および `Gemini Flash` エイリアス)を 2026-07-21 リリースの
49
- Gemini 3.6 Flash に更新。出力トークンが減り、出力単価も下がり、Artificial
50
- Analysis 計測の出力速度は首位です。
51
- - **エビデンス再監査** — ルーティングのコメント、モデル能力ノート、Gemini
52
- 価格表を公式ソースに合わせて更新(2026-07-21/22)。
53
-
54
- ## v0.9.1 の新機能
55
-
56
- - **修正**: `configure set` が `routing.local.yaml` の手書きコメントを削除しなく
57
- なりました。書き換えるのは自身のスタンプ行と置き換え対象のレーンだけです。
38
+ **omnilane ではないもの。** プロキシでも、新しいサブスクでも、常時面倒を見る
39
+ サービスでもありません。表一枚とディスパッチスクリプト一本が、既存ツールの裏で
40
+ 動くだけです。`./install.sh --uninstall` で痕跡なく削除できます。
58
41
 
59
- ## v0.9.0 の新機能
42
+ **すべてのサブスクは不要です。** 各レーンはフォールバックチェーンであり、実際に
43
+ インストール済みの最初の候補が選ばれます。CLI が一つでも七つでも動作し、どれも
44
+ 無いレーンは失敗せず単にオフになります。サブスク一つでも、デフォルト表はその
45
+ ベンダーに収束します。
60
46
 
61
- - **OpenAI 互換の direct-API ベンダーを 5 つ追加** — `deepseek`、`zai`(GLM)
62
- `mistral`、`groq`、`cerebras` が `openrouter` と同じく CLI 不要のレーンに
63
- (curl と `<VENDOR>_API_KEY` だけ)。`lib/common.sh` のレジストリに 1 行で
64
- 追加でき、モデル能力の比較は [`docs/model-capabilities-2026-07.md`](docs/model-capabilities-2026-07.md) を参照。
65
- - **Fish シェル補完** — `omnilane completion fish | source`。
47
+ **[⬇ 60 秒クイックスタートへ](#-60-秒クイックスタート)** · **[❓ FAQ を読む](#-faq)**
66
48
 
67
49
  ## ⚡ 60 秒クイックスタート
68
50
 
@@ -144,15 +126,11 @@ flowchart LR
144
126
  | 🗳️ arbitrate | off(オプトイン) | — | 内蔵オピニオンパネル(重大な判断用)——デフォルト無効。`routing.local.yaml` で有効化;投票者×ラウンドごとに 1 コール消費 |
145
127
 
146
128
  **バックアップ**はチェーンの次の候補——第一候補のベンダー CLI が未インストールの
147
- ときにディスパッチが降格する先です。
129
+ ときにディスパッチが降格する先です。どのレーンもこうしたチェーンで、チェーン内に
130
+ 何もインストールされていなければレーンは `off` に降格します。
148
131
 
149
- > **Claude Fable 5 はどこ?** 意図的にデフォルト表に入れていません:Claude の
150
- > 最上位ティアは通常*メインループ自身*であり、ディスパッチされるワーカーでは
151
- > ないため(価格も Opus より上)。これはコスト/ガードレール/メインループ方針で
152
- > あり、能力評価ではありません。Anthropic は Fable 5 を Opus 5 より上位に
153
- > 位置付けています。設定メニューのモデル一覧には載っているので、
154
- > 使いたければ自分でルーティングできます(例:`routing.local.yaml` に
155
- > `taste-final: claude claude-fable-5 high`)。
132
+ > **Claude Fable 5 はどこ?** 意図的にデフォルト表に入れていません——理由と
133
+ > 実測データは [FAQ](#-faq) にまとめてあります。
156
134
 
157
135
  ### 自然言語コンサルテーション
158
136
 
@@ -377,12 +355,139 @@ configure.sh set|get|unset|list|diff LANE [SPEC] # routing.local.yaml を非
377
355
  記録し、`jobs.sh status` が `dead` を報告。
378
356
  - **ペイロード上限** — 巨大なタスクテキストは自動で頭尾トランケート。
379
357
 
358
+ ## ❓ FAQ
359
+
360
+ <details>
361
+ <summary><b>これらのサブスクは全部必要ですか?</b></summary>
362
+
363
+ <br/>
364
+
365
+ いいえ。各レーンはフォールバックチェーンで、実際にインストール済みの最初の候補が
366
+ 使われます。サブスクが一つなら表全体がそのベンダーに収束し、チェーン内に何も無い
367
+ レーンはエラーではなく単にオフになります。`omnilane doctor` で今このマシンが実際に
368
+ 到達できる先が分かり、`routing.local.yaml.example` にはよくある状況向けの
369
+ スタータープロファイル(Claude のみ、Codex 中心、Codex 無し)が入っています。
370
+
371
+ </details>
372
+
373
+ <details>
374
+ <summary><b>omnilane は私のコードを新しい送信先へ送りますか?</b></summary>
375
+
376
+ <br/>
377
+
378
+ 新しい送信先は増えません。ディスパッチはすでにインストールしログイン済みの
379
+ ベンダー CLI を呼ぶだけなので、コードが届くのは元から使っているベンダーだけです。
380
+ ランナーはサブスク制 CLI を呼ぶ前に API キーの環境変数を取り除くため、残っていた
381
+ キーによって従量課金へ黙って切り替わることもありません。唯一の例外は direct-API
382
+ ベンダー群(`openrouter`、`deepseek`、`zai`、`mistral`、`groq`、`cerebras`)で、
383
+ これらは定義上あなたが設定したキーでそのプロバイダーの API を呼びます——いずれも
384
+ advise 専用で、ファイルを編集しません。
385
+
386
+ </details>
387
+
388
+ <details>
389
+ <summary><b>Claude Fable 5 はどこ?なぜデフォルト表に無いのですか?</b></summary>
390
+
391
+ <br/>
392
+
393
+ **Claude の最上位ティアは通常メインループ自身であり、ディスパッチされるワーカー
394
+ ではないからです。** レーンは「今あなたが動かしているモデル以外」に作業を送るために
395
+ あります。Fable 5 がメインループなら、判断や文章を Fable 5 に戻すのは呼び出しが
396
+ 一回増えるだけで得るものがありません——だからこそ上の「メインモデルを選ぶ」一覧では
397
+ Fable 5 に**ドライバー**として独立した行があり、hard-judgment、taste-final、
398
+ 正確性が要の最難関修正を自分で処理します。
399
+
400
+ **計測データもワーカーとしての採用を支持しません。** Artificial Analysis の
401
+ Intelligence Index(2026-07-24)では Opus 5(max)が 61、Fable 5(max)が 60 —— AA 自身が
402
+ 「実質的に同点」と表現し、Epoch AI の Capability Index は順位が逆です
403
+ (Fable 5 161、Opus 5 159)。総合的な知能は引き分けと見てよいでしょう。差が付くのは
404
+ エージェント的な専門アウトプットで、その差は小さくありません:
405
+
406
+ | ベンチマーク | Claude Opus 5 (max) | Claude Fable 5 | |
407
+ |---|---:|---:|---|
408
+ | AA-Briefcase(エージェント的知識労働、Elo) | 1720 | 1574 | **+146** |
409
+ | GDPval-AA v2(Elo) | 1861 | 1747 | **+114** |
410
+ | AA-Briefcase の 1 タスク単価 | $17.79 | $22.30 | **-20%** |
411
+ | API 価格、入力/出力 1M あたり | $5 / $25 | $10 / $50 | **半額** |
412
+
413
+ Opus 5 の max・xhigh・high の三ティアが AA-Briefcase の上位三席を占め、`high`
414
+ ティアですら 1 タスク単価が半分以下で Fable 5 を上回ります。つまり Fable 5 は
415
+ 価格が二倍でありながら、レーンが重視するどの軸でも優位を買えていません。
416
+
417
+ **Fable 5 が実際に優れている点**:知識の広さです。AA-Omniscience では今も Opus 5 を
418
+ 上回っており(モデルのサイズクラスから見て妥当)、一方の Opus 5 は不確かなときでも
419
+ 答えがちで、ハルシネーション率は 50%(Opus 4.8 比 +14 ポイント)です。実行より
420
+ 想起が中心のタスクなら、明示的に指名してください:
421
+
422
+ ```bash
423
+ dispatch.sh --vendor claude --model claude-fable-5 --effort high consult "…"
424
+ ```
425
+
426
+ **これはコストとメインループの方針上の選択であり、能力評価ではありません。**
427
+ Fable 5 は設定メニューのモデル一覧に載っており、`routing.local.yaml` の 1 行で
428
+ デフォルトを上書きできます:
429
+
430
+ ```yaml
431
+ taste-final: claude claude-fable-5 high
432
+ ```
433
+
434
+ </details>
435
+
436
+ <details>
437
+ <summary><b>Claude のレーンはなぜ <code>max</code> ではなく <code>xhigh</code> なのですか?</b></summary>
438
+
439
+ <br/>
440
+
441
+ 努力度は高ければ高いほど良い、というものではないからです。Anthropic は `xhigh` を
442
+ コーディングとエージェント作業の出発点、`high` をそれ以外の知能を要する作業の下限、
443
+ `max` を正確性がコストに優先する場合の設定として文書化しています。第三者の計測も
444
+ 一致しており、Vals.ai の Vibe Code Bench では Opus 5 は `high` で 89.8%、`xhigh` で
445
+ 88.3%、`max` で 88.4% —— 上位ティアはより手の込んだ解を出し、その分だけ失敗も増えます。
446
+ ワークロードが違うならレーン単位で上げてください:
447
+
448
+ ```bash
449
+ omnilane configure set hard-judgment "claude claude-opus-5 max"
450
+ ```
451
+
452
+ </details>
453
+
454
+ <details>
455
+ <summary><b>レーンの第一候補 CLI が無いときはどうなりますか?</b></summary>
456
+
457
+ <br/>
458
+
459
+ ディスパッチはチェーンを辿り、手元にある最初のベンダーを使います。コールを消費
460
+ せずに判断を確認できます:
461
+
462
+ ```bash
463
+ scripts/dispatch.sh --explain hardest-coding # 候補ごとのトレース
464
+ scripts/dispatch.sh --list # 実効表の全体
465
+ scripts/dispatch.sh --dry-run hardest-coding "…" # 解決済みプラン、プロバイダー呼び出し無し
466
+ ```
467
+
468
+ </details>
469
+
470
+ <details>
471
+ <summary><b>ディスパッチされたワーカーはファイルを編集できますか?</b></summary>
472
+
473
+ <br/>
474
+
475
+ 依頼した場合のみです。ディスパッチの既定は読み取り専用の `advise` で、ベンダーごとに
476
+ 実装されています(読み取り専用サンドボックス、plan モード、あるいは読み取り専用の
477
+ ツールセット)。編集には `--mode work` と明示的な `--workdir` の両方が必要です。
478
+ ワーカー自身は再ディスパッチできません——深度ガードが終了コード 86 で入れ子の
479
+ ファンアウトを拒否するため、一つのコマンドがエージェントの連鎖に膨らんでクォータを
480
+ 食い潰すことはありません。
481
+
482
+ </details>
483
+
380
484
  ## 📊 デフォルト値と出典
381
485
 
382
486
  デフォルトのレーン割当は Artificial Analysis の 2026-07 スナップショット
383
487
  (AA サイトの生レコードと各社公式価格ページで照合済み)と公開の比較レビューに
384
488
  基づきます。これは意見であって法則ではありません——設定メニューと
385
- `routing.local.yaml` はそのためにあります。
489
+ `routing.local.yaml` はそのためにあります。ベンチマークごとの但し書きを含む
490
+ 作業ノートは [`docs/model-capabilities-2026-07.md`](docs/model-capabilities-2026-07.md) にあります。
386
491
 
387
492
  ## ⚠️ 既知の制限
388
493
 
@@ -398,8 +503,67 @@ configure.sh set|get|unset|list|diff LANE [SPEC] # routing.local.yaml を非
398
503
 
399
504
  ## 📜 リリース履歴
400
505
 
506
+ ## v0.10.3 の新機能
507
+
508
+ - **5 言語すべての README を再構成** — 冒頭で「これは何か、なぜ欲しくなるのか」を
509
+ まず説明し、バージョン履歴は導入部を分断せず最下部にまとめました。さらに FAQ を
510
+ 新設し、繰り返し寄せられた疑問に答えています:サブスクは全部必要か、コードは
511
+ どこへ送られるか、なぜ Fable 5 がデフォルト表に無いのか、なぜ `max` ではなく
512
+ `xhigh` なのか、CLI が無いときはどうなるか、ワーカーはファイルを編集できるのか。
513
+ - **修正: プラグインマニフェストのバージョンが古いままだった** — `plugin.json` と
514
+ `.claude-plugin/plugin.json` が 0.10.1・0.10.2 リリース後も `0.10.0` を表示して
515
+ いたため、プラグインのインストールで誤ったバージョンが出ていました。
516
+ - **修正: `routing.local.yaml.example` が退役モデルを指していた** — スタータープロ
517
+ ファイル内の `claude-opus-4-8` をすべて `claude-opus-5`(レーンに応じた努力度付き)
518
+ に、Gemini 3.5 Flash 候補を 3.6 Flash に更新し、0.10.0 以降のデフォルトと揃えました。
519
+ - **Intelligence Index の数値を出典に照合して訂正**
520
+ (`docs/model-capabilities-2026-07.md`):パーセントではなく指数ポイントです。
521
+ AA-Briefcase / GDPval-AA v2 の比較を追加し、デフォルトと逆向きの二つの結果も
522
+ 記録しました:事実知識では Fable 5 が、プレゼン品質では GPT-5.6 Sol が上回ります。
523
+
524
+ ## v0.10.2 の新機能
525
+
526
+ - **`hardest-coding` と `hard-judgment` の Claude 努力度を `max` から `xhigh` へ**。
527
+ Claude Opus 5 に関する Anthropic の文書化された指針に合わせました:コーディングと
528
+ エージェント作業は `xhigh` から始め、それ以外の知能を要する作業の下限は `high`、
529
+ `max` は正確性がコストに優先する場合に限る、というものです。戻す場合は
530
+ `omnilane configure set <lane> "<spec>"` を使ってください。
531
+ - **CHANGELOG の壊れた比較リンクを 2 件修正** — 公開されなかった `v0.10.0` タグを
532
+ 指していました。
533
+
534
+ ## v0.10.1 の新機能
535
+
536
+ - **デフォルトルーティングに `claude-opus-5` を追加**。`hard-judgment` と
537
+ `taste-final` の第一候補となり、最難関のコーディング作業でもフォールバックとして
538
+ 利用できます。
539
+ - **`omnilane configure` を全 13 プロバイダーへ拡張**。選択可能なモデルは 106 件で、
540
+ Codex、Claude Code、Grok Build、Antigravity の最新カタログに加え、検証済みの
541
+ OpenRouter/OpenCode ショートカットを収録しています。`c` によるカスタムモデル ID の
542
+ 入力も引き続き利用できます。
543
+
401
544
  <details>
402
- <summary>過去のリリース(v0.8.3 以前)</summary>
545
+ <summary>過去のリリース(v0.10.0 以前)</summary>
546
+
547
+ ## v0.10.0 の新機能
548
+
549
+ - **Gemini 3.6 Flash を既定に** — `fast-agentic`・`triage`・`bulk-mechanical`
550
+ の gemini 候補(および `Gemini Flash` エイリアス)を Gemini 3.6 Flash に更新。
551
+ 出力トークンが減り、出力単価も下がり、Artificial Analysis 計測の出力速度は首位です。
552
+ - **エビデンス再監査** — ルーティングのコメント、モデル能力ノート、Gemini
553
+ 価格表を公式ソースに合わせて更新。
554
+
555
+ ## v0.9.1 の新機能
556
+
557
+ - **修正**: `configure set` が `routing.local.yaml` の手書きコメントを削除しなく
558
+ なりました。書き換えるのは自身のスタンプ行と置き換え対象のレーンだけです。
559
+
560
+ ## v0.9.0 の新機能
561
+
562
+ - **OpenAI 互換の direct-API ベンダーを 5 つ追加** — `deepseek`、`zai`(GLM)、
563
+ `mistral`、`groq`、`cerebras` が `openrouter` と同じく CLI 不要のレーンに
564
+ (curl と `<VENDOR>_API_KEY` だけ)。`lib/common.sh` のレジストリに 1 行で
565
+ 追加でき、モデル能力の比較は [`docs/model-capabilities-2026-07.md`](docs/model-capabilities-2026-07.md) を参照。
566
+ - **Fish シェル補完** — `omnilane completion fish | source`。
403
567
 
404
568
  ## v0.8.3 の新機能
405
569
 
package/README.ko.md CHANGED
@@ -21,47 +21,29 @@
21
21
 
22
22
  ---
23
23
 
24
- ## 2026-07-25 업데이트
24
+ ## 🤔 omnilane 이란?
25
25
 
26
- - 기본 라우팅에 `claude-opus-5`를 추가했습니다. `hard-judgment`와 `taste-final`의 첫 번째 선택이며, 가장 어려운 코딩 작업의 대체 경로로도 사용됩니다.
27
- - `omnilane configure`를 13개 전체 제공자로 확장했습니다. 선택 가능한 모델은 106개이며 Codex, Claude Code, Grok Build, Antigravity의 최신 카탈로그와 검증된 OpenRouter/OpenCode 바로가기를 포함합니다. `c`를 통한 사용자 지정 모델 ID 입력도 계속 지원합니다.
26
+ **무엇이 문제인가.** 이미 AI 코딩 어시스턴트——**Claude Code, Codex, Cursor,
27
+ Gemini CLI** 같은——를 쓰고 계시죠. 각각은 하나의 모델 계열하고만 대화합니다.
28
+ 그래서 맡기는 모든 일이 그 한 모델에서 돌아갑니다, 적합하든 아니든——일회성 파일
29
+ 이름 변경이 가장 비싼 모델을 소모하고, 정작 어려운 설계 문제는 마침 열어 둔
30
+ 모델에 걸립니다.
28
31
 
29
- ---
30
- ## 👋 처음이신가요?
31
-
32
- 이미 AI 코딩 어시스턴트——**Claude Code, Codex, Cursor, Gemini CLI** 같은——를 쓰고
33
- 계시죠. 각각은 번에 하나의 AI 모델과 대화하며, "어떤 작업에 어떤 모델이 최선인가"는
34
- 당신 몫으로 남습니다.
35
-
36
- **omnilane 이 대신 골라 줍니다.** 모든 작업을 그 일에 가장 강한(그리고 가장 저렴한) 모델로
37
- 자동 라우팅합니다——어려운 코딩은 최고 코더에게, 간단한 확인은 빠르고 싼 모델에게, 긴 문서는
38
- 큰 컨텍스트 모델에게——전부 이미 결제 중인 구독과 API 키로. 기본값 그대로 쓰거나, 작은 설정
39
- 파일 하나만 손보면 됩니다. 새로 관리할 대상이 늘지 않고(기존 도구 뒤에서 동작),
40
- `./install.sh --uninstall` 로 깔끔히 제거됩니다.
41
-
42
- **[⬇ 60초 시작으로](#-60초-시작)**
43
-
44
- ## v0.10.0 새 기능
32
+ **omnilane 이 하는 일.** 어시스턴트에게 라우팅 표를 줍니다. 작업은 **레인**——
33
+ 가장 어려운 코딩, 기계적인 물량, 분류, 어려운 판단, 최종 다듬기——으로 나뉘고,
34
+ 각 레인에는 그 일에 가장 강하고(그리고 가장 저렴한) 모델이 지정됩니다.
35
+ 어시스턴트는 자신이 잘하는 레인을 직접 처리하고, 나머지는 이미 가진 로그인으로
36
+ 다른 벤더의 CLI 백그라운드로 넘깁니다.
45
37
 
46
- - **Gemini 3.6 Flash 기본 라우팅** `fast-agentic`, `triage`,
47
- `bulk-mechanical` gemini 후보(그리고 `Gemini Flash` 별칭)를 2026-07-21
48
- 출시된 Gemini 3.6 Flash변경: 출력 토큰 감소, 출력 단가 인하, Artificial
49
- Analysis 측정 출력 속도 1위.
50
- - **근거 재감사** — 라우팅 주석, 모델 능력 노트, Gemini 가격표를 공식 소스에
51
- 맞춰 갱신 (2026-07-21/22).
52
-
53
- ## v0.9.1 새 기능
54
-
55
- - **수정**: `configure set` 이 더 이상 `routing.local.yaml` 의 수기 주석을
56
- 삭제하지 않습니다. 자체 스탬프 줄과 교체 대상 레인만 다시 씁니다.
38
+ **omnilane 아닌 것.** 프록시도, 구독도, 계속 돌봐야 할 서비스도 아닙니다.
39
+ 장과 디스패치 스크립트 하나가 기존 도구 뒤에서 돌아갈 뿐입니다.
40
+ `./install.sh --uninstall`흔적 없이 제거됩니다.
57
41
 
58
- ## v0.9.0 기능
42
+ **모든 구독이 필요하지는 않습니다.** 각 레인은 대체 체인이며, 실제로 설치된 첫
43
+ 후보가 선택됩니다. CLI 가 하나든 일곱이든 동작하고, 아무것도 없는 레인은 실패
44
+ 대신 그냥 꺼집니다. 구독이 하나여도 기본 표는 그 벤더로 수렴합니다.
59
45
 
60
- - **OpenAI 호환 direct-API 벤더 5개 추가** — `deepseek`, `zai` (GLM), `mistral`,
61
- `groq`, `cerebras` 가 `openrouter` 처럼 CLI 없는 레인으로 추가(curl 과
62
- `<VENDOR>_API_KEY` 만 필요). `lib/common.sh` 레지스트리에 한 줄로 추가되며,
63
- 모델 능력 비교는 [`docs/model-capabilities-2026-07.md`](docs/model-capabilities-2026-07.md) 참고.
64
- - **Fish 셸 자동완성** — `omnilane completion fish | source`.
46
+ **[⬇ 60초 시작으로](#-60초-시작)** · **[❓ FAQ 보기](#-faq)**
65
47
 
66
48
  ## ⚡ 60초 시작
67
49
 
@@ -142,15 +124,11 @@ flowchart LR
142
124
  | 🗳️ arbitrate | off(옵트인) | — | 내장 의견 패널(중대한 결정용)——기본 비활성. `routing.local.yaml` 에서 활성화;투표자×라운드마다 1콜 소모 |
143
125
 
144
126
  **백업**은 체인의 다음 후보입니다——1순위 벤더 CLI 가 설치되지 않았을 때
145
- 디스패치가 강등되는 대상입니다.
127
+ 디스패치가 강등되는 대상입니다. 모든 레인이 이런 체인이며, 체인에 아무것도
128
+ 설치되어 있지 않으면 레인은 `off` 로 강등됩니다.
146
129
 
147
- > **Claude Fable 5 는 어디에?** 의도적으로 기본 테이블에 넣지 않았습니다:
148
- > Claude 최상위 티어는 보통 *메인 루프 자신*이지 디스패치되는 워커가 아니며,
149
- > 가격도 Opus 보다 높습니다. 이는 비용/가드레일/메인 루프 정책이며 능력 평가가
150
- > 아닙니다. Anthropic 은 Fable 5 를 Opus 5 보다 상위에 둡니다. 설정 메뉴의
151
- > 모델 목록에는 있으니 원하면 직접
152
- > 라우팅하세요(예: `routing.local.yaml` 에
153
- > `taste-final: claude claude-fable-5 high`).
130
+ > **Claude Fable 5 는 어디에?** 의도적으로 기본 테이블에 넣지 않았습니다——
131
+ > 이유와 실측 데이터는 [FAQ](#-faq) 정리했습니다.
154
132
 
155
133
  ### 자연어 상담
156
134
 
@@ -365,12 +343,136 @@ CLI 를 사용할 수 없음, `5` 1라운드 성공 투표자 부족, `6` 2라
365
343
  `jobs.sh status` 가 `dead` 를 보고.
366
344
  - **페이로드 상한** — 과대한 태스크 텍스트는 머리/꼬리만 남기고 자동 절단.
367
345
 
346
+ ## ❓ FAQ
347
+
348
+ <details>
349
+ <summary><b>이 구독들이 전부 필요한가요?</b></summary>
350
+
351
+ <br/>
352
+
353
+ 아닙니다. 각 레인은 대체 체인이며 실제로 설치된 첫 후보가 사용됩니다. 구독이
354
+ 하나면 표 전체가 그 벤더로 수렴하고, 체인에 아무것도 없는 레인은 오류 대신 그냥
355
+ 꺼집니다. `omnilane doctor` 로 이 머신이 지금 실제로 닿을 수 있는 곳을 확인할 수
356
+ 있고, `routing.local.yaml.example` 에는 흔한 상황별 시작 프로필(Claude 만,
357
+ Codex 중심, Codex 없음)이 들어 있습니다.
358
+
359
+ </details>
360
+
361
+ <details>
362
+ <summary><b>omnilane 이 제 코드를 새로운 곳으로 보내나요?</b></summary>
363
+
364
+ <br/>
365
+
366
+ 새로운 목적지는 생기지 않습니다. 디스패치는 이미 설치하고 로그인해 둔 벤더 CLI 를
367
+ 호출할 뿐이라, 코드가 도달하는 곳은 원래 쓰던 벤더뿐입니다. 러너는 구독형 CLI 를
368
+ 호출하기 전에 API 키 환경 변수를 제거하므로, 남아 있던 키 때문에 토큰 종량제로
369
+ 조용히 전환되는 일도 없습니다. 유일한 예외는 direct-API 벤더군(`openrouter`,
370
+ `deepseek`, `zai`, `mistral`, `groq`, `cerebras`)으로, 이들은 정의상 당신이 설정한
371
+ 키로 해당 제공자의 API 를 호출합니다——모두 advise 전용이며 파일을 수정하지 않습니다.
372
+
373
+ </details>
374
+
375
+ <details>
376
+ <summary><b>Claude Fable 5 는 어디에? 왜 기본 테이블에 없나요?</b></summary>
377
+
378
+ <br/>
379
+
380
+ **Claude 최상위 티어는 보통 메인 루프 자신이지 디스패치되는 워커가 아니기
381
+ 때문입니다.** 레인은 "지금 당신이 몰고 있는 모델 이외"에 작업을 보내려고 존재합니다.
382
+ Fable 5 가 메인 루프라면 판단과 문장을 다시 Fable 5 로 라우팅하는 것은 호출만 한 번
383
+ 늘 뿐 얻는 것이 없습니다——그래서 위의 "메인 모델 고르기" 목록에서 Fable 5 는
384
+ **드라이버**로 독립된 줄을 가지며, hard-judgment, taste-final, 정확성이 핵심인
385
+ 가장 어려운 수정을 직접 처리합니다.
386
+
387
+ **측정 데이터도 워커로 쓰는 쪽을 지지하지 않습니다.** Artificial Analysis
388
+ Intelligence Index(2026-07-24)에서 Opus 5(max)는 61점, Fable 5(max)는 60점 ——
389
+ AA 자신이 "사실상 동점"이라 표현했고, Epoch AI 의 Capability Index 는 순위가
390
+ 반대입니다(Fable 5 161, Opus 5 159). 종합 지능은 무승부로 보면 됩니다. 실제로
391
+ 벌어지는 곳은 에이전트형 전문 산출물이며, 그 격차는 작지 않습니다:
392
+
393
+ | 벤치마크 | Claude Opus 5 (max) | Claude Fable 5 | |
394
+ |---|---:|---:|---|
395
+ | AA-Briefcase(에이전트형 지식 노동, Elo) | 1720 | 1574 | **+146** |
396
+ | GDPval-AA v2(Elo) | 1861 | 1747 | **+114** |
397
+ | AA-Briefcase 작업당 비용 | $17.79 | $22.30 | **-20%** |
398
+ | API 가격, 입력/출력 1M 당 | $5 / $25 | $10 / $50 | **절반** |
399
+
400
+ Opus 5 의 max, xhigh, high 세 티어가 AA-Briefcase 상위 세 자리를 차지하며,
401
+ `high` 티어조차 작업당 비용 절반 이하로 Fable 5 를 이깁니다. 즉 Fable 5 는 가격이
402
+ 두 배이면서 레인이 중시하는 어떤 축에서도 우위를 사지 못합니다.
403
+
404
+ **Fable 5 가 실제로 더 나은 지점**: 사실 지식의 폭입니다. AA-Omniscience 에서는
405
+ 여전히 Opus 5 를 앞서며(두 모델의 규모 차이를 감안하면 당연), 반대로 Opus 5 는
406
+ 확신이 없을 때도 답하는 경향이 있어 환각률이 50%(Opus 4.8 대비 +14 포인트)입니다.
407
+ 실행보다 회상이 중심인 작업이라면 명시적으로 지목하세요:
408
+
409
+ ```bash
410
+ dispatch.sh --vendor claude --model claude-fable-5 --effort high consult "…"
411
+ ```
412
+
413
+ **이는 비용과 메인 루프 정책의 선택이지 능력 평가가 아닙니다.** Fable 5 는 설정
414
+ 메뉴의 모델 목록에 있으며, `routing.local.yaml` 한 줄로 기본값을 덮어쓸 수 있습니다:
415
+
416
+ ```yaml
417
+ taste-final: claude claude-fable-5 high
418
+ ```
419
+
420
+ </details>
421
+
422
+ <details>
423
+ <summary><b>Claude 레인은 왜 <code>max</code> 가 아니라 <code>xhigh</code> 인가요?</b></summary>
424
+
425
+ <br/>
426
+
427
+ 노력 수준이 높을수록 좋은 것이 아니기 때문입니다. Anthropic 은 `xhigh` 를 코딩과
428
+ 에이전트 작업의 출발점, `high` 를 그 외 지능이 필요한 작업의 하한, `max` 를
429
+ 정확성이 비용보다 중요한 경우의 설정으로 문서화합니다. 제3자 측정도 일치합니다:
430
+ Vals.ai 의 Vibe Code Bench 에서 Opus 5 는 `high` 에서 89.8%, `xhigh` 에서 88.3%,
431
+ `max` 에서 88.4% —— 최상위 티어는 더 복잡한 해법을 내놓고 그만큼 더 자주 실패합니다.
432
+ 워크로드가 다르다면 레인 단위로 올리세요:
433
+
434
+ ```bash
435
+ omnilane configure set hard-judgment "claude claude-opus-5 max"
436
+ ```
437
+
438
+ </details>
439
+
440
+ <details>
441
+ <summary><b>레인의 1순위 CLI 가 없으면 어떻게 되나요?</b></summary>
442
+
443
+ <br/>
444
+
445
+ 디스패치가 체인을 따라 내려가며 보유한 첫 벤더를 사용합니다. 호출을 쓰지 않고도
446
+ 결정을 먼저 확인할 수 있습니다:
447
+
448
+ ```bash
449
+ scripts/dispatch.sh --explain hardest-coding # 후보별 추적
450
+ scripts/dispatch.sh --list # 전체 유효 테이블
451
+ scripts/dispatch.sh --dry-run hardest-coding "…" # 완전히 해석된 계획, 제공자 호출 없음
452
+ ```
453
+
454
+ </details>
455
+
456
+ <details>
457
+ <summary><b>디스패치된 워커가 제 파일을 수정할 수 있나요?</b></summary>
458
+
459
+ <br/>
460
+
461
+ 요청했을 때만 가능합니다. 디스패치의 기본값은 읽기 전용 `advise` 이며 벤더별로
462
+ 구현되어 있습니다(읽기 전용 샌드박스, plan 모드, 또는 읽기 전용 도구 집합).
463
+ 수정하려면 `--mode work` 와 명시적인 `--workdir` 가 모두 필요합니다. 워커는 다시
464
+ 디스패치할 수도 없습니다——깊이 가드가 종료 코드 86 으로 중첩 팬아웃을 거부하므로,
465
+ 명령 하나가 에이전트 연쇄로 번져 할당량을 태우는 일은 없습니다.
466
+
467
+ </details>
468
+
368
469
  ## 📊 기본값과 출처
369
470
 
370
471
  기본 레인 배치는 Artificial Analysis 2026-07 스냅샷(AA 사이트 원본 레코드와
371
472
  각사 공식 가격 페이지로 교차 검증)과 공개 비교 리뷰에 근거합니다.
372
473
  이는 의견이지 법칙이 아닙니다——설정 메뉴와 `routing.local.yaml` 이
373
- 그래서 존재합니다.
474
+ 그래서 존재합니다. 벤치마크별 단서를 포함한 작업 노트는
475
+ [`docs/model-capabilities-2026-07.md`](docs/model-capabilities-2026-07.md) 에 있습니다.
374
476
 
375
477
  ## ⚠️ 알려진 제한
376
478
 
@@ -385,8 +487,67 @@ CLI 를 사용할 수 없음, `5` 1라운드 성공 투표자 부족, `6` 2라
385
487
 
386
488
  ## 📜 릴리스 기록
387
489
 
490
+ ## v0.10.3 새 기능
491
+
492
+ - **5개 언어 README 전면 재구성** — 문서 첫머리에서 "이게 무엇이고 왜 필요한가"를
493
+ 먼저 설명하고, 버전 기록은 도입부를 끊지 않도록 맨 아래로 모았습니다. 그리고
494
+ 반복해서 들어온 질문에 답하는 FAQ 를 새로 넣었습니다: 구독이 전부 필요한지,
495
+ 코드가 어디로 가는지, 왜 Fable 5 가 기본 테이블에 없는지, 왜 `max` 가 아니라
496
+ `xhigh` 인지, CLI 가 없으면 어떻게 되는지, 워커가 파일을 수정할 수 있는지.
497
+ - **수정: 플러그인 매니페스트가 옛 버전을 표시** — `plugin.json` 과
498
+ `.claude-plugin/plugin.json` 이 0.10.1, 0.10.2 릴리스 후에도 `0.10.0` 으로
499
+ 남아 있어 플러그인 설치 시 잘못된 버전이 표시되었습니다.
500
+ - **수정: `routing.local.yaml.example` 이 퇴역 모델을 가리킴** — 시작 프로필의
501
+ `claude-opus-4-8` 을 모두 `claude-opus-5`(레인에 맞는 노력 수준 포함)로,
502
+ Gemini 3.5 Flash 후보를 3.6 Flash 로 바꿔 0.10.0 이후 기본값과 맞췄습니다.
503
+ - **Intelligence Index 수치를 원본과 대조해 정정**
504
+ (`docs/model-capabilities-2026-07.md`): 퍼센트가 아니라 지수 점수입니다.
505
+ AA-Briefcase / GDPval-AA v2 비교를 추가하고, 기본값과 반대 방향인 두 결과도
506
+ 기록했습니다: 사실 지식은 Fable 5 가, 표현 품질은 GPT-5.6 Sol 이 앞섭니다.
507
+
508
+ ## v0.10.2 새 기능
509
+
510
+ - **`hardest-coding` 과 `hard-judgment` 의 Claude 노력 수준을 `max` 에서 `xhigh`
511
+ 로 변경**. Claude Opus 5 에 대한 Anthropic 의 문서화된 지침에 맞췄습니다:
512
+ 코딩과 에이전트 작업은 `xhigh` 에서 시작, 그 외 지능이 필요한 작업의 하한은
513
+ `high`, `max` 는 정확성이 비용보다 중요한 경우에 한합니다. 되돌리려면
514
+ `omnilane configure set <lane> "<spec>"` 을 쓰세요.
515
+ - **깨진 CHANGELOG 비교 링크 2건 수정** — 공개된 적 없는 `v0.10.0` 태그를
516
+ 가리키고 있었습니다.
517
+
518
+ ## v0.10.1 새 기능
519
+
520
+ - **기본 라우팅에 `claude-opus-5` 추가**. `hard-judgment` 와 `taste-final` 의
521
+ 첫 번째 선택이며, 가장 어려운 코딩 작업의 대체 경로로도 사용됩니다.
522
+ - **`omnilane configure` 를 13개 전체 제공자로 확장**. 선택 가능한 모델은
523
+ 106개이며 Codex, Claude Code, Grok Build, Antigravity 의 최신 카탈로그와
524
+ 검증된 OpenRouter/OpenCode 바로가기를 포함합니다. `c` 를 통한 사용자 지정
525
+ 모델 ID 입력도 계속 지원합니다.
526
+
388
527
  <details>
389
- <summary>이전 릴리스(v0.8.3 이하)</summary>
528
+ <summary>이전 릴리스(v0.10.0 이하)</summary>
529
+
530
+ ## v0.10.0 새 기능
531
+
532
+ - **Gemini 3.6 Flash 기본 라우팅** — `fast-agentic`, `triage`,
533
+ `bulk-mechanical` 의 gemini 후보(그리고 `Gemini Flash` 별칭)를 Gemini 3.6
534
+ Flash 로 변경: 출력 토큰 감소, 출력 단가 인하, Artificial Analysis 측정 출력
535
+ 속도 1위.
536
+ - **근거 재감사** — 라우팅 주석, 모델 능력 노트, Gemini 가격표를 공식 소스에
537
+ 맞춰 갱신.
538
+
539
+ ## v0.9.1 새 기능
540
+
541
+ - **수정**: `configure set` 이 더 이상 `routing.local.yaml` 의 수기 주석을
542
+ 삭제하지 않습니다. 자체 스탬프 줄과 교체 대상 레인만 다시 씁니다.
543
+
544
+ ## v0.9.0 새 기능
545
+
546
+ - **OpenAI 호환 direct-API 벤더 5개 추가** — `deepseek`, `zai` (GLM), `mistral`,
547
+ `groq`, `cerebras` 가 `openrouter` 처럼 CLI 없는 레인으로 추가(curl 과
548
+ `<VENDOR>_API_KEY` 만 필요). `lib/common.sh` 레지스트리에 한 줄로 추가되며,
549
+ 모델 능력 비교는 [`docs/model-capabilities-2026-07.md`](docs/model-capabilities-2026-07.md) 참고.
550
+ - **Fish 셸 자동완성** — `omnilane completion fish | source`.
390
551
 
391
552
  ## v0.8.3 새 기능
392
553