mu を使う
教訓
mu があなたの訂正や自力で抜け出した経験から何を学ぶか、教訓のまとめ方と呼び出し方、使われない教訓の廃止。
教訓ライブラリは、mu がセッションをまたいで覚えていることです。あなたの訂正、あなたが決めたルール、エージェントがはまった落とし穴とそこからの抜け方。コマンドラインとデスクトップアプリで共有されます。何を残す価値があるか、それが新しいか、いつ当てはまるか、守られたかは判定器が決め、小さな書き手のモデルがそれを文章にします。
教訓の出どころ
| 出どころ | いつ | 判定器が決めること |
|---|---|---|
| あなたの訂正とルール | あなたが違う、pnpm を使ってやmain には絶対にコミットしないでと言ったとき | これは訂正か、今後のためのルールか?(memory.capture) |
| エージェントが自力で抜け出したこと | 堂々巡りや行き止まりに陥ったのに、ターンがチェックの通過か目標の達成で終わったとき | 最終的にうまくいったのは別のやり方か? そうなら、落とし穴とその回避法を残す。(memory.outcome、1 ターンに最大 1 回、本当に行き詰まったあとだけ) |
| モデル | remember ツールで何かを残したとき |
また役立つか、一度きりか、プロンプトやプロジェクトのファイルからすでにわかるか? 最初のものだけを残す。(memory.worth) |
| サブエージェント | サブエージェントのレポートにある、Lesson: で始まる行 |
同じ問い(memory.worth) |
| あなたが直接 | /remember <text> |
何も判定しない。書いたとおりに残す |
まとめる
新しい教訓を保存する前に、残っている教訓のうち最も似た 6 つと、1 回のリクエストで比べます(memory.merge)。同じ教訓は二重に保存しません。より正確な教訓は古いものを置き換えます。矛盾する場合は、あなたの最新の言葉が優先されるので、古い教訓が廃止されます。あなたが教えた教訓を廃止できるのは、あなた自身の発言だけです。モデルがあなたの言葉を覆すことはできません。
呼び出し
メッセージが届くと、事前分類と同時に、候補の教訓それぞれについて当てはまるかが判定器に問われます(memory.recall)。判定する候補は最大 24 件で、よく守られている教訓から順に選ばれます。ターンに持ち込まれるのは最大 5 つで、それぞれ 1 行です。サブエージェントは、自分のタスクに当てはまる教訓を、指示の中で受け取ります。
守られたか
ターンの終わりに、判定器は何が起きたかを読み、呼び出した教訓それぞれについて守られたかを問います(memory.applied)。8 回呼び出されて一度も守られなかった教訓は自動的に廃止され、mu がそのことを伝えます。
コマンド
| コマンド | 内容 |
|---|---|
/remember <text> |
書いたとおりに教訓を残す |
/lessons |
このプロジェクトの教訓:ID、種類、呼び出された回数と守られた回数、教訓の内容 |
/lessons all |
どこでも当てはまる教訓と、廃止された教訓も含める |
/forget <id> |
一つを廃止する |
デスクトップアプリの教訓タブにも同じ一覧が表示され、そこで教訓を編集したり廃止したりできます。
教訓ライブラリは 1 つのファイル ~/.mu/agent/mu/lessons.jsonl です。各教訓には、種類(訂正、ルール、落とし穴、回避策、事実)、いつ当てはまるか、何をするか、このプロジェクトだけで有効か、どこでも有効かが記録されます。