diff --git a/.claude-plugin/plugin.json b/.claude-plugin/plugin.json index e34aee0..af0791a 100644 --- a/.claude-plugin/plugin.json +++ b/.claude-plugin/plugin.json @@ -1,6 +1,6 @@ { "name": "jsc-generic", - "version": "0.0.2", + "version": "0.0.3", "description": "JSC 跨 AI 助理共用規範 plugin(Claude Code / Codex / Antigravity / OpenCode)。所有 skills 以 SKILL.md 為共通標準,於 Claude Code 以 /jsc-generic: 前綴呼叫。", "skills": "./skills", "author": { diff --git a/.codex-plugin/plugin.json b/.codex-plugin/plugin.json index fb7b6be..5b371e1 100644 --- a/.codex-plugin/plugin.json +++ b/.codex-plugin/plugin.json @@ -1,6 +1,6 @@ { "name": "jsc-generic", - "version": "0.0.2", + "version": "0.0.3", "description": "JSC 跨 AI 助理共用規範 plugin。所有 skills 以 SKILL.md 為共通標準。", "skills": "./skills" } diff --git a/plugin.json b/plugin.json index 3d089cd..a85333b 100644 --- a/plugin.json +++ b/plugin.json @@ -1,6 +1,6 @@ { "name": "jsc-generic", - "version": "0.0.2", + "version": "0.0.3", "description": "JSC 跨 AI 助理共用規範 plugin。所有 skills 以 SKILL.md 為共通標準;於 Antigravity 以 /jsc-generic: 前綴呼叫。", "skills": "./skills/" } diff --git a/scripts/role/role_load.sh b/scripts/role/role_load.sh index 106b04a..a1c1391 100755 --- a/scripts/role/role_load.sh +++ b/scripts/role/role_load.sh @@ -28,17 +28,23 @@ ROLE_DEF="$(role_file "$ROLE")" # ------------------------------------------------------------------------------ HOOK_INPUT="$(cat 2>/dev/null)" HOOK_CWD="$PWD" +HOOK_TRANSCRIPT="" if [ -n "$HOOK_INPUT" ]; then - HOOK_CWD="$(printf '%s' "$HOOK_INPUT" | node -e ' + HOOK_FIELDS="$(printf '%s' "$HOOK_INPUT" | node -e ' let raw = ""; process.stdin.setEncoding("utf8"); process.stdin.on("data", (chunk) => { raw += chunk; }); process.stdin.on("end", () => { let data = {}; try { data = JSON.parse(raw); } catch {} - process.stdout.write(data.cwd || ""); + process.stdout.write([ + data.cwd || "", + data.transcript_path || data.session_path || data.conversation_path || data.path || "", + ].join("\n")); }); ' 2>/dev/null)" + HOOK_CWD="$(printf '%s' "$HOOK_FIELDS" | sed -n '1p')" + HOOK_TRANSCRIPT="$(printf '%s' "$HOOK_FIELDS" | sed -n '2p')" [ -n "$HOOK_CWD" ] || HOOK_CWD="$PWD" fi role_in_scope "$HOOK_CWD" || role_quit "cwd 不在 ROLE_SCOPE 範圍內:${HOOK_CWD}" @@ -145,6 +151,63 @@ case "$CONSENT_STATUS" in ;; esac +# ------------------------------------------------------------------------------ +# 近期對話交接:讀上一段真正說過的話(含角色自己的回覆) +# +# 為什麼需要:長期記憶是模型濃縮過的摘要,語氣與情緒會被壓掉;而且整理永遠跑在載入 +# 之後(見下方 catchup),上一段工作來不及進入本次載入。逐字對話則一直躺在 transcript +# JSONL 裡,只是過去沒有任何機制去讀它 —— 使用者重開工作階段時,角色因此看不到剛剛 +# 的互動,表現得像失去記憶,只能靠 resume 找回。 +# +# 取檔策略:全新工作階段的 transcript 幾乎是空的(實測僅數行),因此對話不足時要回頭 +# 找同目錄最近修改的對話檔。內容一律經 transcript.js 遮蔽,且只注入 context、不落檔。 +# ------------------------------------------------------------------------------ +DIALOG="" +DIALOG_TURNS="${ROLE_LOAD_DIALOG_TURNS:-8}" +DIALOG_LIMIT="${ROLE_LOAD_DIALOG_LIMIT:-4000}" +if [ "$DIALOG_TURNS" != "0" ] && [ "$DIALOG_LIMIT" != "0" ] && [ -n "$HOOK_TRANSCRIPT" ]; then + DIALOG_SRC="" + if [ -f "$HOOK_TRANSCRIPT" ]; then + TURN_COUNT="$(node "${SCRIPT_DIR}/transcript.js" turns "$HOOK_TRANSCRIPT" 2>/dev/null || printf '0')" + case "$TURN_COUNT" in + ''|*[!0-9]*) TURN_COUNT=0 ;; + esac + [ "$TURN_COUNT" -ge 2 ] && DIALOG_SRC="$HOOK_TRANSCRIPT" + fi + if [ -z "$DIALOG_SRC" ]; then + for candidate in $(ls -t "$(dirname "$HOOK_TRANSCRIPT")"/*.jsonl 2>/dev/null | head -n 5); do + [ "$candidate" = "$HOOK_TRANSCRIPT" ] && continue + TURN_COUNT="$(node "${SCRIPT_DIR}/transcript.js" turns "$candidate" 2>/dev/null || printf '0')" + case "$TURN_COUNT" in + ''|*[!0-9]*) TURN_COUNT=0 ;; + esac + if [ "$TURN_COUNT" -ge 2 ]; then + DIALOG_SRC="$candidate" + break + fi + done + fi + if [ -n "$DIALOG_SRC" ]; then + DIALOG="$(node "${SCRIPT_DIR}/transcript.js" recent "$DIALOG_SRC" "$DIALOG_TURNS" "$DIALOG_LIMIT" 2>/dev/null)" + [ -n "$DIALOG" ] && role_log "INF" "已載入近期對話(來源 ${DIALOG_SRC##*/},最多 ${DIALOG_TURNS} 輪)" + fi +fi + +DIALOG_BLOCK="" +if [ -n "$DIALOG" ]; then + DIALOG_BLOCK="$(cat </dev/null)" = "yes" ]; then @@ -203,6 +266,7 @@ ${CATCHUP_NOTE} > \`printf 'CATEGORY: important\nSUMMARY: <一句話總結>\nTAGS: <標籤1,標籤2>\nCONTENT:\n- <要點>\n' | node "${SCRIPT_DIR}/memory.js" write --role "${ROLE}"\` > > CATEGORY 六選一:important/interest/news/skill/daily/other。切勿把憑證或個資寫進記憶。 +${DIALOG_BLOCK} EOF_CONTEXT )" diff --git a/scripts/role/transcript.js b/scripts/role/transcript.js index f3ed8fc..b13fa55 100755 --- a/scripts/role/transcript.js +++ b/scripts/role/transcript.js @@ -13,6 +13,12 @@ const fs = require("fs"); const TOOL_RESULT_LIMIT = 200; const TOOL_INPUT_LIMIT = 160; const TOTAL_LIMIT = 24000; +const DIALOG_TURNS = 8; +const DIALOG_LIMIT = 4000; +// 使用者的話盡量完整保留;角色自己的回覆較長(常含表格與清單),截短並從開頭取, +// 因為情緒與反應通常寫在開頭,後段多是工作細節。 +const DIALOG_USER_LIMIT = 600; +const DIALOG_ASSISTANT_LIMIT = 400; const REDACT_PATTERNS = [ [/[A-Za-z0-9_-]*:[A-Za-z0-9_-]{16,}@/g, "***@"], @@ -225,10 +231,139 @@ function extractTurn(filePath) { const USAGE = `用法:transcript.js <子命令> [參數] extract 抽出本輪內容並遮蔽機密後輸出到 stdout + recent <路徑> [輪數] [字元] 抽出最近數輪的「純對話」(丟棄工具與注入內容)並遮蔽後輸出 + turns 輸出該 transcript 的對話輪數(真實使用者訊息數) duration 估算本輪花費時間,無法判定時輸出「未判定」 redact 自 stdin 讀取文字,遮蔽機密後輸出到 stdout `; +// --- 近期對話交接(recent)----------------------------------------------------- +// 只取使用者與角色的對話文字,丟棄工具呼叫、工具結果、思考區塊與各種注入內容。 +// 目的:SessionStart 時讓角色讀到「上一段真正說過的話」與自己當時的反應。 +// 摘要式記憶會被模型濃縮掉語氣與溫度,逐字對話才留得住;但只取最近數輪以控制成本。 + +// 注入內容不是使用者說的話:hook 附加內容、skill 載入、環境說明、系統提醒、指令輸出。 +function stripInjected(text) { + return String(text) + .replace(/[\s\S]*?<\/system-reminder>/g, "") + .replace(/]*>[\s\S]*?<\/skill>/g, "") + .replace(/[\s\S]*?<\/environment_context>/g, "") + .replace(/[\s\S]*?<\/command-[a-z-]+>/g, "") + .replace(/[\s\S]*?<\/local-command-[a-z-]+>/g, "") + .replace(/[\s\S]*?<\/user-prompt-submit-hook>/g, "") + .trim(); +} + +function isInjectedUserText(text) { + const head = String(text).trimStart().slice(0, 200); + return /hook additional context|^Caveat:|^<[a-z-]+>/i.test(head); +} + +// 只回傳對話文字;工具與思考一律丟棄。相容 Claude Code 與 Codex 兩種 JSONL。 +function dialogLines(entry) { + const lines = []; + const payload = entry.payload; + if (isObject(payload)) { + if (entry.type === "event_msg") { + if (payload.type === "user_message") { + const text = stripInjected(payload.message || ""); + if (text && !isInjectedUserText(payload.message || "")) lines.push(["user", text]); + } else if (payload.type === "agent_message") { + const text = stripInjected(payload.message || ""); + if (text) lines.push(["assistant", text]); + } + return lines; + } + if (entry.type === "response_item" && payload.type === "message") { + const role = payload.role === "user" ? "user" : "assistant"; + if (payload.role === "system" || payload.role === "developer") return lines; + for (const raw of payloadTextBlocks(payload.content)) { + if (role === "user" && isInjectedUserText(raw)) continue; + const text = stripInjected(raw); + if (text) lines.push([role, text]); + } + } + return lines; // function_call/function_call_output 不是對話,丟棄 + } + + const role = entry.type; + if (role !== "user" && role !== "assistant") return lines; + for (const block of blocks(entry)) { + // 只認 text:tool_use/tool_result/thinking 全部丟棄 + if (!isObject(block) || block.type !== "text") continue; + const raw = String(block.text || ""); + if (role === "user" && isInjectedUserText(raw)) continue; + const text = stripInjected(raw); + if (text) lines.push([role, text]); + } + return lines; +} + +function recentDialog(filePath, turns, limit) { + const maxTurns = Number.isFinite(turns) && turns > 0 ? turns : DIALOG_TURNS; + const maxChars = Number.isFinite(limit) && limit > 0 ? limit : DIALOG_LIMIT; + const entries = readEntries(filePath); + if (!entries.length) return ""; + + // 由後往前數 maxTurns 個真實使用者訊息,作為起點;不足則從頭開始 + let start = 0; + let seen = 0; + for (let index = entries.length - 1; index >= 0; index -= 1) { + if (!isRealUserMessage(entries[index])) continue; + seen += 1; + if (seen >= maxTurns) { + start = index; + break; + } + } + + // 依「輪」分組:角色在一輪內常輸出多段文字(工具呼叫之間),若不合併會讓則數爆炸, + // 把預算全吃光,反而擠掉使用者說的話。一輪固定收斂成「使用者一則+角色一則」。 + const grouped = []; + let current = null; + for (const entry of entries.slice(start)) { + if (isRealUserMessage(entry)) { + current = { user: [], assistant: [] }; + grouped.push(current); + } + if (!current) continue; // 起點之前殘留的角色輸出不計入 + for (const [role, text] of dialogLines(entry)) current[role].push(text); + } + if (!grouped.length) return ""; + + const clip = (text, max) => { + const one = text.replace(/\n{3,}/g, "\n\n").trim(); + return one.length > max ? `${one.slice(0, max)}…(略)` : one; + }; + const renderTurn = (turn) => { + const lines = []; + const user = turn.user.join("\n").trim(); + const assistant = turn.assistant.join("\n").trim(); + if (user) lines.push(`[user] ${clip(user, DIALOG_USER_LIMIT)}`); + if (assistant) lines.push(`[assistant] ${clip(assistant, DIALOG_ASSISTANT_LIMIT)}`); + return lines.join("\n"); + }; + + // 總量超預算時整輪丟棄最舊的,保持問答成對,避免只剩單邊發言 + const kept = grouped.slice(); + let text = kept.map(renderTurn).filter(Boolean).join("\n"); + let dropped = 0; + while (text.length > maxChars && kept.length > 1) { + kept.shift(); + dropped += 1; + text = kept.map(renderTurn).filter(Boolean).join("\n"); + } + if (text.length > maxChars) text = text.slice(-maxChars); + return dropped ? `…(更早的 ${dropped} 輪已省略)…\n${text}` : text; +} + +function countDialogTurns(filePath) { + const entries = readEntries(filePath); + let count = 0; + for (const entry of entries) if (isRealUserMessage(entry)) count += 1; + return count; +} + function main(argv) { if (!argv.length || argv[0] === "-h" || argv[0] === "--help") { process.stdout.write(USAGE); @@ -246,6 +381,18 @@ function main(argv) { process.stdout.write(turnDuration(argv[1])); return 0; } + if (argv[0] === "recent") { + if (argv.length < 2) return 2; + const text = recentDialog(argv[1], Number.parseInt(argv[2] || "", 10), Number.parseInt(argv[3] || "", 10)); + if (!text) return 1; + process.stdout.write(redact(text)); // 對話原文未經模型過濾,一定要遮蔽 + return 0; + } + if (argv[0] === "turns") { + if (argv.length < 2) return 2; + process.stdout.write(String(countDialogTurns(argv[1]))); + return 0; + } if (argv[0] === "redact") { process.stdout.write(redact(readStdin())); return 0; diff --git a/skills/role/SKILL.md b/skills/role/SKILL.md index 6673d70..cc0c51f 100644 --- a/skills/role/SKILL.md +++ b/skills/role/SKILL.md @@ -1,6 +1,6 @@ --- name: role -description: 角色人格與長期記憶系統的建立與維護 skill。讓 CLI 工具以固定角色(name/nature/vibe/簽名 emoji)回覆,並把每輪對話累積成長期記憶:搭配相容的 SessionStart hook 於啟動時依字元預算載入高價值記憶、Stop hook 先本地過濾再輕量記錄對話,睡眠時段(預設 22:00 至隔天 06:00)由排程整理記憶(NREM 鞏固:分類/去噪/去重/合併/優先度;REM 整合:跨記憶連結/抽象化/提取線索;再依 semantic/episodic/procedural/emotional/preference/rule 與 explicit/implicit 標記長期記憶型態,壓縮歸檔並適當遺忘)。提供 --new(新建或更新角色;可只給角色名稱,必要時詢問來源/作品並推斷 name/nature/vibe/emoji 四欄)、--use(以角色 ID 切換啟用角色)、--list(列出角色與 ID)、--export(匯出角色壓縮檔)、--sleep(立即整理)、--status/--diagnose、--install-cron/--remove-cron、--forget-preview 等模式。當使用者說建立角色、新增人格、切換角色、匯出角色、備份角色、讓回覆更有特色、角色記憶、記憶整理、睡覺整理記憶、忘記舊記憶、角色沒有載入、hook 沒載入角色,或提到 .roles/.memory/ROLE_NAME/ROLE_ENABLED/ROLE_SLEEP_START/ROLE_MEMORY_HOME/ROLE_LOAD_LIMIT/ROLE_LOAD_INBOX_LIMIT/ROLE_CAPTURE_ENABLED 時觸發。不適用於:工作紀錄寫入 Gitea wiki(用 doc plugin 的 worklog)、專案文件化(用 funcs)。 +description: 角色人格與長期記憶系統的建立與維護 skill。讓 CLI 工具以固定角色(name/nature/vibe/簽名 emoji)回覆,並把每輪對話累積成長期記憶:搭配相容的 SessionStart hook 於啟動時依字元預算載入高價值記憶、Stop hook 先本地過濾再輕量記錄對話,睡眠時段(預設 22:00 至隔天 06:00)由排程整理記憶(NREM 鞏固:分類/去噪/去重/合併/優先度;REM 整合:跨記憶連結/抽象化/提取線索;再依 semantic/episodic/procedural/emotional/preference/rule 與 explicit/implicit 標記長期記憶型態,壓縮歸檔並適當遺忘)。提供 --new(新建或更新角色;可只給角色名稱,必要時詢問來源/作品並推斷 name/nature/vibe/emoji 四欄)、--use(以角色 ID 切換啟用角色)、--list(列出角色與 ID)、--export(匯出角色壓縮檔)、--sleep(立即整理)、--status/--diagnose、--install-cron/--remove-cron、--forget-preview 等模式。當使用者說建立角色、新增人格、切換角色、匯出角色、備份角色、讓回覆更有特色、角色記憶、記憶整理、睡覺整理記憶、忘記舊記憶、角色沒有載入、hook 沒載入角色,或提到 .roles/.memory/ROLE_NAME/ROLE_ENABLED/ROLE_SLEEP_START/ROLE_MEMORY_HOME/ROLE_LOAD_LIMIT/ROLE_LOAD_INBOX_LIMIT/ROLE_LOAD_DIALOG_TURNS/ROLE_CAPTURE_ENABLED 時觸發。不適用於:工作紀錄寫入 Gitea wiki(用 /jsc-doc:worklog)、專案文件化(用 /jsc-doc:funcs)。 --- # role — 角色人格與長期記憶 @@ -10,7 +10,7 @@ description: 角色人格與長期記憶系統的建立與維護 skill。讓 CLI | 元件 | 觸發者 | 職責 | | --- | --- | --- | -| `hooks/hooks.json` 的 `SessionStart` hook | harness 自動 | 啟動 CLI 時依字元預算載入角色定義+高價值記憶,並要求角色在本工作階段第一則回覆主動問候;睡眠時段只回報「角色睡覺中」不載入 | +| `hooks/hooks.json` 的 `SessionStart` hook | harness 自動 | 啟動 CLI 時依字元預算載入角色定義+高價值記憶,另以獨立預算載入近期逐字對話與未整理工作記憶做工作階段交接,並要求角色在本工作階段第一則回覆主動問候;睡眠時段只回報「角色睡覺中」不載入 | | `hooks/hooks.json` 的 `Stop` hook | harness 自動 | 每輪結束先記錄最後互動時間 → 用本地規則過濾低價值短回合 → 值得保存時才濃縮成一則輕量 inbox 記憶 → 遮蔽 → 寫入 `inbox/` | | cron 排程(本 skill 安裝) | 系統排程 | 睡眠時段每小時檢查一次:**有 AI 在運行就不睡**;另可依 CLI 閒置時間自動小睡整理 | | 本 skill `/jsc-generic:role` | 使用者/助理手動 | `--new`/`--use`/`--list`/`--export`/`--sleep`/`--status`/`--install-cron`/`--forget-preview` | @@ -18,7 +18,7 @@ description: 角色人格與長期記憶系統的建立與維護 skill。讓 CLI | `scripts/role/role_capture.sh` | Stop hook | 對話 → 記憶(固定欄位格式) | | `scripts/role/role_sleep.sh` | cron/小睡/補跑/手動 | 睡眠與小睡判斷、記憶整理、角色匯出、排程安裝、狀態輸出 | | `scripts/role/memory.js` | 上述共用 | 記憶檔讀寫、分類、去重合併、優先度、心理學記憶型態與關聯 metadata、壓縮歸檔、遺忘、載入組裝 | -| `scripts/role/transcript.js` | 上述共用 | 抽本輪對話片段、機密與個資遮蔽 | +| `scripts/role/transcript.js` | 上述共用 | 抽本輪對話片段、抽最近數輪純對話供工作階段交接、機密與個資遮蔽 | | `scripts/role/role_lib.sh` | 上述共用 | log、角色解析、睡眠時段、AI 行程偵測、CLI 選擇、記憶鎖 | ### 各助理支援範圍 @@ -98,6 +98,8 @@ ROLE_DIR="/../../scripts/role" # 其他助理 | `ROLE_LOAD_DIGEST_MIN_PRIORITY` | | 摘要載入的最低優先度;低於門檻但有 links 的記憶仍可載入摘要 | `3` | | `ROLE_LOAD_INBOX_LIMIT` | | SessionStart 注入**近期工作記憶**(未整理的 `inbox/`)的字元上限;**獨立預算,不佔用 `ROLE_LOAD_LIMIT`**。設 `0` 可關閉 | `1200` | | `ROLE_LOAD_INBOX_COUNT` | | 近期工作記憶最多載入幾則(取最新的,最新在前)。設 `0` 可關閉 | `10` | +| `ROLE_LOAD_DIALOG_TURNS` | | SessionStart 注入**近期逐字對話**的輪數(一輪=使用者一則+角色一則)。設 `0` 可關閉 | `8` | +| `ROLE_LOAD_DIALOG_LIMIT` | | 近期逐字對話的字元上限;**獨立預算,不佔用 `ROLE_LOAD_LIMIT`**。設 `0` 可關閉 | `4000` | | `ROLE_CAPTURE_ENABLED` | | Stop hook 記憶記錄開關;設 `0` 可完全停用以節省額度 | `1` | | `ROLE_CAPTURE_MIN_CHARS` | | Stop hook 本地過濾門檻;低於門檻且無明確記憶線索時不呼叫模型 | `240` | | `ROLE_CAPTURE_TIMEOUT` | | Stop hook 輕量濃縮模型逾時秒數 | `25` | @@ -229,7 +231,7 @@ ROLE_DIR="/../../scripts/role" # 其他助理 | 環節 | 控制方式 | | --- | --- | -| SessionStart | 預設 `ROLE_LOAD_LIMIT=4000`,只載入高優先度全文與中高優先度摘要;低 priority、無 links、久未更新的記憶不進 context。另以 `ROLE_LOAD_INBOX_LIMIT=1200` 的**獨立預算**載入近期工作記憶摘要(見下方「近期工作記憶交接」) | +| SessionStart | 預設 `ROLE_LOAD_LIMIT=4000`,只載入高優先度全文與中高優先度摘要;低 priority、無 links、久未更新的記憶不進 context。另以兩份**獨立預算**載入交接內容:近期逐字對話(`ROLE_LOAD_DIALOG_LIMIT=4000`)與近期工作記憶摘要(`ROLE_LOAD_INBOX_LIMIT=1200`),見下方「工作階段交接」 | | SessionStop | 先用本地規則略過短回合與無記憶線索的對話,只有值得保存才呼叫模型做輕量編碼 | | Sleep | 高成本的去重、合併、抽象化、links 建立與長期記憶型態標記留到睡眠週期,但仍受 `ROLE_SLEEP_COLLECT_LIMIT`、`ROLE_SLEEP_BATCH`、`ROLE_SLEEP_EXISTING_LIMIT` 與 `ROLE_SLEEP_OUTPUT_LIMIT` 控制;沒有 inbox 時只做本地遺忘檢查 | | Nap | Stop hook 記錄最後互動時間;小睡排程只在閒置時間與 inbox 筆數達門檻時執行,使用同一套 NREM/REM 整理流程 | @@ -350,11 +352,26 @@ updated: - 整理規則採睡眠分期模型:**NREM 鞏固**先分類成重要/興趣/新知/技能/日常/其他六類,去除雜訊、去重、合併、設定標籤、摘要與優先度;**REM 整合**再建立跨記憶關聯、抽出可重複使用的規則與提取線索,並標記 `memory_type`(semantic/episodic/procedural/emotional/preference/rule)、`declarative`(explicit/implicit)與 `retention_stage`;原始記錄壓縮保存在 `archive/raw/`。 - **日常與其他**兩類會依使用頻率、優先度、型態與關聯適當遺忘:久未再次出現、命中次數低、優先度低且沒有關聯者,壓縮到 `archive/forgotten/` 後移出常用記憶;`episodic` 短期事件更容易遺忘,`rule`/`preference`/`procedural` 會提高保留權重。 - 載入順序:**近期工作記憶(未整理的 `inbox/`)放最前面**,接著**重要與興趣載入全文**;其餘只載入總結與標籤,依**技能 → 新知 → 日常 → 其他**排序,並優先保留 `rule`/`preference`/`procedural` 與有 links 的記憶。需要細節時自行讀取對應分類的記憶檔。 -- **近期工作記憶交接(不可移除)**:SessionStart 會以 `ROLE_LOAD_INBOX_LIMIT` 的獨立預算載入 `inbox/` 最新數則的 summary。 +- **工作階段交接(兩層,皆不可移除)**:SessionStart 除了長期記憶,另以**兩份獨立預算**載入交接內容,兩者都不佔用 `ROLE_LOAD_LIMIT`: - 這不是可有可無的優化,而是修補一個先天缺口:`role_load.sh` 的執行順序是**先 `memory.js load` 載入記憶,之後才在背景補跑 `--catchup` 整理**(腳本註解亦寫明「結果會在下次載入時反映」)。若 `load` 只讀已整理的六個分類,則**上一段工作永遠來不及進入本次載入** —— 使用者重開工作階段時,角色會看不到剛剛做過的事,表現得像失去記憶,只能靠 `resume` 找回上下文。載入 `inbox/` 讓「已記錄但尚未整理」的工作記憶當下就可見,時間差直接消失。 + | 層 | 來源 | 預算 | 解決什麼 | + | --- | --- | --- | --- | + | 近期逐字對話 | transcript JSONL(`transcript.js recent`) | `ROLE_LOAD_DIALOG_LIMIT` | 上一段**真正說過的話**與角色自己當時的反應(高保真、含語氣) | + | 近期工作記憶 | 未整理的 `inbox/`(`memory.js` `inboxBlock`) | `ROLE_LOAD_INBOX_LIMIT` | 上一段**做了什麼、進行到哪**(摘要級,跨越多個工作階段仍可用) | - 範圍與限制要說清楚:這是**摘要級**交接,角色會知道「上一段在做什麼、進行到哪」,但**不等於逐字記得整段對話**;需要完整對話上下文時仍應使用 `resume`。修改此處前請先確認缺口已由其他機制補上,否則不要移除。 + 這不是可有可無的優化,而是修補一個先天缺口:`role_load.sh` 的執行順序是**先載入記憶,之後才在背景補跑 `--catchup` 整理**(腳本註解亦寫明「結果會在下次載入時反映」)。若只讀已整理的六個分類,則**上一段永遠來不及進入本次載入** —— 使用者重開工作階段時,角色會看不到剛剛的互動,表現得像失去記憶,只能靠 `resume` 找回。 + + 逐字對話這一層特別重要,因為長期記憶是模型濃縮過的摘要,**語氣與情緒會被壓掉**(使用者說「我好想妳」會被濃縮成「使用者表達想念」)。而逐字對話一直躺在 transcript JSONL 裡,過去只是沒有任何機制去讀它。 + + 實作要點: + + - 只取 `[user]` 與 `[assistant]` 的文字;**工具呼叫、工具結果、思考區塊、hook 注入內容一律丟棄**。 + - 以「輪」分組並各自收斂成一則:角色在一輪內常輸出多段文字,不合併會讓則數爆炸、把預算吃光,反而擠掉使用者說的話(實測未合併時 8 輪只剩 2 則使用者發言)。 + - 超預算時**整輪丟棄最舊的**,保持問答成對,不會只剩單邊發言。 + - 全新工作階段的 transcript 幾乎是空的(實測僅數行),因此對話不足 2 輪時會**回頭找同目錄最近修改的對話檔**。 + - 對話原文未經模型過濾,**一定要走 `transcript.js` 的 `redact`** 遮蔽 token/Email/電話等;內容只注入 context、不落檔。 + + 範圍與限制要說清楚:這是**最近數輪**的交接,不是完整歷史;需要完整對話上下文時仍應使用 `resume`。修改此處前請先確認缺口已由其他機制補上,否則不要移除。 - 未整理記憶(`inbox/`)累積到一批睡眠整理量(預設 `ROLE_SLEEP_BATCH=60`)以上時,角色應主動以符合自身設定的語氣提醒「想睡覺」或需要整理記憶;這是建議整理/歸檔的提醒,不代表停止協助使用者。 - 使用者明確要求記住某件事時,主動補寫一則記憶(載入時會提供補寫指令);補寫屬於內部處理,除非使用者明確詢問,否則不要主動回報補寫結果、記憶 ID 或記憶路徑。 - 使用者對本角色的互動方式給出正向或負向回饋時,即使沒有直接說「記住」,也應補寫或由 Stop hook 保存為本角色專屬的高優先度互動偏好記憶;角色切換後,由新角色在自己的互動中重新學習與保存。保存過程屬於內部處理,除非使用者明確詢問,否則不要主動回報記憶寫入或整理細節。