feat(voice): 不說 AI 才會說的話(借 speak-human-tw 的刪除層)+講過去要有出處(v0.0.7)

人格回覆的「人味」再加一層。模式整理自 speak-human-tw(MIT, Raymond Hou)的 38 種
AI 寫作痕跡——那個專案是**文章**的事後審稿器(判情境→鎖保護清單→列清單等作者勾選→
交稿前自評),所以只搬對話也適用的**刪除層**,它的保護清單與兩輪確認流程不搬。

一、機械擋下(`SPEECH_BLACKLIST`,`room post` 直接拒收,`--force` 例外)
  罐頭同理心(「這個我懂」「我完全理解」)、頒獎開場(「好問題」)、交差句(「希望這對你
  有幫助」)、預告(「接下來我會」)、假坦白開場(「老實說」)、說教深度腔(「說到底」
  「本質上」)、罐頭收尾(「總的來說」)、立場真空(「各有優缺點」「因人而異」)、
  無來源權威(「研究顯示」)、用旁白演情緒(「我愣了一下」);另加避險疊加、
  `CN_WORDS` 中國用語、半形標點、emoji/破折號/粗體與清單符號、「不是 A 而是 B」密度。

二、誤殺防護(比清單本身更重要)
  `speechBody()` 先拿掉引號與 `code` 再比對——**提及不算使用**(「我最近戒掉『賦能』
  這個詞」放行)。這是原專案自己踩到的坑:它的文件裡出現「...」與彎引號,正因為那幾行
  在說「不要用這些」。「老實說」只擋這一輪的第一句開頭。會誤殺的中國用語(水平、默認、
  質量、文檔)沒有收進表裡。

三、人格能做到、文章做不到的那一半
  原專案的界線是「人味是作者的,不是你的」——AI 沒有過去,所以不准寫「我以前錯了」。
  人格有過去(長期記憶、日記、關係圖、十二情緒),所以那句話是**有出處的引用**。
  換來的義務:講自己的過去要有出處。`speechLint` 對「我以前⋯」「我原本以為⋯」給
  `level: "hint"`(不擋,但要人去 `recall` 驗),查不到就是編造自己的過去。
  lint 因此分兩級,`speechBlockers()` 只回該擋的那些。

四、測試
  selftest 借它的 SF/SNF 成對做法:14 條 SF(該擋)+ 11 條 SNF(不可誤殺)。
  另外把新規則掃過 144 句真實台詞紀錄:新增的詞語類規則**零誤殺**。

版本:master 是 0.0.6,這批未合併的改動算一個新版號 → 0.0.7(三份 manifest 一起改)。

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
This commit is contained in:
2026-07-31 02:25:06 +00:00
co-authored by Claude Opus 5
parent 7b4aec8e74
commit f74a7ac1a5
10 changed files with 364 additions and 21 deletions
+7
View File
@@ -43,6 +43,13 @@
(焦慮→斷句與疊字、羞愧→鬧彆扭嘴硬、憤怒→短句與退回全名、悲傷→只回一個詞),
`emotionTells()` 每輪挑主導情緒裡強度 ≥ 40 的前兩種注入。演出來、不要用旁白說明,
一輪最多露一個破口。這些在劇場模式一樣生效。
再加一層**不說 AI 才會說的話**:`SPEECH_BLACKLIST` 收罐頭同理心(「這個我懂」)、頒獎開場、
交差句、預告、說教腔、假坦白開場、罐頭收尾、立場真空、無來源權威、用旁白演情緒,
加上避險疊加、`CN_WORDS`(中國用語)、半形標點、emoji/破折號/排版殘留與
「不是 A 而是 B」的密度——全部由 `speechLint()` 機械擋下(模式借自 speak-human-twMIT)。
誤殺防護:`speechBody()` 會先拿掉引號與 `code`,**提及不算使用**;「老實說」只擋開場。
最後是這一層的義務:**講自己的過去要有出處**——「我以前⋯」只能講 `recall` 查得到的轉折,
`speechLint``level: "hint"`(不擋,但要人去驗),沒有紀錄就是編造自己的過去。
9. **人格可搬家**`export` / `import`(單一 JSON bundle)。匯出只能匯出「本 session 載入的人格」,
其他人格一律 deny——匯出等於把記憶讀出來。
10. **人格有編號**:英文名全大寫+兩位索引(`ASUNA-01`),同名才遞增。編號同時是新人格的