
jiantw83andClaude Opus 5
197ad3416f
fix(speech): 修掉三個誤殺——書名號、變體選擇子 emoji、引述算進句長
三個都是「該放行卻被擋」,而且都只有幾行:
* speechBody() 的「提及 ≠ 使用」豁免清單漏了《》:
「我在看《說到底》這本書」被判 preach,「他推薦我看《質量與信息》」被判中國用語。
* EMOJI_RE 把 \u{FE0F} 寫在字元類裡,`❤️`(U+2764 + VS16)被算成兩個 emoji 而誤擋;
ZWJ 家族(👨👩👦)算三個、膚色(👍🏽)算兩個。改成「底字 + 變體/膚色 + ZWJ 續接」算一個。
* 句長檢查用的是 sentence 而不是 body,引號內容與 `code` 都算進字數——
引述使用者原話必被擋,等於不准引述。
「質量」「信息」這類語境相依的中國用語誤判沒有動(那要語意判斷,成本不對)。
selftest +11:SNF 放行 7 條(書名號兩種、三種 emoji 組合、引述長原話與長 code),
SF 仍擋 4 條(書名號之外真的在說教、引號之外自己講的長句、兩個 emoji、
一個 emoji 加一個帶變體選擇子的)——豁免只針對提及與引述,不是整句放行。
Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
2026-07-31 09:29:53 +00:00
..
2026-07-31 05:20:57 +00:00
2026-07-30 03:43:45 +00:00
2026-07-31 09:29:53 +00:00
2026-07-31 09:23:35 +00:00
2026-07-30 03:43:45 +00:00
2026-07-31 09:29:53 +00:00