fix(baoyu-post-to-wechat): decode HTML entities and strip tags from article summary

Add cleanSummaryText() to baoyu-md package: decodes HTML entities (&, <, &#x..., etc.)
and strips HTML tags before using frontmatter description/summary as WeChat article digest
This commit is contained in:
Jim Liu 宝玉
2026-04-12 20:16:53 -05:00
parent 517ff566a1
commit 990fea4f7b
7 changed files with 138 additions and 13 deletions
@@ -4,6 +4,7 @@ import path from "node:path";
import process from "node:process";
import {
cleanSummaryText,
extractSummaryFromBody,
extractTitleFromMarkdown,
parseFrontmatter,
@@ -47,8 +48,9 @@ export async function convertMarkdown(
}
const author = stripWrappingQuotes(frontmatter.author ?? "");
let summary = stripWrappingQuotes(frontmatter.description ?? "")
const frontmatterSummary = stripWrappingQuotes(frontmatter.description ?? "")
|| stripWrappingQuotes(frontmatter.summary ?? "");
let summary = cleanSummaryText(frontmatterSummary);
if (!summary) {
summary = extractSummaryFromBody(body, 120);
}