Module:PageSummary:修订间差异
武外梗百科 爱国好学自强图新的百科全书
更多操作
无编辑摘要 |
无编辑摘要 |
||
| 第1行: | 第1行: | ||
local p = {} | local p = {} | ||
-- | -- 核心清理函数:仅使用 gsub,不使用 while,从根源杜绝死循环 | ||
local function | local function safeStrip(text) | ||
if not text then return "" end | if not text then return "" end | ||
-- 1. 移除引用和注释 | -- 1. 移除引用和注释 | ||
text = string.gsub(text, "<ref.-</ref>", "") | |||
text = string.gsub(text, "<ref.->", "") | |||
text = string.gsub(text, "<!%-%-.-%-%->", "") | |||
-- 2. | -- 2. 移除图片标签(分两步粉碎,处理掉带有一层链接的图片描述) | ||
local prefixes = {"[ | local prefixes = {"[Ff]ile:", "[Ii]mage:", "文件:", "图像:"} | ||
for _, | for _, prefix in ipairs(prefixes) do | ||
-- 第一步:爆破嵌套链接的图片 [[File:xxx|[[yyy]]]] | |||
text = string.gsub(text, "%[%[" .. prefix .. "[^%[%]]+ %[%[[^%[%]]+%]%] [^%[%]]+ %]%]", "") | |||
-- 第二步:处理普通图片 | |||
text = string.gsub(text, "%[%[" .. prefix .. ".-%]%]", "") | |||
end | end | ||
-- 3. 移除模板 ( | -- 3. 移除模板 (不递归,只跑 3 次,保证性能) | ||
text = string.gsub(text, "{{[^{}]+}}", "") | |||
text = string.gsub(text, "{{[^{}]+}}", "") | |||
text = string.gsub(text, "{{[^{}]+}}", "") | |||
-- 4. 移除 Wiki 格式符号 | -- 4. 移除 Wiki 格式符号 | ||
text = string.gsub(text, "\n==+.-==+", " ") | |||
text = string.gsub(text, "\n%s*[*#:]+", " ") | |||
text = string.gsub(text, "&[Nn][Bb][Ss][Pp];", " ") | |||
text = string.gsub(text, "\n", " ") | |||
text = string.gsub(text, "%s+", " ") | |||
return mw.text.trim( | return mw.text.trim(text) | ||
end | end | ||
| 第64行: | 第40行: | ||
local content = title:getContent() | local content = title:getContent() | ||
local rawExcerpt = mw.ustring.sub(content, 1, | -- 减少预加载长度到 400,从源头降低压力 | ||
local rawExcerpt = mw.ustring.sub(content, 1, 400) | |||
-- | -- 提取第一张图(不带参数,直接拿名字) | ||
local firstImage = string.match(rawExcerpt, "%[%[([Ff]ile:[^|%]]+)") or | local firstImage = string.match(rawExcerpt, "%[%[([Ff]ile:[^|%]%s]+)") or | ||
string.match(rawExcerpt, "%[%[(文件:[^|%]]+)") | string.match(rawExcerpt, "%[%[(文件:[^|%]%s]+)") | ||
-- 执行安全清理 | -- 执行安全清理 | ||
local cleanText = | local cleanText = safeStrip(rawExcerpt) | ||
-- 截断 150 字 | -- 截断 150 字 | ||
| 第77行: | 第54行: | ||
local summary = mw.ustring.sub(cleanText, 1, targetLen) | local summary = mw.ustring.sub(cleanText, 1, targetLen) | ||
-- | -- 简单的截断修复 | ||
summary = string.gsub(summary, "%[+$", "") -- 移除末尾残留的 [ | |||
local _, opens = string.gsub(summary, "%[%[", "") | local _, opens = string.gsub(summary, "%[%[", "") | ||
local _, closes = string.gsub(summary, "%]%]", "") | local _, closes = string.gsub(summary, "%]%]", "") | ||
if opens > closes then | if opens > closes then | ||
-- 链接不完整时,直接反向切掉最后一段,不进行向后搜索(向后搜索最耗资源) | |||
local lastOpen = string.find(summary:reverse(), "%[%[") | |||
if lastOpen then | |||
summary = string.sub(summary, 1, #summary - lastOpen - 1) | |||
end | end | ||
end | end | ||
summary = mw.text.trim(summary) | summary = mw.text.trim(summary) | ||
if mw.ustring.len(cleanText) > targetLen then | if mw.ustring.len(cleanText) > targetLen then | ||
summary = summary .. "..." | summary = summary .. "..." | ||
end | end | ||
2025年12月21日 (日) 18:21的版本
此模块的文档可以在Module:PageSummary/doc创建
local p = {}
-- 核心清理函数:仅使用 gsub,不使用 while,从根源杜绝死循环
local function safeStrip(text)
if not text then return "" end
-- 1. 移除引用和注释
text = string.gsub(text, "<ref.-</ref>", "")
text = string.gsub(text, "<ref.->", "")
text = string.gsub(text, "<!%-%-.-%-%->", "")
-- 2. 移除图片标签(分两步粉碎,处理掉带有一层链接的图片描述)
local prefixes = {"[Ff]ile:", "[Ii]mage:", "文件:", "图像:"}
for _, prefix in ipairs(prefixes) do
-- 第一步:爆破嵌套链接的图片 [[File:xxx|[[yyy]]]]
text = string.gsub(text, "%[%[" .. prefix .. "[^%[%]]+ %[%[[^%[%]]+%]%] [^%[%]]+ %]%]", "")
-- 第二步:处理普通图片
text = string.gsub(text, "%[%[" .. prefix .. ".-%]%]", "")
end
-- 3. 移除模板 (不递归,只跑 3 次,保证性能)
text = string.gsub(text, "{{[^{}]+}}", "")
text = string.gsub(text, "{{[^{}]+}}", "")
text = string.gsub(text, "{{[^{}]+}}", "")
-- 4. 移除 Wiki 格式符号
text = string.gsub(text, "\n==+.-==+", " ")
text = string.gsub(text, "\n%s*[*#:]+", " ")
text = string.gsub(text, "&[Nn][Bb][Ss][Pp];", " ")
text = string.gsub(text, "\n", " ")
text = string.gsub(text, "%s+", " ")
return mw.text.trim(text)
end
function p.getSummaryAndImage(frame)
local pageName = frame.args[1] or ""
local title = mw.title.new(pageName)
if not title or not title.exists then return "" end
local content = title:getContent()
-- 减少预加载长度到 400,从源头降低压力
local rawExcerpt = mw.ustring.sub(content, 1, 400)
-- 提取第一张图(不带参数,直接拿名字)
local firstImage = string.match(rawExcerpt, "%[%[([Ff]ile:[^|%]%s]+)") or
string.match(rawExcerpt, "%[%[(文件:[^|%]%s]+)")
-- 执行安全清理
local cleanText = safeStrip(rawExcerpt)
-- 截断 150 字
local targetLen = 150
local summary = mw.ustring.sub(cleanText, 1, targetLen)
-- 简单的截断修复
summary = string.gsub(summary, "%[+$", "") -- 移除末尾残留的 [
local _, opens = string.gsub(summary, "%[%[", "")
local _, closes = string.gsub(summary, "%]%]", "")
if opens > closes then
-- 链接不完整时,直接反向切掉最后一段,不进行向后搜索(向后搜索最耗资源)
local lastOpen = string.find(summary:reverse(), "%[%[")
if lastOpen then
summary = string.sub(summary, 1, #summary - lastOpen - 1)
end
end
summary = mw.text.trim(summary)
if mw.ustring.len(cleanText) > targetLen then
summary = summary .. "..."
end
-- 渲染
local container = mw.html.create('div'):css({['margin-bottom']='25px', ['display']='flow-root'})
if firstImage then
container:wikitext('[[' .. firstImage .. '|150px|right|link=' .. pageName .. ']]')
end
container:tag('div')
:css({['font-size']='1.35em', ['font-weight']='bold', ['margin-bottom']='6px'})
:wikitext('[[' .. pageName .. ']]')
container:tag('div')
:css({['line-height']='1.6', ['color']='#202122'})
:wikitext(summary)
return tostring(container)
end
return p