First Commit
ci / go (push) Waiting to run
ci / go-db (agent) (push) Waiting to run
ci / go-db (config) (push) Waiting to run
ci / go-db (db) (push) Waiting to run
ci / go-db (evidence) (push) Waiting to run
ci / go-db (llmrec) (push) Waiting to run
ci / go-db (server) (push) Waiting to run
web / web (push) Waiting to run
docs / links (push) Canceled after 0s
detections / detections (push) Canceled after 0s

This commit is contained in:
dela
2026-10-09 08:38:16 +08:00
commit 0335d572de
756 changed files with 201663 additions and 0 deletions
+150
View File
@@ -0,0 +1,150 @@
package notify
import (
"strings"
"testing"
"unicode/utf8"
)
func TestTruncateBytesKeepsValidUTF8(t *testing.T) {
// 这是本包最要紧的一条不变量。企微按**字节**限长,中文 3 字节/字,
// 任何按字节硬切的实现都会把汉字切成半个,产出非法 UTF-8 而被平台拒收。
// 用长度互质的多种中英混排输入去撞每一个可能的切点。
inputs := []string{
"中文测试内容",
"混合 mixed 内容 content",
"a中b文c测d试e",
"🔴🟠🟡🔵", // 4 字节 emoji,切错更明显
strings.Repeat("漏洞", 100),
}
for _, in := range inputs {
for max := 1; max <= len(in)+2; max++ {
got := TruncateBytes(in, max)
if !utf8.ValidString(got) {
t.Fatalf("输入 %q max=%d: 产出非法 UTF-8 %q", in, max, got)
}
if len(got) > max {
t.Fatalf("输入 %q max=%d: 结果 %d 字节超出上限", in, max, len(got))
}
// 未被截断时不得改动内容。
if len(in) <= max && got != in {
t.Fatalf("输入 %q max=%d: 未超限却改动了内容 -> %q", in, max, got)
}
}
}
}
func TestTruncateBytesZeroMeansUnlimited(t *testing.T) {
long := strings.Repeat("x", 10000)
if got := TruncateBytes(long, 0); got != long {
t.Fatal("max=0 应表示不限制")
}
if got := TruncateBytes(long, -5); got != long {
t.Fatal("max<0 应表示不限制")
}
}
func TestTruncateBytesEllipsisBudget(t *testing.T) {
// max 小于省略号本身时,不能因为追加省略号而反过来超限。
got := TruncateBytes("abcdefgh", 1)
if len(got) > 1 {
t.Fatalf("max=1 时结果 %q 长度 %d 超限", got, len(got))
}
// 正常情况应带省略号。
if got := TruncateBytes("abcdefgh", 5); !strings.HasSuffix(got, ellipsis) {
t.Fatalf("期望带省略号,得到 %q", got)
}
}
func TestTruncateRunesCountsCharactersNotBytes(t *testing.T) {
// 与 TruncateBytes 的口径差异必须保留:Telegram 按字符限长,
// 用字节口径会把中文消息切到只剩三分之一。
s := "一二三四五六七八九十"
got := TruncateRunes(s, 5)
if n := utf8.RuneCountInString(got); n != 5 {
t.Fatalf("期望 5 个字符,得到 %d 个 (%q)", n, got)
}
// 同样的字符串按字节口径应明显更短。
if utf8.RuneCountInString(TruncateBytes(s, 5)) >= 5 {
t.Fatal("字节口径不应产出与字符口径相同的字符数")
}
}
func TestOneLineCollapsesWhitespace(t *testing.T) {
got := OneLine("第一行\n\n第二行\t带制表 多空格", 0)
if strings.ContainsAny(got, "\n\t") {
t.Fatalf("应折叠所有空白,得到 %q", got)
}
if strings.Contains(got, " ") {
t.Fatalf("不应保留连续空格,得到 %q", got)
}
// 截断后仍须可读且合法。
got = OneLine("一二三四五六七八九十", 4)
if n := utf8.RuneCountInString(got); n != 4 {
t.Fatalf("期望 4 字符,得到 %d (%q)", n, got)
}
}
func TestTruncateHTMLNeverCutsTagInHalf(t *testing.T) {
// 直接截断 HTML 会切出 `<a href="htt` 这种残片,平台会拒收整条消息。
s := `<b>标题</b>正文正文正文<a href="https://example.com/very/long/path">查看详情</a>`
for max := 1; max <= utf8.RuneCountInString(s)+2; max++ {
got := TruncateHTML(s, max)
if n := utf8.RuneCountInString(got); max > 0 && n > max {
t.Fatalf("max=%d: 结果 %d 字符超限", max, n)
}
// 尾部不能有未闭合的 `<`(即最后一段里出现 `<` 却无 `>`)。
if lt := strings.LastIndex(got, "<"); lt >= 0 && !strings.Contains(got[lt:], ">") {
t.Fatalf("max=%d: 尾部标签被切断 -> %q", max, got)
}
}
}
func TestAssetLineOmitsExcess(t *testing.T) {
if got := assetLine(nil, 3); got != "" {
t.Fatalf("无资产应返回空串,得到 %q", got)
}
if got := assetLine([]string{"a", "b"}, 3); got != "a, b" {
t.Fatalf("未超限应全列,得到 %q", got)
}
// 超出上限时必须标注总数,否则读者不知道还有多少资产没列出来。
got := assetLine([]string{"a", "b", "c", "d", "e"}, 2)
if !strings.Contains(got, "등 5개") {
t.Fatalf("应标注总数 5,得到 %q", got)
}
}
func TestSeverityAndStatusLabels(t *testing.T) {
if AtLeast("", "low") {
t.Fatal("空级别序数为 0,应被任何门槛挡住")
}
if !AtLeast("critical", "") {
t.Fatal("空门槛应放行")
}
if got := StatusLabel("fixed"); got != "수정됨" {
t.Fatalf("未知状态映射,得到 %q", got)
}
// 未知状态原样回显,不臆造标签。
if got := StatusLabel("weird_status"); got != "weird_status" {
t.Fatalf("未知状态应原样回显,得到 %q", got)
}
}
// TestTruncateHTMLNeverCutsEntity 覆盖审计指出的一处遗漏:截断不只要避开
// 半截标签,还要避开被切断的 HTML 实体。
//
// `&amp;` 被切成 `&amp` 之后,一个只认实体的解析器可能拒收**整条**消息——
// 而超长汇总消息本来就常见,代价太大。
func TestTruncateHTMLNeverCutsEntity(t *testing.T) {
s := "aaaa&amp;bbbb&lt;cccc&quot;dddd"
for max := 1; max <= utf8.RuneCountInString(s)+2; max++ {
got := TruncateHTML(s, max)
// 尾部不得出现「有 & 但没有对应 ;」的实体残片。
if amp := strings.LastIndex(got, "&"); amp >= 0 && !strings.Contains(got[amp:], ";") {
t.Fatalf("max=%d: 尾部留下实体残片 %q", max, got[amp:])
}
if strings.Contains(got, "&amp\x00") {
t.Fatalf("max=%d: 出现畸形实体", max)
}
}
}