ci / go (push) Waiting to run
ci / go-db (agent) (push) Waiting to run
ci / go-db (config) (push) Waiting to run
ci / go-db (db) (push) Waiting to run
ci / go-db (evidence) (push) Waiting to run
ci / go-db (llmrec) (push) Waiting to run
ci / go-db (server) (push) Waiting to run
detections / detections (push) Waiting to run
web / web (push) Waiting to run
docs / links (push) Canceled after 0s
151 lines
5.3 KiB
Go
151 lines
5.3 KiB
Go
package notify
|
|
|
|
import (
|
|
"strings"
|
|
"testing"
|
|
"unicode/utf8"
|
|
)
|
|
|
|
func TestTruncateBytesKeepsValidUTF8(t *testing.T) {
|
|
// 这是本包最要紧的一条不变量。企微按**字节**限长,中文 3 字节/字,
|
|
// 任何按字节硬切的实现都会把汉字切成半个,产出非法 UTF-8 而被平台拒收。
|
|
// 用长度互质的多种中英混排输入去撞每一个可能的切点。
|
|
inputs := []string{
|
|
"中文测试内容",
|
|
"混合 mixed 内容 content",
|
|
"a中b文c测d试e",
|
|
"🔴🟠🟡🔵", // 4 字节 emoji,切错更明显
|
|
strings.Repeat("漏洞", 100),
|
|
}
|
|
for _, in := range inputs {
|
|
for max := 1; max <= len(in)+2; max++ {
|
|
got := TruncateBytes(in, max)
|
|
if !utf8.ValidString(got) {
|
|
t.Fatalf("输入 %q max=%d: 产出非法 UTF-8 %q", in, max, got)
|
|
}
|
|
if len(got) > max {
|
|
t.Fatalf("输入 %q max=%d: 结果 %d 字节超出上限", in, max, len(got))
|
|
}
|
|
// 未被截断时不得改动内容。
|
|
if len(in) <= max && got != in {
|
|
t.Fatalf("输入 %q max=%d: 未超限却改动了内容 -> %q", in, max, got)
|
|
}
|
|
}
|
|
}
|
|
}
|
|
|
|
func TestTruncateBytesZeroMeansUnlimited(t *testing.T) {
|
|
long := strings.Repeat("x", 10000)
|
|
if got := TruncateBytes(long, 0); got != long {
|
|
t.Fatal("max=0 应表示不限制")
|
|
}
|
|
if got := TruncateBytes(long, -5); got != long {
|
|
t.Fatal("max<0 应表示不限制")
|
|
}
|
|
}
|
|
|
|
func TestTruncateBytesEllipsisBudget(t *testing.T) {
|
|
// max 小于省略号本身时,不能因为追加省略号而反过来超限。
|
|
got := TruncateBytes("abcdefgh", 1)
|
|
if len(got) > 1 {
|
|
t.Fatalf("max=1 时结果 %q 长度 %d 超限", got, len(got))
|
|
}
|
|
// 正常情况应带省略号。
|
|
if got := TruncateBytes("abcdefgh", 5); !strings.HasSuffix(got, ellipsis) {
|
|
t.Fatalf("期望带省略号,得到 %q", got)
|
|
}
|
|
}
|
|
|
|
func TestTruncateRunesCountsCharactersNotBytes(t *testing.T) {
|
|
// 与 TruncateBytes 的口径差异必须保留:Telegram 按字符限长,
|
|
// 用字节口径会把中文消息切到只剩三分之一。
|
|
s := "一二三四五六七八九十"
|
|
got := TruncateRunes(s, 5)
|
|
if n := utf8.RuneCountInString(got); n != 5 {
|
|
t.Fatalf("期望 5 个字符,得到 %d 个 (%q)", n, got)
|
|
}
|
|
// 同样的字符串按字节口径应明显更短。
|
|
if utf8.RuneCountInString(TruncateBytes(s, 5)) >= 5 {
|
|
t.Fatal("字节口径不应产出与字符口径相同的字符数")
|
|
}
|
|
}
|
|
|
|
func TestOneLineCollapsesWhitespace(t *testing.T) {
|
|
got := OneLine("第一行\n\n第二行\t带制表 多空格", 0)
|
|
if strings.ContainsAny(got, "\n\t") {
|
|
t.Fatalf("应折叠所有空白,得到 %q", got)
|
|
}
|
|
if strings.Contains(got, " ") {
|
|
t.Fatalf("不应保留连续空格,得到 %q", got)
|
|
}
|
|
// 截断后仍须可读且合法。
|
|
got = OneLine("一二三四五六七八九十", 4)
|
|
if n := utf8.RuneCountInString(got); n != 4 {
|
|
t.Fatalf("期望 4 字符,得到 %d (%q)", n, got)
|
|
}
|
|
}
|
|
|
|
func TestTruncateHTMLNeverCutsTagInHalf(t *testing.T) {
|
|
// 直接截断 HTML 会切出 `<a href="htt` 这种残片,平台会拒收整条消息。
|
|
s := `<b>标题</b>正文正文正文<a href="https://example.com/very/long/path">查看详情</a>`
|
|
for max := 1; max <= utf8.RuneCountInString(s)+2; max++ {
|
|
got := TruncateHTML(s, max)
|
|
if n := utf8.RuneCountInString(got); max > 0 && n > max {
|
|
t.Fatalf("max=%d: 结果 %d 字符超限", max, n)
|
|
}
|
|
// 尾部不能有未闭合的 `<`(即最后一段里出现 `<` 却无 `>`)。
|
|
if lt := strings.LastIndex(got, "<"); lt >= 0 && !strings.Contains(got[lt:], ">") {
|
|
t.Fatalf("max=%d: 尾部标签被切断 -> %q", max, got)
|
|
}
|
|
}
|
|
}
|
|
|
|
func TestAssetLineOmitsExcess(t *testing.T) {
|
|
if got := assetLine(nil, 3); got != "" {
|
|
t.Fatalf("无资产应返回空串,得到 %q", got)
|
|
}
|
|
if got := assetLine([]string{"a", "b"}, 3); got != "a, b" {
|
|
t.Fatalf("未超限应全列,得到 %q", got)
|
|
}
|
|
// 超出上限时必须标注总数,否则读者不知道还有多少资产没列出来。
|
|
got := assetLine([]string{"a", "b", "c", "d", "e"}, 2)
|
|
if !strings.Contains(got, "등 5개") {
|
|
t.Fatalf("应标注总数 5,得到 %q", got)
|
|
}
|
|
}
|
|
|
|
func TestSeverityAndStatusLabels(t *testing.T) {
|
|
if AtLeast("", "low") {
|
|
t.Fatal("空级别序数为 0,应被任何门槛挡住")
|
|
}
|
|
if !AtLeast("critical", "") {
|
|
t.Fatal("空门槛应放行")
|
|
}
|
|
if got := StatusLabel("fixed"); got != "수정됨" {
|
|
t.Fatalf("未知状态映射,得到 %q", got)
|
|
}
|
|
// 未知状态原样回显,不臆造标签。
|
|
if got := StatusLabel("weird_status"); got != "weird_status" {
|
|
t.Fatalf("未知状态应原样回显,得到 %q", got)
|
|
}
|
|
}
|
|
|
|
// TestTruncateHTMLNeverCutsEntity 覆盖审计指出的一处遗漏:截断不只要避开
|
|
// 半截标签,还要避开被切断的 HTML 实体。
|
|
//
|
|
// `&` 被切成 `&` 之后,一个只认实体的解析器可能拒收**整条**消息——
|
|
// 而超长汇总消息本来就常见,代价太大。
|
|
func TestTruncateHTMLNeverCutsEntity(t *testing.T) {
|
|
s := "aaaa&bbbb<cccc"dddd"
|
|
for max := 1; max <= utf8.RuneCountInString(s)+2; max++ {
|
|
got := TruncateHTML(s, max)
|
|
// 尾部不得出现「有 & 但没有对应 ;」的实体残片。
|
|
if amp := strings.LastIndex(got, "&"); amp >= 0 && !strings.Contains(got[amp:], ";") {
|
|
t.Fatalf("max=%d: 尾部留下实体残片 %q", max, got[amp:])
|
|
}
|
|
if strings.Contains(got, "&\x00") {
|
|
t.Fatalf("max=%d: 出现畸形实体", max)
|
|
}
|
|
}
|
|
}
|