1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
package search
 
import (
    "testing"
)
 
// TestExploreParagraphExtraction 段落截取:只输出命中关键词的段落,整段不截半句
func TestExploreParagraphExtraction(t *testing.T) {
    content := "# 标题\n\n第一段讲称重。\n\n## 补气流程\n\n补气失败时先检查阀门。\n\n## 其他\n\n无关内容。\n"
    got := extractRelevantParagraphs(content, []string{"补气"}, 100)
    want := "## 补气流程\n\n补气失败时先检查阀门。\n"
    if got != want {
        t.Errorf("段落截取:\n got=%q\nwant=%q", got, want)
    }
}
 
// TestExploreWholeDocWhenSmall 文档短于预算时整篇输出
func TestExploreWholeDocWhenSmall(t *testing.T) {
    got := extractRelevantParagraphs("短文档\n", []string{"不存在"}, 10000)
    if got != "短文档\n" {
        t.Errorf("应整篇输出: %q", got)
    }
}
 
// TestExploreKeywordExpansion 长 CJK 词拆 bigram(原词保留,ASCII/短词不拆)
func TestExploreKeywordExpansion(t *testing.T) {
    got := expandKeywords([]string{"电子秤补气失败", "补气", "abc"})
    want := []string{"电子秤补气失败", "电子", "子秤", "秤补", "补气", "气失", "失败", "补气", "abc"}
    if len(got) != len(want) {
        t.Fatalf("展开数量: got=%d want=%d (%v)", len(got), len(want), got)
    }
    for i := range want {
        if got[i] != want[i] {
            t.Errorf("第 %d 项: got=%q want=%q", i, got[i], want[i])
        }
    }
}
 
func TestExploreBudget(t *testing.T) {
    // 用 extractRelevantParagraphs 的预算版验证:预算 20 字节,命中段落 30 字节 → 输出空(宁缺毋滥,不截半段)
    got := extractWithBudget("## 段落\n\n这是一段超过预算的内容啊\n", []string{"段落"}, 20)
    if got != "" {
        t.Errorf("超预算段落应跳过: %q", got)
    }
}