在Web开发早期,站内全文检索是一个很常见的需求——用户输入一个关键词,系统就能从一堆静态HTML文件里找出包含该词的所有页面。今天翻出一段老代码,正好聊聊当年用ASP+纯文本文件实现全文搜索的思路。虽然现在有Elasticsearch、Solr这些“重型武器”,但理解这种最朴素的实现方式,对掌握文件操作和数据库查询的结合依然有启发。

核心流程:从用户输入到结果输出

整个检索过程分三步走:首先,从用户提交的表单中拿到搜索关键词;然后,遍历一个记录所有文件信息的数据库表,逐个打开对应的物理文件;最后,在每个文件中搜索匹配的字符串,将匹配成功的文件标题以超链接的形式返回给用户。

代码的开头部分做了几件基础工作:设置鼠标指针样式(mousepointer=13),建立ODBC数据库连接(DSN=intels),从pages_catalogue表中提取所有记录。这里的关键是,数据库只存了文件的标题和文件名,真正的文件内容存放在服务器硬盘上——没错,这就是最原始的“数据库+文件系统”混合检索方案。

拿到用户输入后,有一段预处理逻辑:

' 匹配字串的长度.预处理Request取得的数据(用户输入的有用信息), 通过计算有效信息长度来截取所需的字串.我们也可以在输入字串后附加一标志字符(如#或chr(7))来处理.
doubbytes=len(sch_str)\2 
sch_str=left(sch_str,doubbytes)

这段代码的意图是处理中英文混输时的字节对齐问题。因为VBScript的Len函数对中文字符按2字节计算,而截取函数Left是按字符数操作的,所以需要先除以2再截取,避免乱码。当然,更严谨的做法是附加一个终止符,但这里用取整除法也够用。

核心函数:text_match 文件全文匹配

整个检索的灵魂是一个名为text_match的函数,它用VBScript编写,在服务器端执行。逻辑非常直接:

function text_match(filename,search_string)
    dim retstring
    dim find_pos
    Dim fso, a
    dim done
    text_match=false
    Set fso = Server.CreateObject("Scripting.FileSystemObject")
    ' 创建脚本的文件系统,打开文本流以读入.
    Set a = fso.OpenTextFile(filename, 1, FALSE) 
    done=a.AtEndOfStream or text_match
    Do While not done
        retstring = a.ReadLine
        find_pos=instr(retstring,search_string)
        if find_pos>0 then text_match=true
        done=a.AtEndOfStream or text_match
    Loop
    a.Close
end function

它用FileSystemObject打开指定文件,一行一行地读,用InStr函数判断当前行是否包含搜索词。一旦找到就立即返回True,并停止读取。这个函数被主循环中的每个文件调用,决定是否将该文件列入结果列表。

结果输出与错误处理

主循环遍历数据库记录集,对每个文件执行text_match。如果匹配成功,就构造一个超链接,链接地址指向文件对应的URL路径,链接文本就是文件标题。所有匹配结果包裹在

本文转载于:https://www.jb51.net/article/4789.htm 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。