发布于2026-07-22 阅读(0)
扫一扫,手机访问
在Web开发早期,站内全文检索是一个很常见的需求——用户输入一个关键词,系统就能从一堆静态HTML文件里找出包含该词的所有页面。今天翻出一段老代码,正好聊聊当年用ASP+纯文本文件实现全文搜索的思路。虽然现在有Elasticsearch、Solr这些“重型武器”,但理解这种最朴素的实现方式,对掌握文件操作和数据库查询的结合依然有启发。
整个检索过程分三步走:首先,从用户提交的表单中拿到搜索关键词;然后,遍历一个记录所有文件信息的数据库表,逐个打开对应的物理文件;最后,在每个文件中搜索匹配的字符串,将匹配成功的文件标题以超链接的形式返回给用户。
代码的开头部分做了几件基础工作:设置鼠标指针样式(mousepointer=13),建立ODBC数据库连接(DSN=intels),从pages_catalogue表中提取所有记录。这里的关键是,数据库只存了文件的标题和文件名,真正的文件内容存放在服务器硬盘上——没错,这就是最原始的“数据库+文件系统”混合检索方案。
拿到用户输入后,有一段预处理逻辑:
' 匹配字串的长度.预处理Request取得的数据(用户输入的有用信息), 通过计算有效信息长度来截取所需的字串.我们也可以在输入字串后附加一标志字符(如#或chr(7))来处理.
doubbytes=len(sch_str)\2
sch_str=left(sch_str,doubbytes)
这段代码的意图是处理中英文混输时的字节对齐问题。因为VBScript的Len函数对中文字符按2字节计算,而截取函数Left是按字符数操作的,所以需要先除以2再截取,避免乱码。当然,更严谨的做法是附加一个终止符,但这里用取整除法也够用。
整个检索的灵魂是一个名为text_match的函数,它用VBScript编写,在服务器端执行。逻辑非常直接:
function text_match(filename,search_string)
dim retstring
dim find_pos
Dim fso, a
dim done
text_match=false
Set fso = Server.CreateObject("Scripting.FileSystemObject")
' 创建脚本的文件系统,打开文本流以读入.
Set a = fso.OpenTextFile(filename, 1, FALSE)
done=a.AtEndOfStream or text_match
Do While not done
retstring = a.ReadLine
find_pos=instr(retstring,search_string)
if find_pos>0 then text_match=true
done=a.AtEndOfStream or text_match
Loop
a.Close
end function
它用FileSystemObject打开指定文件,一行一行地读,用InStr函数判断当前行是否包含搜索词。一旦找到就立即返回True,并停止读取。这个函数被主循环中的每个文件调用,决定是否将该文件列入结果列表。
主循环遍历数据库记录集,对每个文件执行text_match。如果匹配成功,就构造一个超链接,链接地址指向文件对应的URL路径,链接文本就是文件标题。所有匹配结果包裹在列表标签中输出。
循环结束后,用一个布尔变量result记录是否有任何匹配。如果全程都没有匹配,就输出“对不起,没有找到!”。最后将鼠标指针恢复为默认样式(mousepointer=0)。
这段代码虽然年代久远,但有几个设计点值得回味:
当然,缺点也很明显:每次搜索都要遍历所有文件,且文件内容无法被数据库索引,数据量一大就会变得很慢。但话说回来,在只有几十个静态页面的个人站点上,这种方案完全够用。
[1]