- 浏览: 203307 次
- 性别:
- 来自: 重庆
文章分类
最新评论
-
liping0423:
这边文章 的很不错,拿去用了。谢谢
Oracle时间加减 -
Salyang:
黑莓软件还是很多的,而且我有整理,发布在我的站点里了,www. ...
BlackBerry手机常用软件(在8820中测试通过) -
bulktree:
应该有个清单吧
BlackBerry手机常用软件(在8820中测试通过) -
binyan17:
xkorey 写道那些软件都是什么功能?介绍下吧。
里面的软件 ...
BlackBerry手机常用软件(在8820中测试通过) -
xkorey:
那些软件都是什么功能?介绍下吧。
BlackBerry手机常用软件(在8820中测试通过)
官方网站:http://www.sphinxsearch.com/ 1.Windows下安装Sphinx [D:\coreseek-3.2.13-win32\api]API接口目录,其中包括了php,python,ruby等操作实例,其中test_coreseek.php是一个不错的中文检索的例子. [D:\****\bin]应用程序目录,其中包含以下几个文件 [D:\****\etc]sphinx配置目录 1.2.创建配置文件 #源定义 # 数据库服务器基本配置信息 #命令行查询时,从数据库读取原始数据信息 source delta # 数据库服务器基本配置信息 # 增量索引,从最大id开始 #命令行查询时,从数据库读取原始数据信息 #index定义 index delta : mysql #全局index定义 #searchd服务定义 ------------------------------------------------------------------------------------------------------- 1.3.建立索引 d:&cd D:\coreseek-3.2.13-win32\bin 先切换到sphinx的bin目录,然后再执行: indexer.exe -c D:\coreseek-3.2.13-win32\etc\csft_dedecmsv57.conf mysql --rotate 这个时候sphinx开始构建索引,如果数据量比较大,这个时间可能比较长,需要耐心等待(如图1). 然后再创建下增量索引,使用下列命令: 1.4.测试检索是否正常 search.exe -c D:\coreseek-3.2.13-win32\etc\csft_dedecmsv57.conf dedecms 如果能够正常返回数据(如图2),则说明已经成功建立索引. 2.结合DedeCMS程序使用sphinx sphinx_test.php $mode = SPH_MATCH_ANY; //匹配模式 $res = $sphinx->Query('织梦内容管理系统'); //var_dump($sphinx); ----------------------------------------------------------------------------------------------------- 2.2.创建一个DedeSphinx服务 searchd.exe --install -c D:\coreseek-3.2.13-win32\etc\csft_dedecmsv57.conf --servicename DedeSphinx 3.更新与维护 如果内容更新比较频繁,下列的命令需要每分钟被执行一次(可以创建一个脚本,使用windows计划任务定期执行) 生成增量索引: indexer.exe -c D:\coreseek-3.2.13-win32\etc\csft_dedecmsv57.conf delta --rotate 当然每一天都需要将增量索引合并到主索引mysql中去,需要执行: indexer.exe -c D:\coreseek-3.2.13-win32\etc\csft_dedecmsv57.conf --merge mysql delta --rotate
官方文档:http://www.sphinxsearch.com/docs/
中文支持:http://www.coreseek.cn/
中文使用手册下载:http://www.coreseek.cn/uploads/pdf/sphinx_doc_zhcn_0.9.pdf
中文在线手册:http://www.coreseek.cn/docs/coreseek_3.2-sphinx_0.9.9.html
1.1.开始前的准备工作
先从http://www.coreseek.cn/products/ft_down/下载Coreseek 3.2.13,这里我们就以Windows环境为例:
下载后直接解压coreseek-3.2.13-win32.zip,我们这里假设解压到:D:\coreseek-3.2.13-win32.这里我们需要简单了解几个目录:
* indexer: 用于创建全文索引;
* search: 一个简单的命令行(CLI) 的测试程序,用于测试全文索引;
* searchd: 一个守护进程,其他软件可以通过这个守护进程进行全文检索;
* sphinxapi: 一系列searchd 的客户端API 库,用于流行的Web脚本开发语言(PHP, Python, Perl, Ruby, Java).
* spelldump: 一个简单的命令行工具,用于从 ispell 或 MySpell (OpenOffice内置绑定) 格式的字典中提取词条。当使用 wordforms 时可用这些词条对索引进行定制.
* indextool: 工具程序,用来转储关于索引的多项调试信息。 此工具是从版本Coreseek 3.1(Sphinx 0.9.9-rc2)开始加入的。
* mmseg: 工具程序和库,Coreseek用于提供中文分词和词典处理。
[D:\****\var]sphinx变量&索引&日志存放目录
由于DedeCms使用的是mysql,所以我们需要来配置一个mysql的sphinx模板配置,可以复制csft_mysql.conf改名为:csft_dedecmsv57.conf,例如我们这里仅做文章的全文检索,我们需要做如下配置:
先在DedeCMS中创建一个统计表,方法可以在DedeCMS后台[系统]->[SQL命令行工具]中执行下列代码:
CREATE TABLE `dede_sphinx` (
`countid` int(11) unsigned NOT NULL,
`maxaid` int(11) unsigned NOT NULL,
PRIMARY KEY (`countid`)
) ENGINE=MyISAM DEFAULT CHARSET=gbk
这是一个sphinx内容统计表,为了适合数据量较大的情况下分批生成索引而使用的.
创建完数据表后,我们对sphinx的配置文件,即csft_dedecmsv57.conf修改,内容如下,其中包含注释:
--------------------------------------------------------------------------------------------
source mysql
{
type = mysql
sql_host = 192.168.0.103
sql_user = dedev57
sql_pass = dedecms
sql_db = dedecmsv57gbk
sql_port = 3306
# 设定编码,这里我们是gbk编码,如果是utf-8,可以设置:
# sql_query_pre = SET NAMES utf8
sql_query_pre = SET NAMES gbk
# 数据检索增量
sql_range_step = 1000
#当前最新文档id数
sql_query_pre = REPLACE INTO dede_sphinx SELECT 1, MAX(id) FROM dede_archives
#检索条件
sql_query = SELECT ARC.id,ARC.typeid,ARC.typeid2,ARC.sortrank,ARC.flag,ARC.channel,ARC.ismake,ARC.arcrank,ARC.click,ARC.title,ARC.shorttitle,ARC.color,ARC.writer,ARC.source,ARC.litpic,ARC.pubdate,ARC.senddate,ARC.mtype,ARC.description,ARC.badpost,ARC.goodpost,ARC.scores,ARC.lastpost,ARC.keywords,ARC.mid,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id>=$start AND ARC.id<=$end #sql_query第一列id需为整数
#title、body作为字符串/文本字段,被全文索引
# 获取当前最大检索id
sql_query_range = SELECT 1,maxaid FROM dede_sphinx WHERE countid=1
sql_attr_uint = typeid #从SQL读取到的值必须为整数
sql_attr_uint = typeid2
sql_attr_uint = channel
sql_attr_uint = click
sql_attr_uint = badpost
sql_attr_uint = goodpost
sql_attr_uint = scores
sql_attr_uint = mid
sql_attr_timestamp = pubdate #从SQL读取到的值必须为整数,作为时间属性
sql_attr_timestamp = senddate
sql_attr_timestamp = lastpost
sql_query_info = SELECT ARC.*,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id=$id
}
{
type = mysql
sql_host = 192.168.0.103
sql_user = dedev57
sql_pass = dedecms
sql_db = dedecmsv57gbk
sql_port = 3306
sql_query_pre = SET NAMES gbk
sql_query = SELECT ARC.id,ARC.typeid,ARC.typeid2,ARC.sortrank,ARC.flag,ARC.channel,ARC.ismake,ARC.arcrank,ARC.click,ARC.title,ARC.shorttitle,ARC.color,ARC.writer,ARC.source,ARC.litpic,ARC.pubdate,ARC.senddate,ARC.mtype,ARC.description,ARC.badpost,ARC.goodpost,ARC.scores,ARC.lastpost,ARC.keywords,ARC.mid,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id > ( SELECT maxaid FROM dede_sphinx WHERE countid=1 )
#从SQL读取到的值必须为整数
sql_query_post = REPLACE INTO dede_sphinx SELECT 1, MAX(id) FROM dede_archives
sql_attr_uint = typeid
sql_attr_uint = typeid2
sql_attr_uint = channel
sql_attr_uint = click
sql_attr_uint = badpost
sql_attr_uint = goodpost
sql_attr_uint = scores
sql_attr_uint = mid
sql_attr_timestamp = pubdate #从SQL读取到的值必须为整数,作为时间属性
sql_attr_timestamp = senddate
sql_attr_timestamp = lastpost
sql_query_info = SELECT ARC.*,ART.body FROM dede_archives AS ARC LEFT JOIN dede_addonarticle AS ART ON ARC.id = ART.aid WHERE ARC.id=$id
}
index mysql
{
source = mysql #对应的source名称
path = D:/coreseek-3.2.13-win32/var/data/mysql
docinfo = extern
mlock = 0
morphology = none
min_word_len = 1
html_strip = 0
#charset_dictpath = /usr/local/mmseg3/etc/ #BSD、Linux环境下设置,/符号结尾
charset_dictpath = D:/coreseek-3.2.13-win32/etc/ #Windows环境下设置,/符号结尾
charset_type = zh_cn.gbk
}
{
min_word_len = 1
source = delta
path = D:/coreseek-3.2.13-win32/var/data/delta.new
}
indexer
{
mem_limit = 128M
}
searchd
{
listen = 9312
read_timeout = 5
max_children = 30
max_matches = 1000
seamless_rotate = 0
preopen_indexes = 0
unlink_old = 1
pid_file = D:/coreseek-3.2.13-win32/var/log/searchd_mysql.pid
log = D:/coreseek-3.2.13-win32/var/log/searchd_mysql.log
query_log = D:/coreseek-3.2.13-win32/var/log/query_mysql.log
}
配置完成后,我们要先建立索引,在开始菜单中打开[运行],输入"cmd",确认后打开命令行.输入下列代码:
indexer.exe -c D:\coreseek-3.2.13-win32\etc\csft_dedecmsv57.conf delta --rotate
建立完索引之后我们来检测下是否能够正常搜索到匹配内容,可以继续在cmd中输入下列命令:
2.1.开启sphinx服务
在上面的步骤中我们已经成功生成了索引,接下来为了能够使用客户端调用则需要开启sphinx服务.
可以直接在cmd中执行:
searchd.exe -c D:\coreseek-3.2.13-win32\etc\csft_dedecmsv57.conf
这样我们就开启了sphinx服务(如图3),我们可以写一个简单的例子进行测试:
--------------------------------------------------------------------------------------------------------
<?php
set_time_limit(0);
require_once (dirname(__FILE__) . "/include/common.inc.php");
$sphinx = new SphinxClient;
$host = "localhost"; //服务ip
$port = 9312; //服务端口
$sphinx->SetServer($host, $port);
$sphinx->SetArrayResult(true);
$sphinx->SetMatchMode($mode);
//var_dump($res);
$total = count($res['matches']);
for($i=0; $i < $total; $i++)
{
var_dump($res['matches'][$i]);
}
执行sphinx_test.php,可以看到已经能够正常通信,并且返回了内容.
上面我们通过searchd.exe开启了服务,但不好的是,我们关闭了cmd窗口就不能继续访问了,解决办法如下:
同样切换到bin目录下,执行:
这样就在系统中成功创建了一个DedeSphinx服务,无需再打开窗口(如图5).
对于全文检索的索引,我们是需要不定期生成的,如果是数据量比较小,直接使用上述生成索引的命令重建就可以,如果数据量比较大,我们则需要定义的更新全文索引.
发表评论
-
CentOS7内核优化参数
2015-01-20 15:14 12220参考:http://www.centoscn.com/Cen ... -
CentOS下安装VNCSERVER
2014-05-27 23:59 10691、检查安装包: rpm -q vnc vnc-serve ... -
[转]scp 命令
2014-04-10 09:44 847scp 可以在 2个 linux 主机间复制文件; 命令基 ... -
Apache添加多用户虚拟主机管理模块
2013-01-04 22:30 0wget http://mpm-itk.sesse.net/a ... -
Linux服务器安装札记
2012-10-18 00:39 0所有配置是基于 CentOS 6.2上: 1、查看DN ... -
Nginx在Linux中系统服务配置脚本
2012-09-29 00:56 9031以下代码是在前人的基础上,结合自己服务器实际情况修改的,本人服 ... -
Windows及Linux下的虚拟主机Web管理软件
2012-09-28 21:38 2248Windows平台:Parallels、Zkeys(宏杰虚拟主 ... -
【转】Nginx——防止webshell跨目录
2012-03-19 22:50 1919原文地址: http://www.itdhz.com/post ... -
Linux权限位)(S位)
2012-03-07 21:50 28039一、UNIX下关于文件权限的表示方法和解析 UN ... -
apache htpasswd命令用法
2012-02-17 21:05 0apache htpasswd命令用法介 ... -
在Centos中yum安装和卸载软件的使用方法
2012-02-17 21:04 1076在Centos中yum安装和卸载软件的使用方法安装方法安 ... -
RPM 安装与卸载命令
2012-02-17 20:44 1215RPM(Red Hat Package Manager) ... -
Suse 10 下NFS的配置
2011-05-15 21:01 3113服务端的配置:1、编辑 ... -
crontab 文件条目格式
2011-05-06 10:00 1317一个 crontab 文件包含每个 cron 作业的条目。条目 ... -
基于PHP的搜索引擎Sphinx安装步骤
2011-03-01 14:52 1689系统要求: 1.Windows XP或以上,或者是Linu ... -
在Linux系统中如何禁用用户帐号
2010-11-02 17:16 2731通过以下方法来禁用linux用户账户 方法1: ... -
国内Oracle下载镜像
2010-09-14 16:08 5832这里有很多,如果国外网速慢的话,可以考虑: http: ... -
Linux下修改系统时间
2010-06-21 10:58 1045两步(1)date 062111032010 也可以用 dat ... -
使用google-perftools中的TCMalloc库,提高Mysql在大规模高并发下性能
2010-06-05 15:27 0安装google-perftools:wget http:// ... -
chkconfig 命令详解
2010-06-05 00:45 2037chkconfig命令主要用来更新(启动或停止)和查询系统 ...
相关推荐
Sphinx是一个高性能、开源的全文检索引擎,专为配合SQL数据库而设计,如MySQL和PostgreSQL,用于实现高效且专业的全文搜索功能。它的核心优势在于能够提供比数据库原生搜索更强大的搜索性能,并且易于集成到各种使用...
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
【基于Sphinx+MySQL的千万级数据全文检索】的架构设计着重解决大数据量下的高效全文检索问题。Sphinx是一款源自俄罗斯的开源全文搜索引擎,它在处理海量数据时表现出极高的性能和可扩展性。在DELL PowerEdge 6850...
Sphinx是一款开源的全文搜索引擎,特别适用于需要高效、精确全文搜索功能的应用程序。它由俄罗斯开发者Andrew ...对于那些需要深入理解全文检索原理和优化搜索性能的IT从业者来说,学习Sphinx无疑是一个有价值的方向。
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
《Coreseek 全文检索服务器 2.0 (Sphinx 0.9.8)参考手册》详述了Coreseek全文检索服务器的核心功能、安装配置、索引建立、搜索机制以及API接口等内容,旨在帮助用户深入理解和高效使用该服务器。 1. **简介** - **...
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
对于"archive_ Sphinx全文检索引擎 for Mac v3.3.1 [江西新余电信].zip.zip"这个压缩包,用户需要先将其解压缩,然后按照提供的说明文件进行操作。 在文件列表中,"output.txt"可能是Sphinx的配置或日志文件,用于...
sphinx全文检索引擎
【Python-ABlog:Sphinx全文检索引擎的扩展】 ABlog是Python开发中的一款强大工具,专门为Sphinx文档系统提供博客功能的扩展。Sphinx是一款广泛使用的文档生成器,尤其在编写技术文档时表现优秀。而ABlog则进一步...
在这个压缩包“archive_ Sphinx全文检索引擎 for Linux v3.3.1 [江西新余电信].zip.zip”中,包含了Sphinx在Linux环境下的版本3.3.1。这个版本可能包含了源代码、编译脚本、配置文件、文档以及可能的示例,帮助用户...
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
Sphinx与SQL结合使用,可以显著提升大数据量下的检索效率,尤其适用于需要高效搜索的Web应用和信息检索系统。 1. **Sphinx简介** Sphinx是一个独立的搜索引擎,它设计用于快速、准确地提供信息检索服务。Sphinx...
【标题】"PHP实例开发源码—Sphinx全文检索引擎php版 for Windows"是一个针对Windows平台的PHP开发实例,它整合了Sphinx全文搜索引擎,旨在帮助开发者理解和运用Sphinx进行PHP项目的全文检索功能构建。 【Sphinx...
Sphinx是一个基于SQL的全文检索引擎,可以结合MySQL,PostgreSQL做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。Sphinx特别为一些脚本语言设计搜索API接口,如PHP,...
51CTO技术沙龙第19期讲义:Sphinx 全文检索实践指南主讲:李沫南部分主要内容:全文检索 VS 数据库检索SELECT * FROM documents WHERE title like '%test%'CPU 100%'30秒内只能进行一次查询'没有找到记录......