Java开源 全文检索

LIUS

LIUS LIUS是一个基于Jakarta Lucene项目的索引框架。LIUS为Lucene添加了对许多文件格式的进行索引功能如:Ms Word,Ms Excel,Ms PowerPoint,RTF,PDF,XML,HTML,TXT,Open Office序列和JavaBeans。针对JavaBeans的索引特别有用当我们要对数据库进行索引或刚好用户使用持久层O

查看次数(38)| 详细内容

Red-Piranha

Red-Piranha Red-Piranha是一个开源搜索系统,它能够真正"学习"你所要查找的是什么.Red-Piranha可作为你桌面系统(Windows,Linux与Mac)的个人搜索引擎,或企业内部网搜索引擎,或为你的网站提供搜索功能,或作为一个P2P搜索引擎,或与wiki结合作为一个知识/文档管理解决方案,或搜索你要的RSS聚合信息,或搜索你公司的系统(

查看次数(31)| 详细内容

Oxyus

Oxyus 是一个纯java写的web搜索引擎。  http://oxyus.sourceforge.net/

查看次数(30)| 详细内容

YaCy

YaCy YaCy基于p2p的分布式Web搜索引擎.同时也是一个Http缓存代理服务器.这个项目是构建基于p2p Web索引网络的一个新方法.它可以搜索你自己的或全局的索引,也可以Crawl自己的网页或启动分布式Crawling等.

查看次数(29)| 详细内容

Aperture

Aperture Aperture这个Java框架能够从各种各样的资料系统(如:文件系统、Web站点、IMAP和Outlook邮箱)或存在这些系统中的文件(如:文档、图片)爬取和搜索其中的全文本内容与元数据。它当前支持的文件格式如下: Plain text HTML, XHTML XML PDF (Portable Document Format)

查看次数(26)| 详细内容

Nutch

Nutch Nutch 是一个刚刚诞生开放源代码(open-source)的web搜索引擎。在它的主页有中文详细的说明。  http://nutch.sourcef

查看次数(26)| 详细内容

Zilverline

Zilverline Zilverline是一个搜索引擎,它通过web方式搜索本地硬盘或intranet上的内容。Zilverline可以从PDF, Word, Excel, Powerpoint, RTF, txt, java, CHM,zip, rar等文档中抓取它们的内容来建立摘要和索引。从本地硬盘或intranet中查找到的结果可重新再进行检索。Zilve

查看次数(25)| 详细内容

JXTA Search

JXTA Search JXTA Search是一个分布式的搜索系统.设计用在点对点的网络与网站上.  http://search.jxta.org/

查看次数(23)| 详细内容

XQEngine

XQEngine XQEngine用于XML文档的全文本搜索引擎.利用XQuery做为它的前端查询语言.它能够让你查询XML文档集合通过使用关键字的逻辑组合.有点类似于Google与其它搜索引擎搜索HTML文档一样.XQEngine只是一个用Java开发的很紧凑的可嵌入的组件.

查看次数(21)| 详细内容

BDDBot

BDDBot BDDBot是一个简单的易于理解和使用的搜索引擎。它目前在一个文本文件(urls.txt)列出的URL中爬行,将结果保存在一个数据库中。它也支持一个简单的Web服务器,这个服务器接受来自浏览器的查询并返回响应结果。它可以方便地集成到你的Web站点中。

查看次数(21)| 详细内容
全文检索 fullsearch 开源全文检索 javasearch
[1] [2] 下一页>> 

Powered by Jcms1.0 | Theme by 皖ICP备08002322号