From: Miles Keaton Date: 2005-10-23T07:25:55+09:00 Subject: Re: [ANN] Ferret 0.1.0 (Port of Java Lucene) released one correction:RegExpTokenizer should be RETokenizer(at least in the version you've released publicly) > require 'rubygems'> require 'ferret'> include Ferret>> class ChineseAnalyzer> def token_stream(field, string)> tokenizer = Analysis::RegExpTokenizer.new(string)> class < def token_re() /./ end> end> return tokenizer> end> end>> docs = ["������", "������������", "����������������", "����������������"]> index = Index::Index.new(:analyzer => ChineseAnalyzer.new)> docs.each { |doc| index << doc }> puts index[3][""]> tq = Search::TermQuery.new(Index::Term.new("", "��"))> index.search_each(tq) do |doc, score|> puts "Document #{doc} found with score #{score}"> end> index.close