日記(802)

<前 次>

無題

k-meansについて大体分かってきた感じ。
JavaScriptで実装してみました。
今のところ公開の予定はないですが。

無題

アンパンマンDBのコメントフォームを微修正してました。
管理上の都合だけなのでユーザーからは特に変わったところはありません。

無題

アンパンマンDB用のよみがな生成関数を作ってました。
ほぼひらがなとカタカナだけの変換ですが、入力作業がかなり楽になるものと思います。

例:ロールパンナとハンバーガーキッド→ろおるはんなとはんはあかあきつと

人に読ませるのではなくソートに使うだけなので、濁点などは取り除かれます。

へぶわーーーっ!!

オプーナやってました。
とある湖の底である爺さんと戦いました。
久々に燃えるボス戦!
爺さん本人は気付かない間にお隠れになったのですが、後衛のデカブツ2体が強い!
なにしろHPだけで言えば合計でサラマンダーを上回るし、攻撃力もなかなかのもの。
この場所に来る前に戦った別のボスが意外とあっさりプッチンと潰れてしまっていたので、ますます強く感じました。
そしていよいよラスボスと思われる方から湖の底まで届く大きな声でラストダンジョンにご招待されました。
その後仲間も増えたことだしと思ってサラマンダーと戦いに行ったらサラマンダーも仲間が増えてて返り討ちにあったんですけどね。

ナマライザ、docomoの検索ワードを拾えるようになったので公開しました。
ついでにURLデコードの時にエラー回避した方法の応用で検索ワード抽出全般を高速化できました。

無題

ナマライザ、読み込みながらURLデコードというのはしんどいので、とりあえず表示だけURLデコードに対応させてみました。
あと、docomoの検索ワードを拾えるようにしたいので、そちらに対応したら公開しようと思います。
検索ワードについては、いずれ検索ワードの解析方法をユーザー定義できるようにしたいと思っています。

無題

アクセス解析していたら、アンパンマン質問箱でAND検索を試みた形跡があったので、ちゃちゃっと実装してみました。
ところで、予定ページには既に書いていたのですが、正規表現検索というのを考えています。
例えば、「(苦|((ニ|に)(ガ|が)))(瓜|((ウ|う)(リ|り)))(マ|ま)(ン|ん)」という正規表現を作れば「ニガウリマン」でも「苦ウリまん」でも「にガ瓜まン」でもマッチさせることができるのです。
ただ問題は、ユーザーは普通正規表現を使わないこと、データベースに登録できるのは私の思いついたパターンのみであるということ。
つまり、ユーザーが正規表現で検索することはないと考えたほうが良いのです。
だから逆に正規表現のほうをこちらで用意してやると、ユーザーから来る予想外の表記ゆれにも柔軟に対応できるというわけです。
ところがこちらにも問題がありまして、部分一致ができないんです。
先ほどのニガウリマンの例でいけば、「ニガウリ」で検索すると、正規表現後半の「(マ|ま)(ン|ん)」の部分にマッチしないのでニガウリマンが見つけられないのです。
このあたりさえ解決できれば非常に便利になるはずなのですが…。
ちなみにこれをやると検索性確保のための表記ゆれの入力が不必要になるので、別名の項目自体を抹消するかもしれません。

<前 次>