A Study of Design for Intellingent Web Syllabus Crawling Agent
信太郎 山田, Shintaro Yamada, 吉広 松永, Yoshihiro Matsunaga, 栄典 伊東, Eisuke Ito, 佐千男 廣川, Sachio Hirokawa · Transactions of the Institute of Electronics, Information and Communication Engineers · 2003
情報技術の発達と情報通信基盤の普及に伴い,膨大 な情報が電子化され情報ネットワーク,特にWeb を 介して公開され容易に利用できるようになった.それ らは各組織,個人が個別に作成したものであり,関連 する内容であっても様々な形式で記述され,系統的な 利用は困難である.人類の知識の宝庫とも呼べるWeb から,体系的に,あるいは特定の目的にあった情報を 収集・分類することは今後の情報社会において最も重 要な課題といえる.実際,HTML を代表とする半構 造化データから知識を抽出する研究 [3], [15], [16], [19] や,特定のテーマに関する情報を収集する研究 [14]が 行なわれている.また,Webデータを自動収集するク ローラーについても,目的に合致したページだけを効 率よく収集する研究がある [1], [2]. 特定の対象につい て体系的にページ群を収集し,その中から必要とする