メーリングリストの皆様 CODH/国立情報学研究所 北本と申します。 機械学習用データセットとして、日本の古典籍から抽出した大規模くずし字字形 データセット(3,999文字種、403,242文字)をこのたび公開しましたので、お知 らせいたします。オープンデータライセンスですので、どなたでもご自由にお使 いいただけます。 --------------------- 日本古典籍字形データセット http://codh.rois.ac.jp/char-shape/ --------------------- このデータセットは「くずし字解読の自動化」というグランドチャレンジの解決 に資するものです。埋もれている日本の過去の文化を掘り起こすための技術的な 挑戦として、ぜひチャレンジしてみて下さい。 また、データセットに関連して、人文学画像+言語データ解析を担う特任研究員 を募集中です。 --------------------- 特任研究員募集(締切 6月30日) http://codh.rois.ac.jp/recruit/ --------------------- また、データセットを用いたアルゴリズムコンテストも現在開催中です。 --------------------- 第21回 PRMUアルゴリズムコンテスト(締切 8月31日) https://sites.google.com/view/alcon2017prmu --------------------- これらにも皆様の積極的なご応募をお待ちしております。 よろしくお願いいたします。 -- 北本 朝展 (KITAMOTO Asanobu) 国立情報学研究所 コンテンツ科学研究系 情報・システム研究機構 人文学オープンデータ共同利用センター http://agora.ex.nii.ac.jp/~kitamoto/