日本データベース学会の皆様 (複数のMLにお送りしております.重複して受け取られた際にはどうかご容赦ください) [Apologize for multiple copies] 理化学研究所AIPの関根です。 Call for participants of SHINRA 2022. This is a shared task which uses datasets of Japanese language only. Please join us if interested. 森羅プロジェクトの2022年のタスク開催予定についてお知らせいたします。 2022年はこれまでの森羅プロジェクトのタスクを統合したEnd-to-Endタスクを開催し、参加者を募集します。また、End-to-Endタスクの各ステップに対応するサブタスクも開催し、サブタスクのみの参加者も歓迎いたします。 森羅2022ホームページ:http://shinra-project.info/shinra2022/ 森羅プロジェクトホームページ:http://shinra-project.info/ 本メールの最後にメーリングリストやslackの情報がありますので、是非ご登録 下さいますよう、お願いいたします。 また、言語処理学会年次大会における森羅プロジェクト関連の発表で、 森羅2022のタスクについてもご紹介しますので、是非ご参加下さい。 3月15日(火) 11:00-12:20(E1:言語資源・アノテーション(1) ) [E1-1] 拡張固有表現に分類された31言語のWikipedia知識ベース 発表者:関根聡(理研) 3月15日(火) 13:20-15:00 (E2:言語資源・アノテーション(2)) [E2-4] 森羅 2021-LinkJP 結果の分析:BERT とルールベースの比較 発表者:野本昌子(理研) 皆様のご参加を心からお待ちしております。 ------------------------------------------------------------------------------------------------- 森羅2022開催予定のお知らせ 日本語構造化タスクは森羅プロジェクトで2018年から実施している日本語Wikipediaを対象とした情報抽出タスクです。4回目となる森羅2022ではこれまでの森羅プロジェクトのタスクを統合したEnd-to-Endタスクを開催し、参加者を募集します。 End-to-Endタスクでは、以下の3つのステップを一気に実施することで、分類、属性抽出、リンクの複合タスクを実現し、相乗効果/End-to-Endで精度向上の可能性を探ります。 STEP1: Wikipedia記事ページを約220種類のカテゴリに分類(例:「人名」) STEP2: 分類済ページのテキストからカテゴリ毎に定めた属性情報を抽出 (例:「人名」カテゴリに分類されたページからは対象の人の「所属 組織」等の情報を抽出) STEP3: 抽出した属性の値を対応するWikipediaページにリンク (例:属性「所属組織」の値「日本代表」をWikipediaの「サッカー 日本代表」ページにリンク) また、各STEPに対応する、分類タスク、属性抽出タスク、リンクタスクの3つのサブタスクも実施します。サブタスクのみの参加も歓迎いたします。 ・過去の森羅プロジェクトの参加システムの実行結果を利用可能 ・リーダーボードのみ参加も可能 *スケジュール 森羅2022 キックオフミーティング&データ公開: 2022年4月下旬~5月中旬 リーダーボードオープン: 2022年5月中旬(予定) 実行結果の提出締切: 2022年10月末日(予定) 評価結果の返却: 2022年11月中旬 最終報告会: 2022年12月 *コミュニティ/連絡先 森羅2022タスク Email:(実行委員宛): shinra2022-info (at) googlegroups.com (コミュニティ): shinra2022-all (at) googlegroups.com Slack: http://shinra2022.slack.com [参加リンク] (代理投稿:渋木@BESNA研究所)