『みんなのマレー語辞典』(マレー語:Kamus Melayu-Jepun Kita)は2018年からほぼ月1で開催しているマレー語勉強会のメンバーの協力のもと作っているオープンなマレー語・日本語辞典です。
例文はほどんどがLeipzig Corpora Collection (Goldhahn et al. 2012)のマレー語サブコーパス、Asian Language Treebank (Riza et al. 2016)、TUFS Asian Language Parallel Corpus (TULPCo) (Nomoto et al. 2018) から採った文やそれを改変(簡略化)した文ですが、一部その他のウェブデータから採った文もあります。
このレポジトリのすべてのファイルは、Creative Commons Attribution 4.0 International(CC-BY 4.0)の下で提供されています。適切なクレジット(著者名・作品名・ライセンス)を付した上で、営利・非営利を問わず、自由に利用・改変・再配布が可能です。
野元裕樹(監修). 2025. 『みんなのマレー語辞典』. https://github.com/matbahasa/KamusKita/.
野元裕樹(東京外国語大学)
- 飯島葉月/Hazuki Iijima
- 上宮かれん/Karen Uemiya
- 内田美那/Mina Uchida
- 大沼千秋/Chiaki Onuma
- S. Ogawara
- 柏美紀/Miki Kashiwa
- 高橋はな/Hana Takahashi
- 田村陽太/Yota Tamura
- 都築佑樹/Yuki Tsuzuki
- 西依勇輝/Yuki Nishiyori
- 野間口百合/Yuri Nomaguchi
- 野元裕樹/Hiroki Nomoto
- 由井彩花/Ayaka Yui
kamus.xml: 辞書ファイル本体。index.html: ブラウザで閲覧可能な辞書。kamus_style.xsl: 辞書ファイルkamus.xmlをhtml形式に変換することを目的としたスタイルシート。xml2html.py: 辞書ファイルkamus.xmlをスタイルシートkamus_style.xslに基づいてhtmlファイルに変換するPythonスクリプト。index.htmlが出力結果。
人文学におけるテキストの構造的マークアップの国際標準であるTEI (Text Encoding Initiative)のガイドラインに準拠しています。一般的なマレー語辞書と同様に語根を最上位の見出し(entry)とし、その下にその具体的な語形が下位エントリーとして列挙される形になっています。後者の<entry>の属性xml:idの値はマレー語・インドネシア語形態情報辞書MALINDO MorphのIDと同じものです。
<entry type="root">
<!-- 同綴り語の場合は上位entryを設け、n="1" subtype="hom"を追加 -->
<!-- 語根 -->
<form>
<orth>語根正書法</orth>
<pron>語根発音</pron>
</form>
<xr type="cf">
<ref target="#ID">参照先の見出し</ref>
</xr>
<xr type="abbr">
<ref target="#ID">完全形</ref><lbl>の短縮形</lbl>
</xr>
<xr type="var">
<ref target="#ID">標準形</ref><lbl>の異形</lbl>
</xr>
<!-- 語形 -->
<entry xml:id="ID" resp="担当者">
<form>語形</form>
<usg type="register">文体(「口語]など)</usg>
<xr type="formal">
<ref target="ID">参照先の見出し</ref><lbl>の口語形</lbl>
</xr>
<!-- 品詞 -->
<gramGrp>
<pos>品詞</pos>
</gramGrp>
<usg type="register">文体(「口語]など)</usg>
<xr type="formal">
<ref target="ID">参照先の見出し</ref><lbl>の口語形</lbl>
</xr>
<sense n="1">
<usg type="time">時代(「古」など)</usg>
<usg type="gram">用法</usg>
<def>意味</def>
<cit type="example">
<quote>例文(<emph>当該語形</emph>)</quote>
<cit type="translation">
<quote>例文日本語訳</quote>
</cit>
</cit>
</sense>
<!-- 熟語 -->
<re>
<entry>
<form>熟語</form>
<sense>
<usg type="gram">用法</usg>
<def>意味</def>
<cit type="example">
<quote>例文(<emph>当該語形</emph>)</quote>
<cit type="translation">
<quote>例文日本語訳</quote>
</cit>
</cit>
</sense>
</entry>
</re>
</entry>
</entry>- Goldhahn, Dirk, Thomas Eckart and Uwe Quasthoff. 2012. Building large monolingual dictionaries at the Leipzig Corpora Collection: From 100 to 200 languages. In Proceedings of the Eighth International Conference on Language Resources and Evaluation (LREC'12), 759-765. Istanbul: European Language Resources Association.
- Nomoto, Hiroki, Kenji Okano, David Moeljadi and Hideo Sawada. 2018. TUFS Asian Language Parallel Corpus (TALPCo). In Proceedings of the Twenty-Fourth Annual Meeting of the Association for Natural Language Processing, 436-439.
- Riza, Hammam, Michael Purwoadi, Gunarso, Teduh Uliniansyah, Aw Ai Ti, Sharifah Mahani Aljunied, Luong Chi Mai, Vu Tat Thang, Nguyen Phuong Thai, Vichet Chea, Rapid Sun, Sethserey Sam, Sopheap Seng, Khin Mar Soe, Khin Thandar Nwet, Masao Utiyama and Chenchen Ding. 2016. Introduction of the Asian Language Treebank. In 2016 Conference of the Oriental Chapter of International Committee for Coordination and Standardization of Speech Databases and Assessment Techniques (O-COCOSDA).