JSON data structure browser

Download full JSON mapping

Fields and tags index

The raw JSON data used to generate this site consists of individual JSON object for each separate word. The browser here is a union of all these objects combined into one, by recursively delving through each of them and adding newly found nodes in a parallel mapping.

{
"antonyms":
[
{
"sense": sense seen in menarik [Bahasa Indonesia]; reached 16 times,
"word": word seen in absent [Bahasa Inggris]; reached 42 times
}
]
"categories":
[categories seen in censor [Bahasa Inggris]; reached 142880 times]
"derived":
[
{
"raw_tags":
[raw_tags seen in 日本 [Bahasa Tionghoa]; reached 2 times]
"sense": sense seen in [Bahasa Jepang]; reached 228 times,
"word": word seen in tanaman [Bahasa Indonesia]; reached 3545 times
}
]
"etymology_texts":
[etymology_texts seen in edutainment [Bahasa Inggris]; reached 46 times]
"forms":
[
{
"form": form seen in matta [Bahasa Inggris]; reached 65570 times,
"raw_tags":
[raw_tags seen in ekabahasawan [Bahasa Indonesia]; reached 715 times]
"tags":
[tags seen in dibesutkan [Bahasa Indonesia]; reached 64128 times]
}
]
"hyphenations":
[
{
"parts":
[parts seen in pelajaran [Bahasa Indonesia]; reached 4 times]
}
]
"lang": lang seen in censor [Bahasa Inggris]; reached 54648 times,
"lang_code": lang_code seen in censor [Bahasa Inggris]; reached 54648 times,
"notes":
[notes seen in percuma [Bahasa Indonesia]; reached 81 times]
"pos": pos seen in censor [Bahasa Inggris]; reached 54648 times,
"pos_title": pos_title seen in censor [Bahasa Inggris]; reached 54648 times,
"proverbs":
[
{
"sense": sense seen in menghargai [Bahasa Indonesia]; reached 16 times,
"word": word seen in menghargai [Bahasa Indonesia]; reached 40 times
}
]
"related":
[
{
"raw_tags":
[raw_tags seen in 日本人 [Bahasa Tionghoa]; reached 4 times]
"sense": sense seen in [Bahasa Jepang]; reached 55 times,
"word": word seen in encyclopedia [Bahasa Inggris]; reached 345 times
}
]
"senses":
[
{
"categories":
[categories seen in momentum [Bahasa Inggris]; reached 32198 times]
"examples":
[
{
"bold_text_offsets":
[
[bold_text_offsets seen in romaji [Bahasa Inggris]; reached 1632 times]
]
"bold_translation_offsets":
[
[bold_translation_offsets seen in curve [Bahasa Inggris]; reached 3312 times]
]
"roman": roman seen in хорошо [Bahasa Rusia]; reached 2 times,
"text": text seen in romaji [Bahasa Inggris]; reached 14961 times,
"translation": translation seen in guarantee [Bahasa Inggris]; reached 1769 times
}
]
"form_of":
[
{
"word": word seen in videos [Bahasa Inggris]; reached 29466 times
}
]
"glosses":
[glosses seen in censor [Bahasa Inggris]; reached 82583 times]
"raw_tags":
[raw_tags seen in Barbenheimer [Bahasa Inggris]; reached 41 times]
"tags":
[tags seen in matta [Bahasa Inggris]; reached 32738 times]
"topics":
[topics seen in momentum [Bahasa Inggris]; reached 381 times]
}
]
"sounds":
[
{
"ipa": ipa seen in romaji [Bahasa Inggris]; reached 43 times,
"raw_tags":
[raw_tags seen in romaji [Bahasa Prancis]; reached 10 times]
"rhymes": rhymes seen in double [Bahasa Inggris]; reached 10 times
}
]
"synonyms":
[
{
"sense": sense seen in bersejingkat [Bahasa Indonesia]; reached 58 times,
"word": word seen in double [Bahasa Inggris]; reached 162 times
}
]
"tags":
[tags seen in how many [Bahasa Inggris]; reached 454 times]
"translations":
[
{
"lang": lang seen in romaji [Bahasa Inggris]; reached 298 times,
"lang_code": lang_code seen in romaji [Bahasa Inggris]; reached 298 times,
"raw_tags":
[raw_tags seen in romaji [Bahasa Inggris]; reached 5 times]
"roman": roman seen in romaji [Bahasa Inggris]; reached 88 times,
"sense": sense seen in romaji [Bahasa Inggris]; reached 219 times,
"tags":
[tags seen in romaji [Bahasa Inggris]; reached 82 times]
"word": word seen in romaji [Bahasa Inggris]; reached 298 times
}
]
"word": word seen in censor [Bahasa Inggris]; reached 54648 times
}

This page is a part of the kaikki.org machine-readable dictionary. This dictionary is based on structured data extracted on 2026-08-12 from the idwiktionary dump dated 2026-08-04 using wiktextract (be32728 and 4deed51). The data shown on this site has been post-processed and various details (e.g., extra categories) removed, some information disambiguated, and additional data merged from other sources. See the raw data download page for the unprocessed wiktextract data.

If you use this data in academic research, please cite Tatu Ylonen: Wiktextract: Wiktionary as Machine-Readable Structured Data, Proceedings of the 13th Conference on Language Resources and Evaluation (LREC), pp. 1317-1325, Marseille, 20-25 June 2022. Linking to the relevant page(s) under https://kaikki.org would also be greatly appreciated.