JSON data structure browser

Download full JSON mapping

Fields and tags index

The raw JSON data used to generate this site consists of individual JSON object for each separate word. The browser here is a union of all these objects combined into one, by recursively delving through each of them and adding newly found nodes in a parallel mapping.

{
"antonyms":
[
{
"raw_tags":
[raw_tags seen in otevřený [čeština]; reached 231 times]
"sense_index": sense_index seen in lehčí [čeština]; reached 21745 times,
"tags":
[tags seen in zásuvka [čeština]; reached 295 times]
"word": word seen in lehčí [čeština]; reached 22103 times
}
]
"categories":
[categories seen in stvrď [čeština]; reached 321147 times]
"derived":
[
{
"word": word seen in 喜ぶ [japonština]; reached 205 times
}
]
"etymology_texts":
[etymology_texts seen in člověkohodina [čeština]; reached 32090 times]
"forms":
[
{
"form": form seen in laňka [čeština]; reached 1628237 times,
"raw_tags":
[raw_tags seen in domažlický [čeština]; reached 443303 times]
"roman": roman seen in 痩せる [japonština]; reached 411 times,
"tags":
[tags seen in laňka [čeština]; reached 4928599 times]
}
]
"hyphenations":
[
{
"parts":
[parts seen in laňka [čeština]; reached 223116 times]
}
]
"lang": lang seen in laňka [čeština]; reached 194142 times,
"lang_code": lang_code seen in laňka [čeština]; reached 194142 times,
"note": note seen in aklatan [tagalog]; reached 21 times,
"phrases":
[
{
"word": word seen in píše [čeština]; reached 10 times
}
]
"pos": pos seen in laňka [čeština]; reached 194142 times,
"pos_title": pos_title seen in laňka [čeština]; reached 194142 times,
"proverbs":
[
{
"sense_index": sense_index seen in šplouchat [čeština]; reached 5 times,
"word": word seen in kárat [čeština]; reached 1594 times
}
]
"raw_tags":
[raw_tags seen in pětiletého [čeština]; reached 62988 times]
"related":
[
{
"raw_tags":
[raw_tags seen in vztahovačný [čeština]; reached 13 times]
"sense_index": sense_index seen in rozdat si to [čeština]; reached 781 times,
"tags":
[tags seen in bachor [čeština]; reached 41 times]
"word": word seen in stvrď [čeština]; reached 270455 times
}
]
"senses":
[
{
"categories":
[categories seen in laňka [čeština]; reached 32791 times]
"examples":
[
{
"bold_text_offsets":
[
[bold_text_offsets seen in barbína [čeština]; reached 46306 times]
]
"ref": ref seen in laňka [čeština]; reached 31466 times,
"text": text seen in laňka [čeština]; reached 56705 times,
"translation": translation seen in velikán [čeština]; reached 10974 times
}
]
"form_of":
[
{
"word": word seen in pětiletého [čeština]; reached 92887 times
}
]
"glosses":
[glosses seen in laňka [čeština]; reached 289630 times]
"raw_tags":
[raw_tags seen in zámyčka [čeština]; reached 8864 times]
"tags":
[tags seen in laňka [čeština]; reached 114713 times]
"topics":
[topics seen in couéismus [čeština]; reached 15002 times]
}
]
"sounds":
[
{
"audio": audio seen in prvek [čeština]; reached 40706 times,
"flac_url": flac_url seen in rain fire and brimstone [angličtina]; reached 14 times,
"homophone": homophone seen in připravili [čeština]; reached 27258 times,
"ipa": ipa seen in laňka [čeština]; reached 166159 times,
"mp3_url": mp3_url seen in prvek [čeština]; reached 40706 times,
"oga_url": oga_url seen in aspik [čeština]; reached 226 times,
"ogg_url": ogg_url seen in prvek [čeština]; reached 40481 times,
"opus_url": opus_url seen in Athens [angličtina]; reached 5 times,
"other": other seen in замечание [ruština]; reached 899 times,
"raw_tags":
[raw_tags seen in deštník [čeština]; reached 5108 times]
"tags":
[tags seen in my [čeština]; reached 918 times]
"wav_url": wav_url seen in vlakový [čeština]; reached 3404 times,
"zh_pron": zh_pron seen in 翻譯者 [čínština]; reached 668 times
}
]
"synonyms":
[
{
"raw_tags":
[raw_tags seen in nakládání [čeština]; reached 4469 times]
"sense_index": sense_index seen in barbína [čeština]; reached 109291 times,
"tags":
[tags seen in barbína [čeština]; reached 9939 times]
"word": word seen in barbína [čeština]; reached 111103 times
}
]
"tags":
[tags seen in laňka [čeština]; reached 132970 times]
"translations":
[
{
"lang": lang seen in člověkohodina [čeština]; reached 236651 times,
"lang_code": lang_code seen in člověkohodina [čeština]; reached 236651 times,
"raw_tags":
[raw_tags seen in premiéra [čeština]; reached 1323 times]
"sense": sense seen in člověkohodina [čeština]; reached 207357 times,
"sense_index": sense_index seen in člověkohodina [čeština]; reached 236651 times,
"tags":
[tags seen in člověkohodina [čeština]; reached 93894 times]
"word": word seen in člověkohodina [čeština]; reached 236651 times
}
]
"word": word seen in laňka [čeština]; reached 194142 times
}

This page is a part of the kaikki.org machine-readable dictionary. This dictionary is based on structured data extracted on 2026-07-25 from the cswiktionary dump dated 2026-07-03 using wiktextract (d9fa233 and 9e92f4b). The data shown on this site has been post-processed and various details (e.g., extra categories) removed, some information disambiguated, and additional data merged from other sources. See the raw data download page for the unprocessed wiktextract data.

If you use this data in academic research, please cite Tatu Ylonen: Wiktextract: Wiktionary as Machine-Readable Structured Data, Proceedings of the 13th Conference on Language Resources and Evaluation (LREC), pp. 1317-1325, Marseille, 20-25 June 2022. Linking to the relevant page(s) under https://kaikki.org would also be greatly appreciated.