Number of results to display per page
Search Results
182. Bedřich Hrozný: texty a přednášky :
- Type:
- text, biografie, studie, and přednášky
- Subject:
- Filologie, Biografie, Hrozný, Bedřich,, orientalisté, orientalistika, cesty výzkumné, české země 1848-1918, Československo 1918-1992, and dějiny věd o neslovanských oblastech
- Language:
- Czech
- Description:
- Bedřich Hrozný: Texts and Lectures. Archaeological expeditions and linguistic discoveries od a leading czech orientalist.
- Rights:
- unknown
183. Bedřich Smetana :
- Creator:
- Smetana, Bedřich,
- Type:
- text, deníky, and edice
- Subject:
- Hudebníci, skladatelé a jiná hudební povolání, Smetana, Bedřich,, skladatelé, hudba, život hudební, české země 1792-1847, and hudba, tanec, hudební nástroje
- Language:
- Czech, English, and German
- Rights:
- unknown
184. Bedřichov :
- Creator:
- Dařbujanová, Anna,
- Type:
- text, statický obraz, monografie, and publikace fotografické
- Subject:
- Vlastivěda Česka a Slovenska, obce, dějiny obcí, přehledná zpracování dějin českých zemí (chronologicky), and města, obce
- Language:
- Czech
- Description:
- Chronologický přehled
- Rights:
- unknown
185. Bekyně a kazatelé :
- Creator:
- Grollová, Jana,
- Type:
- text and monografie
- Subject:
- Křesťanská sdružení, spolky a organizace. Řeholní řády, beghardi, bekyně, ženy, spiritualita křesťanská, homiletika, kazatelé, přehledná zpracování světových dějin (chronologicky), české země 1306-1526, and církevní řády a kongregace, náboženská bratrstva, kláštery
- Language:
- Czech
- Rights:
- unknown
186. Bělá pod Pradědem 60 let, Adolfovice a Domašov 740 let /
- Creator:
- Kaňáková, Božena
- Type:
- text and publikace jubilejní
- Subject:
- Dějiny Česka a Slovenska, obce, dějiny obcí, přehledná zpracování dějin českých zemí (chronologicky), and města, obce
- Language:
- Czech
- Description:
- Terminologický slovník and Obálkový název: Bělá pod Pradědem 60 let & Adolfovice a Domašov 740 let
- Rights:
- unknown
187. Bellum 1866 :
- Type:
- text and časopisy
- Subject:
- Vojenství. Obrana země. Ozbrojené síly, časopisy odborné, válka prusko-rakouská (1866), and česká periodika
- Language:
- Czech
- Rights:
- unknown
188. Benedikt XVI. :
- Creator:
- Seewald, Peter,
- Type:
- text, rozhovory, and vzpomínky
- Subject:
- Biografie, Křesťanské církve, sekty, denominace, Benedikt, papeži, papežství, dějiny církevní, světové dějiny od r. 1918 do současnosti, papežství, církevní politika, Německo, and Vatikán
- Language:
- Slovak
- Rights:
- unknown
189. Benešov nad Ploučnicí :
- Creator:
- Šimková, Táňa
- Type:
- text and brožury
- Subject:
- Architektura, kostely, Narození Panny Marie (patrocinium), architektura sakrální, mobiliáře, přehledná zpracování dějin českých zemí (chronologicky), and církevní architektura, hmotné památky, hřbitovy a poutní místa
- Language:
- Czech
- Rights:
- unknown
190. Bengali Visual Genome 1.0
- Creator:
- Sen, Arghyadeep, Parida, Shantipriya, Kotwal, Ketan, Panda, Subhadarshi, Bojar, Ondřej, and Dash, Satya Ranjan
- Publisher:
- Charles University, Faculty of Mathematics and Physics, Institute of Formal and Applied Linguistics (UFAL)
- Type:
- image and corpus
- Subject:
- multi-modal, neural machine translation, image captioning, Bengali captioning, and English-Bengali Multimodal Corpus
- Language:
- English and Bengali
- Description:
- Data ------- Bengali Visual Genome (BVG for short) 1.0 has similar goals as Hindi Visual Genome (HVG) 1.1: to support the Bengali language. Bengali Visual Genome 1.0 is the multi-modal dataset in Bengali for machine translation and image captioning. Bengali Visual Genome is a multimodal dataset consisting of text and images suitable for English-to-Bengali multimodal machine translation tasks and multimodal research. We follow the same selection of short English segments (captions) and the associated images from Visual Genome as HGV 1.1 has. For BVG, we manually translated these captions from English to Bengali taking the associated images into account. The manual translation is performed by the native Bengali speakers without referring to any machine translation system. The training set contains 29K segments. Further 1K and 1.6K segments are provided in development and test sets, respectively, which follow the same (random) sampling from the original Hindi Visual Genome. A third test set is called the ``challenge test set'' and consists of 1.4K segments. The challenge test set was created for the WAT2019 multi-modal task by searching for (particularly) ambiguous English words based on the embedding similarity and manually selecting those where the image helps to resolve the ambiguity. The surrounding words in the sentence however also often include sufficient cues to identify the correct meaning of the ambiguous word. Dataset Formats --------------- The multimodal dataset contains both text and images. The text parts of the dataset (train and test sets) are in simple tab-delimited plain text files. All the text files have seven columns as follows: Column1 - image_id Column2 - X Column3 - Y Column4 - Width Column5 - Height Column6 - English Text Column7 - Bengali Text The image part contains the full images with the corresponding image_id as the file name. The X, Y, Width and Height columns indicate the rectangular region in the image described by the caption. Data Statistics --------------- The statistics of the current release are given below. Parallel Corpus Statistics -------------------------- Dataset Segments English Words Bengali Words ---------- -------- ------------- ------------- Train 28930 143115 113978 Dev 998 4922 3936 Test 1595 7853 6408 Challenge Test 1400 8186 6657 ---------- -------- ------------- ------------- Total 32923 164076 130979 The word counts are approximate, prior to tokenization. Citation -------- If you use this corpus, please cite the following paper: @inproceedings{hindi-visual-genome:2022, title= "{Bengali Visual Genome: A Multimodal Dataset for Machine Translation and Image Captioning}", author={Sen, Arghyadeep and Parida, Shantipriya and Kotwal, Ketan and Panda, Subhadarshi and Bojar, Ond{\v{r}}ej and Dash, Satya Ranjan}, editor={Satapathy, Suresh Chandra and Peer, Peter and Tang, Jinshan and Bhateja, Vikrant and Ghosh, Anumoy}, booktitle= {Intelligent Data Engineering and Analytics}, publisher= {Springer Nature Singapore}, address= {Singapore}, pages = {63--70}, isbn = {978-981-16-6624-7}, doi = {10.1007/978-981-16-6624-7_7}, }
- Rights:
- Creative Commons - Attribution-NonCommercial-ShareAlike 4.0 International (CC BY-NC-SA 4.0), http://creativecommons.org/licenses/by-nc-sa/4.0/, and PUB