Data Marketplace

Use verified, licensed data with confidence. You can download right away or check the data through inquiry.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 326 datasets
  • Pre-training DataText

    Chinese General-Domain Multi-Turn Chat Text Dataset

    A Chinese general-domain multi-turn chat text dataset built by professional native-language annotators for daily life and general conversation domains.

  • Pre-training DataText

    English General-Domain Multi-Turn Chat Text Dataset

    An English general-domain multi-turn chat text dataset built by professional native-language annotators for daily life and general conversation domains.

  • Pre-training DataText

    French General-Domain Multi-Turn Chat Text Dataset

    A French general-domain multi-turn chat text dataset built by professional annotators for daily life and general conversation domains.

  • Pre-training DataText

    Indonesian General-Domain Multi-Turn Chat Text Dataset

    An Indonesian general-domain multi-turn chat text dataset built by professional annotators for daily life and general conversation domains.

  • Pre-training DataText

    Italian General-Domain Multi-Turn Chat Text Dataset

    An Italian general-domain multi-turn chat text dataset built by professional annotators for daily life and general conversation domains.

  • Pre-training DataText

    Japanese General-Domain Multi-Turn Chat Text Dataset

    A Japanese general-domain multi-turn chat text dataset built by professional annotators for daily life and general conversation domains.

  • Pre-training DataText

    Spanish General-Domain Multi-Turn Chat Text Dataset

    A Spanish general-domain multi-turn chat text dataset built by professional annotators for daily life and general conversation domains.

  • Pre-training DataText

    Vietnamese General-Domain Multi-Turn Chat Text Dataset

    A Vietnamese general-domain multi-turn chat text dataset built by professional annotators for daily life and general conversation domains.

  • Pre-training DataText

    Parallel Translation Corpus Text Dataset

    A parallel translation corpus dataset built from Korean source texts and corresponding foreign-language translations across general domains, created by professional translators and native-language annotators.

  • Pre-training DataText

    Multilingual Food and Menu Parallel Translation Corpus

    A multilingual food and menu parallel translation corpus built by translating menu names extracted from sources such as AI Hub, the Korea Tourism Organization, and ImageLab into Korean, English, Chinese, and Japanese, with expert review by translators and native-language annotators.