Data Marketplace

Use verified, licensed data with confidence. You can download right away or check the data through inquiry.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 323 datasets
  • Pre-training DataAudio

    North African Arabic Public Administration Domain Speech Dataset

    A single-turn public administration domain speech dataset based on the North African Arabic (Maghrebi Arabic) dialect.

  • Pre-training DataAudio

    Egyptian Arabic Public Administration Domain Speech Dataset

    A single-turn public administration domain speech dataset based on the Egyptian Arabic dialect.

  • Alignment DataImage

    Arabic Construction Image Captioning and Preference QA Dataset

    A multimodal Arabic image dataset combining image captions and preference QA for general and construction domains, reviewed and annotated by construction and engineering domain experts.

  • Pre-training DataText

    Multilingual Multi-Turn Chat Text Dataset

    A multilingual multi-turn chat text dataset built directly by professional annotators, including speaker information, proper nouns, chat slang, typo tags, and natural conversational turns.

  • Pre-training DataText

    Multilingual Domain-Specific Parallel Translation Corpus Text Dataset

    A multilingual domain-specific parallel translation corpus dataset built from Korean-to-English, Korean-to-Arabic, and Korean-to-Chinese translations specialized in military, finance, and legal domains, curated by expert annotators.

  • Evaluation DataText

    General Arena Benchmark Dataset

    A Korean-based Arena benchmark text dataset built for evaluating AI model performance in general-domain comparison tasks.

  • Evaluation DataText

    General BFCL 3v Benchmark Dataset

    A Korean-based BFCL 3v benchmark text dataset built for evaluating function-calling capabilities of AI models.

  • Evaluation DataText

    General BFCL 4v Benchmark Dataset

    A Korean-based BFCL 4v benchmark text dataset built for evaluating function-calling capabilities of AI models.

  • Evaluation DataText

    General Tau Benchmark Dataset

    A Korean-based Tau benchmark text dataset built for evaluating AI model performance in benchmark tasks.

  • Alignment DataText

    General Preference Evaluation Chat Arena Single-Turn Dataset

    A Korean-based Chat Arena preference evaluation single-turn dataset built by collecting human preferences for AI model responses.