Data Marketplace

Use verified, licensed data with confidence. You can download right away or check the data through inquiry.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 323 datasets
  • Alignment DataText

    Multilingual Legal Model Preference Evaluation Text Dataset

    A multilingual legal preference evaluation dataset built from legal-domain questions and three AI-generated answers, with law majors and legal professionals providing scoring, feedback, and rewritten responses.

  • Alignment DataText

    Multilingual STEM Model Preference Evaluation Text Dataset

    A multilingual STEM preference evaluation dataset built from STEM-domain questions and three AI-generated answers, with STEM majors providing scoring, feedback, and rewritten responses.

  • Alignment DataText

    Multilingual Document-Grounded QA Text Dataset

    A multilingual instruction-following QA text dataset built for tasks that require generating answers based on referenced documents.

  • Alignment DataText

    Multilingual AI Model Evaluation Text Dataset

    A multilingual AI model evaluation dataset built by having expert reviewers re-evaluate and verify automatically scored response quality according to defined evaluation criteria.

  • Alignment DataText

    Multilingual General-Domain Model Preference Evaluation Text Dataset

    A multilingual general-domain preference evaluation dataset built from questions in areas such as politics, finance, and society and three AI-generated answers, with professional annotators providing scoring, feedback, and rewritten responses.

  • Pre-training DataAudio

    Malaysian English Multilingual Speech Dataset

    A single-turn Malaysian English (Manglish) speech dataset designed to enhance multilingual interpretation and translation solutions.

  • Pre-training DataAudio

    Malaysian English Multilingual Speech Dataset for IT & Software Domains

    A single-turn Malaysian English speech dataset designed to improve multilingual interpretation and translation in IT and software domains.

  • Pre-training DataAudio

    Malaysian English Multi-Turn Speech Dataset

    A Malaysian English multi-turn spoken dialogue dataset designed to enhance multilingual interpretation and translation solutions.

  • Pre-training DataAudio

    Standard Arabic Finance Domain Speech Dataset

    A single-turn finance domain speech dataset based on Modern Standard Arabic (MSA).

  • Pre-training DataAudio

    Gulf Arabic Finance Domain Speech Dataset

    A single-turn finance domain speech dataset based on the Gulf Arabic dialect.