Data Marketplace

Use verified, licensed data with confidence. You can download right away or check the data through inquiry.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 326 datasets
  • Fine-tuning DataText

    Multilingual General-Domain QA Text Dataset

    A multilingual general-domain QA text dataset covering topics such as politics, finance, and society, reviewed and refined by professional annotators.

  • Fine-tuning DataText

    Multilingual Current Knowledge QA Text Dataset

    A multilingual QA benchmark dataset built for evaluating rapidly changing knowledge and factual accuracy across general domains, curated by professional annotators.

  • Fine-tuning DataText

    Multilingual Public Administration Open and Closed QA Text Dataset

    A multilingual public administration QA dataset built from tables and contextual sentences in press releases from government agencies such as the Ministry of the Interior and Safety and the Ministry of Health and Welfare, covering both open QA and closed QA.

  • Alignment DataText

    Multilingual Legal Model Preference Evaluation Text Dataset

    A multilingual legal preference evaluation dataset built from legal-domain questions and three AI-generated answers, with law majors and legal professionals providing scoring, feedback, and rewritten responses.

  • Alignment DataText

    Multilingual STEM Model Preference Evaluation Text Dataset

    A multilingual STEM preference evaluation dataset built from STEM-domain questions and three AI-generated answers, with STEM majors providing scoring, feedback, and rewritten responses.

  • Alignment DataText

    Multilingual Document-Grounded QA Text Dataset

    A multilingual instruction-following QA text dataset built for tasks that require generating answers based on referenced documents.

  • Alignment DataText

    Multilingual AI Model Evaluation Text Dataset

    A multilingual AI model evaluation dataset built by having expert reviewers re-evaluate and verify automatically scored response quality according to defined evaluation criteria.

  • Alignment DataText

    Multilingual General-Domain Model Preference Evaluation Text Dataset

    A multilingual general-domain preference evaluation dataset built from questions in areas such as politics, finance, and society and three AI-generated answers, with professional annotators providing scoring, feedback, and rewritten responses.

  • Pre-training DataAudio

    Malaysian English Multilingual Speech Dataset

    A single-turn Malaysian English (Manglish) speech dataset designed to enhance multilingual interpretation and translation solutions.

  • Pre-training DataAudio

    Malaysian English Multilingual Speech Dataset for IT & Software Domains

    A single-turn Malaysian English speech dataset designed to improve multilingual interpretation and translation in IT and software domains.