
HISTORY近 30 天历史柱高表示当天去重热搜数量
09/10—10/09 有历史数据
- 019854fka/prompts.chattask_categories:question-answering, task_categories:text-generation, size_categories:1K<n<10K, format:csv, modality:text, library:datasets, library:pandas, library:polars, library:mlcroissantfka
- 023613HuggingFaceFW/finewebtask_categories:text-generation, language:en, size_categories:10B<n<100B, modality:tabular, modality:text, arxiv:2306.01116, arxiv:2109.07445, arxiv:2406.17557, doi:10.57967/hf/2493HuggingFaceFW
- 032395Anthropic/hh-rlhfsize_categories:100K<n<1M, format:json, modality:text, library:datasets, library:dask, library:polars, library:mlcroissant, arxiv:2204.05862, region:usAnthropic
- 041951openai/gsm8kbenchmark:official, benchmark:eval-yaml, task_categories:text-generation, annotations_creators:crowdsourced, language_creators:crowdsourced, multilinguality:monolingual, source_datasets:original, language:en, size_categories:10K<n<100Kopenai
- 051637wikimedia/wikipediatask_categories:text-generation, task_categories:fill-mask, task_ids:language-modeling, task_ids:masked-language-modeling, language:ab, language:ace, language:ady, language:af, language:alt, language:amwikimedia
- 061607Open-Orca/OpenOrcatask_categories:text-classification, task_categories:token-classification, task_categories:table-question-answering, task_categories:question-answering, task_categories:zero-shot-classification, task_categories:summarization, task_categories:feature-extraction, task_categories:text-generation, language:enOpen-Orca
- 071589OpenAssistant/oasst1language:en, language:es, language:ru, language:de, language:pl, language:th, language:vi, language:sv, language:bn, language:daOpenAssistant
- 081357tatsu-lab/alpacatask_categories:text-generation, language:en, size_categories:10K<n<100K, format:parquet, modality:text, library:datasets, library:pandas, library:polars, library:mlcroissanttatsu-lab
- 091328databricks/databricks-dolly-15ktask_categories:question-answering, task_categories:summarization, language:en, size_categories:10K<n<100K, format:json, modality:text, library:datasets, library:pandas, library:mlcroissantdatabricks
- 101317HuggingFaceFW/fineweb-edutask_categories:text-generation, language:en, size_categories:1B<n<10B, format:parquet, modality:tabular, modality:text, library:datasets, library:dask, library:polarsHuggingFaceFW
- 111273stanfordnlp/imdbtask_categories:text-classification, task_ids:sentiment-classification, annotations_creators:expert-generated, language_creators:expert-generated, multilinguality:monolingual, source_datasets:original, language:en, size_categories:100K<n<1M, format:parquetstanfordnlp
- 121225rajpurkar/squadtask_categories:question-answering, task_ids:extractive-qa, annotations_creators:crowdsourced, language_creators:crowdsourced, language_creators:found, multilinguality:monolingual, source_datasets:extended|wikipedia, language:en, size_categories:10K<n<100Krajpurkar
- 131225gsdf/EasyNegativesize_categories:n<1K, format:imagefolder, modality:image, library:datasets, library:mlcroissant, region:usgsdf
- 141200togethercomputer/RedPajama-Data-1Ttask_categories:text-generation, language:en, region:ustogethercomputer
- 151191FreedomIntelligence/medical-o1-reasoning-SFTtask_categories:question-answering, task_categories:text-generation, language:en, language:zh, size_categories:10K<n<100K, format:json, modality:text, library:datasets, library:pandasFreedomIntelligence
- 161188roneneldan/TinyStoriestask_categories:text-generation, language:en, size_categories:1M<n<10M, format:parquet, modality:text, library:datasets, library:dask, library:polars, library:mlcroissantroneneldan
- 171151HuggingFaceH4/ultrachat_200ktask_categories:text-generation, language:en, size_categories:100K<n<1M, format:parquet, modality:text, library:datasets, library:dask, library:mlcroissant, library:polarsHuggingFaceH4
- 181126nyu-mll/gluetask_categories:text-classification, task_ids:acceptability-classification, task_ids:natural-language-inference, task_ids:semantic-similarity-scoring, task_ids:sentiment-classification, task_ids:text-scoring, annotations_creators:other, language_creators:other, multilinguality:monolingual, source_datasets:originalnyu-mll
- 191123nvidia/PhysicalAI-Autonomous-Vehiclesregion:usnvidia
- 201089allenai/dolmatask_categories:text-generation, language:en, size_categories:n>1T, arxiv:2402.00159, arxiv:2301.13688, region:us, language-modeling, casual-lm, llmallenai
- 211083bigcode/the-stacktask_categories:text-generation, language_creators:crowdsourced, language_creators:expert-generated, multilinguality:multilingual, language:code, size_categories:100M<n<1B, format:parquet, modality:tabular, modality:textbigcode
- 221053lmsys/lmsys-chat-1msize_categories:1M<n<10M, format:parquet, modality:text, library:datasets, library:dask, library:polars, library:mlcroissant, arxiv:2309.11998, region:uslmsys
- 231007ILSVRC/imagenet-1ktask_categories:image-classification, task_ids:multi-class-image-classification, annotations_creators:crowdsourced, language_creators:crowdsourced, multilinguality:monolingual, source_datasets:original, language:en, size_categories:1M<n<10M, format:parquetILSVRC
- 241005cais/hlebenchmark:official, size_categories:1K<n<10K, format:parquet, modality:image, modality:text, library:datasets, library:pandas, library:polars, library:mlcroissantcais
- 25980Nerfgun3/bad_promptlanguage:en, size_categories:n<1K, format:imagefolder, modality:image, library:datasets, library:mlcroissant, region:us, stable-diffusion, text-to-imageNerfgun3
- 26966tiiuae/falcon-refinedwebtask_categories:text-generation, language:en, size_categories:100M<n<1B, format:parquet, modality:text, library:datasets, library:dask, library:mlcroissant, library:polarstiiuae
- 27947HuggingFaceFW/finepdfstask_categories:text-generation, language:aai, language:aak, language:aau, language:aaz, language:aba, language:abi, language:abk, language:abn, language:abqHuggingFaceFW
- 28942open-thoughts/OpenThoughts-114ksize_categories:100K<n<1M, format:parquet, modality:text, library:datasets, library:dask, library:polars, library:mlcroissant, arxiv:2506.04178, region:usopen-thoughts
- 29938anon8231489123/ShareGPT_Vicuna_unfilteredlanguage:en, region:usanon8231489123
- 30913teknium/OpenHermes-2.5language:eng, size_categories:1M<n<10M, format:json, modality:text, library:datasets, library:pandas, library:mlcroissant, library:polars, region:us, syntheticteknium
- 31898HuggingFaceFW/fineweb-2task_categories:text-generation, language:aai, language:aak, language:aau, language:aaz, language:aba, language:abi, language:abk, language:abn, language:abqHuggingFaceFW
- 32891yahma/alpaca-cleanedtask_categories:text-generation, language:en, size_categories:10K<n<100K, format:json, modality:text, library:datasets, library:pandas, library:mlcroissant, library:polarsyahma
- 33876gaia-benchmark/GAIAlanguage:en, size_categories:n<1K, format:parquet, modality:audio, modality:document, modality:image, modality:text, library:datasets, library:pandas, library:polarsgaia-benchmark
- 34875cais/mmlutask_categories:question-answering, task_ids:multiple-choice-qa, annotations_creators:no-annotation, language_creators:expert-generated, multilinguality:monolingual, source_datasets:original, language:en, size_categories:100K<n<1M, format:parquetcais
- 35874XiaomiMiMo/MiMo-V2.6-RL-osssize_categories:1K<n<10K, format:parquet, modality:document, modality:image, modality:text, library:datasets, library:pandas, library:polars, library:mlcroissantXiaomiMiMo
- 36836Salesforce/wikitexttask_categories:text-generation, task_categories:fill-mask, task_ids:language-modeling, task_ids:masked-language-modeling, annotations_creators:no-annotation, language_creators:crowdsourced, multilinguality:monolingual, source_datasets:original, language:enSalesforce
- 37809proj-persona/PersonaHubtask_categories:text-generation, task_categories:text-classification, task_categories:token-classification, task_categories:fill-mask, task_categories:table-question-answering, language:en, language:zh, size_categories:100K<n<1M, format:jsonproj-persona
- 38804open-r1/OpenR1-Math-220klanguage:en, size_categories:100K<n<1M, format:parquet, modality:text, library:datasets, library:dask, library:polars, library:mlcroissant, region:usopen-r1
- 39795QingyiSi/Alpaca-CoTlanguage:en, language:zh, language:ml, region:us, Instruction, CotQingyiSi
- 40789Congliu/Chinese-DeepSeek-R1-Distill-data-110ktask_categories:text-generation, task_categories:question-answering, language:zh, size_categories:100K<n<1M, format:json, modality:tabular, modality:text, library:datasets, library:pandasCongliu
- 41777m-a-p/COIG-CQIAtask_categories:question-answering, task_categories:text-classification, task_categories:text-generation, language:zh, size_categories:10K<n<100K, format:json, modality:text, library:datasets, library:dask, library:mlcroissantm-a-p
- 42765BAAI/Infinity-Instructtask_categories:text-generation, language:en, language:zh, size_categories:10M<n<100M, format:parquet, modality:tabular, modality:text, library:datasets, library:daskBAAI
- 43755HuggingFaceTB/cosmopedialanguage:en, size_categories:10M<n<100M, format:parquet, modality:text, library:datasets, library:dask, library:mlcroissant, library:polars, arxiv:2309.05463HuggingFaceTB
- 44731Salesforce/xlam-function-calling-60ktask_categories:question-answering, task_categories:text-generation, task_categories:reinforcement-learning, language:en, size_categories:10K<n<100K, format:json, modality:text, library:datasets, library:pandasSalesforce
- 45728FlyRank/internship-warehouselanguage:en, size_categories:10M<n<100M, modality:tabular, modality:text, region:us, seo, content-performance, data-warehouse, tabularFlyRank
- 46719HumynLabs/medical-prescription-english-audiotask_categories:audio-classification, language:en, size_categories:n<1K, format:audiofolder, modality:audio, library:datasets, library:mlcroissant, region:us, speechHumynLabs
- 47708nvidia/Llama-Nemotron-Post-Training-Datasetsize_categories:1M<n<10M, format:json, modality:text, library:datasets, library:dask, library:mlcroissant, arxiv:2505.00949, region:usnvidia
- 48703gretelai/synthetic_text_to_sqltask_categories:question-answering, task_categories:table-question-answering, task_categories:text-generation, language:en, size_categories:100K<n<1M, format:parquet, modality:text, library:datasets, library:pandasgretelai
- 49696uonlp/CulturaXtask_categories:text-generation, task_categories:fill-mask, task_ids:language-modeling, task_ids:masked-language-modeling, annotations_creators:no-annotation, language_creators:found, multilinguality:multilingual, source_datasets:original, language:af, language:alsuonlp
- 50677allenai/c4task_categories:text-generation, task_categories:fill-mask, task_ids:language-modeling, task_ids:masked-language-modeling, annotations_creators:no-annotation, language_creators:found, multilinguality:multilingual, source_datasets:original, language:af, language:amallenai


































































































