"数据集" 的搜索结果
共找到12个结果(工具10个· 资讯1篇· 技能1个),SeoAIu已按相关性为你排序。
AI工具 (10)
OpenCompass:上海人工智能实验室打造的开源大模型全方位评测体系与司南开放平台
231OpenCompass(司南)是由上海人工智能实验室推出的开源开放大模型评测体系,提供一站式大语言模型、多模态模型及科学智能模型评测服务。平台支持300+评测数据集、200+大语言模型、150+多模态模型的一键式分布式评测,涵盖知识、语言、推理、理解、数学、代码生成、智能体决策等八大能力维度,并扩展至科学智能、AI计算系统、具身智能、安全可信及垂类行业应用等六大领域,形成“六位一体”的全景评估范式。
2026-05-31AGI-Eval:上海交通大学等顶尖高校联合打造的大模型评测社区与权威第三方评测平台
227AGI-Eval是由上海交通大学、同济大学、华东师范大学及DataWhale等顶尖高校与机构联合打造的大模型评测社区,以“评测助力,让AI成为人类更好的伙伴”为使命。平台通过一系列高质量的人类认知考试(如LSAT、中国高考、SAT、数学竞赛、律师资格考试等)评估基础模型的通用能力,整合中英文双语任务,提供业内大语言模型的综合能力得分排名,涵盖综合评测及各专项能力评测。平台还提供Data Studio数据工坊,拥有超过3万众包用户,已上线485个任务标签,数据总量超过32万条,支持用户自建评测集、高校私有数据集托管,并已开源内部评测框架。
2026-05-31CMMLU:权威中文大语言模型知识理解能力评测基准与67学科全覆盖测试集
207CMMLU(Chinese Massive Multitask Language Understanding)是一个专门针对中文语境设计的大规模多任务语言理解评测基准,涵盖从初等到高等专业级别的67个学科主题,包含自然科学、社会科学、工程技术、人文学科以及具有中国文化特色的内容(如中国驾驶规则等)。测试集包含11,582道四选一选择题,每道题均提供四个选项且仅有一个正确答案,用于评估大语言模型在中文语境下的知识掌握程度和推理能力。
2026-05-30MMLU:大语言模型多任务语言理解能力的国际权威评测基准
188MMLU(Massive Multitask Language Understanding)是由加州大学伯克利分校等机构联合发布的大规模多任务语言理解评测数据集,涵盖57个学科领域,包括人文科学、社会科学、自然科学、工程技术以及医学、法律、数学等专业领域,题目难度覆盖从初等知识到高阶专业知识。测试集包含约14,000道四选一选择题,用于评估大语言模型在零样本和少样本场景下的知识储备与推理能力,是目前全球引用率最高的大模型评测基准之一。
2026-05-31StableLM——Stable Diffusion同门开源的AI大模型,3B参数就能跑、还可商用
154StableLM是Stability AI推出的开源大语言模型系列,基于The Pile扩展数据集训练,数据规模达1.5万亿token。提供1.6B、3B、7B、12B等多个参数版本,支持文本生成与代码编写。采用CC BY-SA 4.0开源协议,允许免费商用。Stable LM 2 12B在部分基准测试中表现超越Llama 2 70B。适合开发者、研究者及中小企业私有化部署。
2026-07-02PubMedQA——专为生物医学问答打造的“AI标尺”,能读懂科研论文才算真正通过“医学图灵测试”
135PubMedQA是首个要求对生物医学研究文本进行推理的问答数据集,由匹兹堡大学等机构于2019年发布。其任务基于PubMed摘要回答Yes/No/Maybe三类问题,包含1k专家标注数据与211k人工生成数据,旨在评估AI模型对复杂医学文献的理解与推理能力。被广泛用于衡量大语言模型在医学领域的实际水平。
2026-07-10Hugging Face——AI领域的“GitHub”,全球最大的开源模型与数据集协作平台
92Hugging Face是全球领先的AI开源社区与模型托管平台,被广泛誉为“机器学习界的GitHub”。它提供模型库、数据集、Spaces应用托管等核心服务,汇集了超过270万个模型、95万个数据集和120万个AI应用。通过Transformers等开源工具库,平台极大降低了AI开发门槛,已成为现代AI开发者不可或缺的基础设施。
2026-07-14飞桨AI Studio星河社区-人工智能学习与实训社区
75飞桨星河社区是百度飞桨旗下的人工智能学习与实训社区,专为AI学习者和开发者打造。平台集成了丰富的免费AI课程、深度学习样例项目、各领域经典数据集,并提供云端超强GPU算力及存储资源。用户可以在社区中参与新手练习赛、精英算法大赛,探索大模型社区及模型应用,实现从入门到实战的全链路学习与开发。
2026-07-22小绿鲸鲸灵AI科研大模型文献阅读器
72小绿鲸鲸灵AI是一款专为科研领域研发的科研垂直大模型,经过超1.8亿篇文献数据集及海量科研参数的深度学习与持续训练。它具备高效的信息处理和精准的知识提取能力,覆盖113个一级学科,包含1.6亿+学术文献、25万+专业双语词汇、828万+全球科研基金数据及5万+国际学术期刊数据。鲸灵AI在长文本处理、翻译准确率、处理效率和知识提取精度上全面升级,与DeepSeek等通用AI相比,在科研领域更专业、精准、高效,能显著提升科研工作者的决策效率与质量。
2026-07-20Kaggle数据科学竞赛与机器学习模型训练平台
70Kaggle是全球最大的数据科学社区和机器学习竞赛平台,提供海量公开数据集、GPU加速的Jupyter Notebook在线环境,以及由企业和研究机构发起的预测建模竞赛。用户可以在线学习数据科学技能,参与真实世界的数据挑战,与全球数据科学家交流协作,提升模型精度并赢取奖金。无论是初学者还是专家,Kaggle都是实践和展示数据分析、深度学习能力的首选平台。
2026-07-22