数据集

2 个数据集
已选筛选: 文本生成 PDF 清除所有筛选
Fineweb-Edu-Chinese-V2.2 已完整同步
Chinese Fineweb-Edu 数据集 V2.2 是一个面向中文教育领域的高质量数据集,覆盖从预训练到监督微调(SFT)的完整流程。该版本基于 DeepSeek V3.2 模型,从顶尖质量语料中提取了 143 万条高质量问答对,专为后训练阶段设计。数据集包含 SFT 问答、SFT 上下文和预训练等多种配置,旨在解决中文开源社区中优质教育语料稀缺的问题,助力提升模型在教育场景下的表现。
GITATTRIBUTESMDPDF Apache License 2.0 207 KiB 3 个文件 WeHub 同步于 2026-08-12 04:26:38 +00:00
DeepSeek-R1T-Chimera 是一个开源模型,通过合并 DeepSeek-R1 和 DeepSeek-V3(0324)的权重而来,融合了 R1 的推理能力与 V3 的 token 效率。该模型采用 DeepSeek-MoE Transformer 架构,于 2025 年 4 月发布,适用于文本生成任务。
DEEPSEEKGITATTRIBUTESJPGJSONMDPDFPYSAFETENSORS MIT License 641 GiB 173 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00