数据集

1 个数据集
已选筛选: 文本生成 JSONL 清除所有筛选
中文基于Qwen3-235B-2507蒸馏数据集 可在线预览 已完整同步
这个数据集包含约11万条中文对话样本,每条数据由用户提问和模型回答组成,内容涵盖广泛的知识与推理场景。数据基于高性能大语言模型生成,旨在用于微调时作为通用数据集混合,帮助模型保持知识广度、避免遗忘。
GITATTRIBUTESJSONJSONLMD Apache License 2.0 528 MiB 4 个文件 WeHub 同步于 2026-08-20 15:13:43 +00:00