数据集

1 个数据集
已选筛选: 文本生成 CSV 清除所有筛选
中文诗词数据集 可在线预览 已完整同步
这是一个中文诗词数据集,收录了从中国古代各朝代的诗词作品,可用于训练诗词续写模型。数据集包含约38.9万条训练样本和1710条测试样本,每条记录以“text1”字段存储一段完整的诗词内容。数据格式支持CSV、JSON和Markdown,便于不同场景下的使用。
CSVJSONMD Apache License 2.0 42 MiB 5 个文件 WeHub 同步于 2026-08-19 14:58:20 +00:00