此网站需要 JavaScript。
我的项目
项目探索
数据集
注册
登录
数据集
1 个数据集
类型
全部
全部
数据集
模型
格式
JSONL
全部
MD
223
GITATTRIBUTES
206
JSON
168
JSONL
69
SAFETENSORS
64
PARQUET
62
TXT
57
PNG
53
MP4
42
PY
39
CSV
21
JPG
17
BIN
15
PT
15
YAML
14
JINJA
13
MODEL
12
PDF
12
HDF5
9
ONNX
9
WAV
9
ZIP
9
GZ
8
JPEG
7
WEBP
6
MVN
5
PTH
5
GITIGNORE
4
IPYNB
4
TAR
4
XML
4
HTML
3
MP3
3
MSGPACK
3
SVG
3
XLSX
3
DOCX
2
GIF
2
H5
2
JS
2
PPTX
2
SH
2
SRT
2
TEX
2
WHL
2
XLS
2
0
1
1
1
2
1
3
1
4
1
5
1
6
1
APK
1
ARROW
1
BIB
1
BINARY
1
BMP
1
CKPT
1
CSS
1
DAT
1
DATA
1
DB
1
DEEPSEEK
1
DISTCP
1
DMG
1
DOC
1
EML
1
EPUB
1
EXE
1
FILE
1
FST
1
GGUF
1
KEEP
1
LOCK
1
METADATA
1
MLMODEL
1
MSC
1
MV
1
NPY
1
NPZ
1
ODS
1
ODT
1
OT
1
PBF
1
PCK
1
PKG
1
PKL
1
PPT
1
RAW
1
RS
1
SCP
1
SQLITE
1
TOML
1
VSIX
1
WASM
1
XCF
1
XZ
1
YUAN
1
ZST
1
许可
全部
全部
apache-2.0
110
mit
49
Apache-2.0
32
Apache License 2.0
31
cc0-1.0
5
cc-by-4.0
4
odbl
2
MIT
1
仅看可在线预览
排序
最近同步
最近同步
按大小
名称
热门分类:
自然语言处理
12
计算机视觉
1
语音识别
4
基准测试
2
数学
1
机器人操作
34
gitattributes
19
家庭场景
16
文本生成
16
md
12
抓取与放置
12
模仿学习
11
大语言模型
9
数学推理
9
代码生成
8
厨房场景
7
mp4
6
强化学习
6
问答
6
HDF5数据
5
py
5
多模态理解
5
文本转语音
5
机器人学习
5
已选筛选:
文本生成
JSONL
清除所有筛选
中文基于Qwen3-235B-2507蒸馏数据集
可在线预览
已完整同步
这个数据集包含约11万条中文对话样本,每条数据由用户提问和模型回答组成,内容涵盖广泛的知识与推理场景。数据基于高性能大语言模型生成,旨在用于微调时作为通用数据集混合,帮助模型保持知识广度、避免遗忘。
GITATTRIBUTES
JSON
JSONL
MD
Apache License 2.0
528 MiB
4 个文件
WeHub 同步于
2026-08-20 15:13:43 +00:00