数据集

6 个数据集
已选筛选: MODEL Apache-2.0 模型 清除所有筛选
这是一个多语言句子嵌入模型,能将句子和段落转换为384维的稠密向量,适用于文本聚类、语义搜索和句子相似度计算等任务。模型支持包括中文在内的50多种语言,基于MiniLM架构,采用均值池化方式生成句子级别的向量表示,输出可直接用于下游应用。
BINGITATTRIBUTESH5JSONMDMODELONNXSAFETENSORSXML Apache License 2.0 4.3 GiB 28 个文件 WeHub 同步于 2026-08-19 12:47:07 +00:00
zai-org/CogVideoX-2b 已完整同步
CogVideoX-2B 是一个文本到视频的生成模型,能够根据英文描述生成连贯的视频内容。该模型采用 Apache-2.0 开源许可证,适用于视频生成相关的研究和应用。
GITATTRIBUTESGITIGNOREJSONMDMODELSAFETENSORS Apache License 2.0 13 GiB 19 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
openbmb/MiniCPM-SALA 已完整同步
MiniCPM-SALA是一种创新的大规模混合注意力模型,首次将稀疏注意力与线性注意力高效融合,专为百万级令牌的上下文建模设计。它采用25%的稀疏注意力层(基于InfLLM-v2)和75%的线性注意力层(Lightning Attention),在保持高保真长上下文建模能力的同时,突破了计算和内存瓶颈,实现了3.5倍的推理加速,并显著降低KV缓存开销。通过混合位置编码(HyPE)和基于蒸馏的HALO训练策略,该模型能够扩展到百万令牌以上的上下文长度,同时在通用知识、数学和代码等任务上保持与全注意力模型相当的性能。
GITATTRIBUTESJSONMDMODELPYSAFETENSORS Apache License 2.0 18 GiB 15 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
Wan-AI/Wan2.2-S2V-14B 已完整同步
Wan2.2-S2V-14B 是一个音频驱动的电影级视频生成模型,能够根据输入音频生成具有丰富表现力的角色动画。它专注于处理复杂场景,如人物互动、自然身体动作和动态镜头运动,适用于影视制作等高品质需求。模型采用混合专家(MoE)架构,在保持计算效率的同时扩大了模型容量,并经过精心筛选的审美数据训练,可生成具有可控光影、构图和色彩风格的电影感视频。
BINBINARYGITATTRIBUTESJSONMDMODELMP4MSCMSGPACKMVPNGPTHPYSAFETENSORSSHTXT Apache License 2.0 46 GiB 49 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
Nanbeige/Nanbeige4.1-3B 已完整同步
Nanbeige4.1-3B 是基于 Nanbeige4-3B-Base 构建的轻量级推理模型,通过监督微调与强化学习进一步优化,在保持小参数规模的同时展现出强大的推理能力、偏好对齐效果和智能体行为。它能够通过单次前向传播完成复杂多步推理,并在代码、数学、科学等多项基准测试中超越同规模及部分更大模型。此外,Nanbeige4.1-3B 原生支持深度搜索任务,可稳定执行超过 500 轮工具调用,填补了小型模型在通用推理与智能体场景中兼顾不足的空白。
GITATTRIBUTESJSONMDMODELPDFPNGSAFETENSORS Apache License 2.0 7.3 GiB 16 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
jetmoe/jetmoe-8b 已完整同步
JetMoE-8B 是一个高效的大语言模型,仅需极低的训练成本就能达到甚至超越 LLaMA2-7B 的性能。它在推理时只有 2.2B 活跃参数,大幅降低了计算开销,同时优于计算量相近的模型(如 Gemma-2B)。该模型完全基于公开数据集训练,代码开源,便于在普通消费级 GPU 上进行微调,适合学术研究场景。
GITATTRIBUTESJSONMDMODELPNGSAFETENSORS Apache License 2.0 16 GiB 16 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00