数据集

3 个数据集
已选筛选: 多模态理解 MD 模型 清除所有筛选
THUDM/GLM-4.1V-9B-Thinking 已完整同步
GLM-4.1V-9B-Thinking 是一个面向推理增强的开源视觉语言模型,基于 GLM-4-9B-0414 构建,通过引入“思考范式”与强化学习显著提升了复杂任务的准确性与完整性。该模型在 10B 参数级别的视觉语言模型中达到领先水平,在 18 项基准测试上甚至超越 72B 参数的 Qwen-2.5-VL-72B。它支持长达 64k 的上下文、任意宽高比及最高 4K 图像分辨率,并具备中英双语能力,适用于数学推理、长上下文理解及多模态智能体等应用场景。
GITATTRIBUTESIPYNBJINJAJSONMDSAFETENSORS MIT License 19 GiB 15 个文件 WeHub 同步于 2026-08-12 04:26:38 +00:00
RYS-Qwen3.5-27B-FP8-S 是一个基于 Qwen3.5 的 27B 参数因果语言模型,采用 FP8 量化(块大小 128)以降低存储和推理开销,同时保持与原始模型几乎一致的性能。该模型集成了视觉编码器,支持图像到文本的多模态任务,原生上下文长度达 262,144 token,并可扩展至 1,010,000 token。架构上融合了 Gated Delta Networks 与稀疏混合专家(MoE),在高效推理的同时兼顾多模态理解、推理、代码生成和智能体能力。它经过大规模强化学习训练,并支持 201 种语言,适用于全球部署场景。
GITATTRIBUTESJINJAJSONMDSAFETENSORSTXT Apache License 2.0 29 GiB 27 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
这是一个基于 Qwen3-VL-8B-Thinking 的 8 位量化模型,支持图像到文本的生成任务,例如描述图片内容。模型采用 MLX 格式,方便在 Apple 设备上高效运行。
GITATTRIBUTESJINJAJSONMDSAFETENSORSTXT Apache License 2.0 9.2 GiB 17 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00