数据集

2 个数据集
已选筛选: SVG 模型 清除所有筛选
LongCat-Video-Avatar 是一个统一的模型,能够根据音频驱动生成富有表现力和高度动态的角色动画。它支持多种生成模式,包括音频-文本生成视频、音频-文本-图像生成视频,以及视频延续,并且兼容单流和多流音频输入。该模型通过解耦无条件引导实现自然的人体动态,采用参考跳跃注意力避免内容重复,并利用跨块潜在拼接减少长序列中的像素退化。
BINGITATTRIBUTESJSONMDONNXPNGPTSAFETENSORSSVG MIT License 99 GiB 34 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
LongCat-Image 是一个开源的、中英双语的图像生成基础模型,拥有60亿参数。它在保持高效性能的同时,在多个基准测试中超越了数倍于自身规模的模型,尤其擅长中文文字渲染,能准确稳定地生成常见汉字,并覆盖了广泛的汉字字典。此外,该模型通过创新的数据策略和训练框架,能够生成具有出色照片级真实感的图像。
GITATTRIBUTESJPEGJPGJSONMDSAFETENSORSSVGTXT Apache License 2.0 27 GiB 36 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00