此网站需要 JavaScript。
我的项目
项目探索
数据集
注册
登录
数据集
1 个数据集
类型
全部
全部
数据集
模型
格式
SVG
全部
MD
223
GITATTRIBUTES
206
JSON
168
JSONL
71
SAFETENSORS
64
PARQUET
62
TXT
57
PNG
53
MP4
42
PY
39
CSV
24
BIN
18
JPG
17
PT
15
YAML
14
JINJA
13
MODEL
12
PDF
12
HDF5
9
ONNX
9
WAV
9
ZIP
9
GZ
8
JPEG
7
WEBP
6
MVN
5
PTH
5
GITIGNORE
4
IPYNB
4
TAR
4
XML
4
HTML
3
MP3
3
MSGPACK
3
SVG
3
XLSX
3
DOCX
2
GIF
2
H5
2
JS
2
PPTX
2
SH
2
SRT
2
TEX
2
WHL
2
XLS
2
0
1
1
1
2
1
3
1
4
1
5
1
6
1
APK
1
ARROW
1
BIB
1
BINARY
1
BMP
1
CKPT
1
CSS
1
DAT
1
DATA
1
DB
1
DEEPSEEK
1
DISTCP
1
DMG
1
DOC
1
EML
1
EPUB
1
EXE
1
FILE
1
FST
1
GGUF
1
KEEP
1
LOCK
1
METADATA
1
MLMODEL
1
MSC
1
MV
1
NPY
1
NPZ
1
ODS
1
ODT
1
OT
1
PBF
1
PCK
1
PKG
1
PKL
1
PPT
1
RAW
1
RS
1
SCP
1
SQLITE
1
TOML
1
VSIX
1
WASM
1
XCF
1
XZ
1
YUAN
1
ZST
1
许可
MIT
全部
apache-2.0
110
mit
53
Apache-2.0
32
Apache License 2.0
31
cc-by-4.0
6
cc0-1.0
5
odbl
2
MIT
1
仅看可在线预览
排序
最近同步
最近同步
按大小
名称
热门分类:
自然语言处理
12
计算机视觉
1
语音识别
4
基准测试
2
数学
1
机器人操作
34
gitattributes
19
家庭场景
16
文本生成
16
md
12
抓取与放置
12
模仿学习
11
大语言模型
9
数学推理
9
代码生成
8
厨房场景
7
mp4
6
强化学习
6
问答
6
HDF5数据
5
py
5
多模态理解
5
文本转语音
5
机器人学习
5
已选筛选:
SVG
MIT
清除所有筛选
meituan-longcat/LongCat-Video-Avatar
已完整同步
LongCat-Video-Avatar 是一个统一的模型,能够根据音频驱动生成富有表现力和高度动态的角色动画。它支持多种生成模式,包括音频-文本生成视频、音频-文本-图像生成视频,以及视频延续,并且兼容单流和多流音频输入。该模型通过解耦无条件引导实现自然的人体动态,采用参考跳跃注意力避免内容重复,并利用跨块潜在拼接减少长序列中的像素退化。
BIN
GITATTRIBUTES
JSON
MD
ONNX
PNG
PT
SAFETENSORS
SVG
MIT License
99 GiB
34 个文件
WeHub 同步于
2026-08-05 08:09:00 +00:00