网站介绍
通义万相 / Wan 是阿里巴巴的视觉生成体系,既提供面向普通用户的在线创作,也提供开放模型和开发接口。它覆盖图片、视频、语音驱动和角色动画,适合从单张视觉到动态内容的一体化探索。
Wan2.2 的视频体系支持文生视频、图生视频、语音生视频和角色动画。开源 5B 混合模型可在消费级 RTX 4090 上运行,支持 720p、24fps 的文字与图片生视频,兼顾研究和本地工作流。
模型对复杂动作、语义和审美进行了强化,并提供 14B 高质量模型与 5B 高效模型。角色动画版本可复现整体动作和表情,语音驱动版本可根据音频生成说话或表演内容。
在线体验的额度和价格会动态变化,而开放模型本身无需订阅。它的性价比来自开源和多任务覆盖,但本地视频生成仍需要较强显卡、较长推理时间和一定技术配置。
核心功能
通义万相的重点是图像视频多任务覆盖、复杂运动、语音与角色驱动,以及可本地部署的开放模型。
图片与视频生成
文字与图片生视频
支持 T2V、I2V 和统一的文字/图片输入视频工作流。
AI 图片
在线平台覆盖文生图、视觉设计和图片编辑能力。
720p / 24fps
Wan2.2 5B 开放模型支持消费级显卡上的 720p、24fps 输出。
动作与角色
复杂运动
扩大图像和视频训练数据后,增强动作、语义和审美泛化。
语音生视频
S2V 模型可根据语音驱动人物口型和表演。
角色动画
Animate 模型支持角色动画和替换,复现动作与表情。
开放与性能
多规模模型
14B 模型追求质量,5B 模型强调消费级设备可运行。
Apache 2.0
Wan2.2 仓库使用 Apache 2.0 许可,并声明不主张生成内容权利。
生态集成
支持 Diffusers、ComfyUI、ModelScope 和本地推理。
订阅价格
Wan 在线站点、开放模型和云 API 是三种不同使用方式;阿里云百炼图像 API 按输出张数计费。
Wan 在线体验
推荐不配置环境、直接测试图片和视频的用户
Wan2.2 开放模型
研究、定制和本地视频工作流
Wan 2.7 / 2.6 图像 API
需要批量生成和产品集成的开发者
Wan 2.7 Image Pro API
高质量文字、品牌色与多参考图任务
使用条件
- 网络要求
- 在线创作与阿里云 API 需要联网;开源模型也可按条件本地部署。
- 网页账号
- 在线创作、额度和作品管理通常需要登录。
- 本地硬件
- 5B 模型可在 24GB 级显存设备运行,更大模型可能需要 80GB 或多卡。
- 推理速度
- 消费级显卡生成 5 秒 720p 视频仍可能需要数分钟。
- 许可要求
- 使用开放模型和衍生版本时应遵守 Apache 2.0 及模型说明中的责任条款。
- API 价格
- 不同地区、端点、分辨率和任务的单价可能不同。
- 素材授权
- 人像、声音、角色和影视素材需要取得合法授权。
- 内容责任
- 本地部署不代表不受法律与内容责任约束。
- 部署能力
- 本地工作流需要 Python、CUDA、模型下载和显存优化经验。
相似工具
信息说明
通义万相 的模型、生成额度、输出规格、价格和地区可用性可能随官方调整,请以购买页和当前账户显示为准。卡片评分为 YuanSpace 根据生成质量、提示词理解、一致性与可控性、编辑工作流、速度稳定性、免费可用度和订阅性价比给出的编辑评分。
如发现网站无法访问或介绍内容有误,可以前往信息纠错提交反馈。