HappyHorse-1.0-I2V
HappyHorse-1.0-I2V 是阿里巴巴 ATH 团队推出的 15B 参数统一多模态 Transformer 视频生成模型。支持图生视频(Image-to-Video),以图像为起点,精准保留原图内容,生成自然流畅的动态视频。具备高度还原的动态画面生成能力,能够精准理解文本语义,输出流畅自然、细节丰富的高质量视频。支持 720P/1080P 分辨率。
覆盖文本、图像、视频、音频 500+ 模型,按使用量计费、合同价直降。点开任意一张卡片查看接入文档、SDK 示例与价格明细。
共 10 个模型
HappyHorse-1.0-I2V 是阿里巴巴 ATH 团队推出的 15B 参数统一多模态 Transformer 视频生成模型。支持图生视频(Image-to-Video),以图像为起点,精准保留原图内容,生成自然流畅的动态视频。具备高度还原的动态画面生成能力,能够精准理解文本语义,输出流畅自然、细节丰富的高质量视频。支持 720P/1080P 分辨率。
支持多模态参考,具备视频编辑和延长能力
Seedance-2.0-fast 是新一代多模态视频创作模型,继承了 Seedance-2.0 的核心功能和优势,速度更快。支持参考图片/视频/音频生成视频、视频编辑、视频延长及首尾帧生成。
新一代专业级多模态视频创作模型,支持基于图像、视频和音频等多模态参考输入生成视频,同时具备视频编辑和扩展能力。
Gemini 3.1 Flash Lite Preview 是 Google Gemini 的模型。 模型族:gemini-flash-lite。 知识截止:2025-01。 模态:text、image、video、audio、pdf → text。 上下文长度:1,048,576 tokens。
Gemini 2.5 Pro 是 Google Gemini 的模型。 模型族:gemini-pro。 知识截止:2025-01。 模态:text、image、audio、video、pdf → text。 上下文长度:1,048,576 tokens。
Gemini 2.5 Flash 是 Google Gemini 的模型。 模型族:gemini-flash。 知识截止:2025-01。 模态:text、image、audio、video、pdf → text。 上下文长度:1,048,576 tokens。
Cinematic creative generation, ultimate dynamic details. 文生视频,精准理解语义,细节丰富画质流畅。支持1080p原生分辨率,同步音频,多镜头故事讲述,7种语言唇形同步。
Gemini 3.1 Pro Preview 是 Google Gemini 的模型。 模型族:gemini-pro。 知识截止:2025-01。 模态:text、image、video、audio、pdf → text。 上下文长度:1,048,576 tokens。
Gemini 3.5 Flash 是 Google Gemini 的模型。 模型族:gemini-flash。 知识截止:2025-01。 模态:text、image、video、audio、pdf → text。 上下文长度:1,048,576 tokens。