AI 模型发现
TypeSafe Jev 1.13
Structured decisions from text or JSON, with yes/no probabilities, choices and scores.
模型发布时间线
MiniMax H3 Max 16-bit Pixel
MiniMax通过文字或首帧图片生成 5–15 秒的 768P 16-bit 像素风格有声视频。
Wan 3.0 Prime
Alibaba阿里巴巴 Wan 3.0 Prime 视频生成,支持文本、图像、视频、音频、文档和网页参考。
Wan 3.0
Alibaba阿里巴巴 Wan 3.0 视频生成,支持文本、图像、视频、音频、文档和网页参考。
MiniMax H3 Max Turbo
MiniMax通过文字或图片生成 5–15 秒视频,支持 480P、768P 和 1080P。
Seedance 2.5
ByteDance字节跳动新一代视频生成模型,增强长叙事能力,并支持最多 50 个多模态参考素材
MiniMax H3
MiniMaxMiniMax H3(海螺 03)多模态原生音频视频生成,最高支持 2K 输出。
Seedance 2.0 Mini
ByteDance字节跳动高性价比 Seedance 2.0 视频模型,生成速度更快、推理成本更低
Seedance 2.0 Fast
ByteDance快速且实惠的多模态视频,支持文本、图像、视频和音频输入,最高可达 720p
HappyHorse 1.1
AlibabaHappyHorse 1.1 支持文生视频、图生视频和参考图生视频,并提供更丰富的宽高比选项。
Grok Imagine Video 1.5
GrokxAI Grok Imagine Video 1.5 图生视频生成
让已确认图片有明确的下一步动作
图生视频 API 以现有视觉素材为起点。选择适合源素材的模型,再按文档规划运动和输出设置。
准备起始画面
选择主体清晰、构图可用且留有运动空间的图片。动画前检查文字、手部和产品细节,避免缺陷进入动态画面。
区分主体运动与镜头运动
分别描述动作和镜头行为。先从一个主要动作开始,检查模型是否在完成动作时保留主体。
核对参考图和帧控制
不同 Endpoint 可能支持起始帧、附加参考或结束帧。准备多项素材前请阅读所选模式的说明。
构建以参考图为主的视频请求
将原始素材与每个结果并列保存,以便审查视觉连续性。
选择源素材
使用有权处理的已确认图片,并记录应保持一致的主体细节与构图。
指定运动
描述一个动作和预期镜头行为,选择文档中适合投放位置的时长与输出选项。
检查完整动画
检查开头、中段和结尾是否有变形、漂移及可用构图,并与源图比较。
集成图生视频 API 前的常见问题
选择模型并准备首次请求的实用解答。
输入图片提供已有的视觉起点或参考,提示词指导运动和场景行为;当视觉已获批准时,图像驱动生成尤其适合。