团队内部使用,请输入访问口令
输入描述,可上传参考图片 / 视频 / 音频,选择模型与参数
上传视频或图片,用 Qwen3-VL 分析,生成可"重建同等画面"的结构化英文提示词(JSON)。视频会自动抽帧分析,耗时约 20~60 秒。
选一个 GIF 文件转成 MP4,可下载,或直接“作为参考视频”加入上方生成框。(限 60MB)