使用 vLLM-Omni 在 SageMaker AI 上生成图像与视频(下)
本文演示如何在 Amazon SageMaker AI 上部署 vLLM-Omni,实现从文本提示词生成图像并动画化为短视频。方案部署两个端点:FLUX.2-klein-4B 图像生成模型运行在实时端点,Wan2.1-VACE-1.3B 视频生成模型运行在异步端点,输出 MP4 文件存储于 Amazon S3。
本文演示如何在 Amazon SageMaker AI 上部署 vLLM-Omni,实现从文本提示词生成图像并动画化为短视频。方案部署两个端点:FLUX.2-klein-4B 图像生成模型运行在实时端点,Wan2.1-VACE-1.3B 视频生成模型运行在异步端点,输出 MP4 文件存储于 Amazon S3。
Simon Willison 用 Claude Opus 5.5 生成了包含 20 只新西兰鸮鹦鹉的像素动画派对页面,再让 Claude Code 通过 Playwright 自动点击并录制成 15 秒视频用于演讲闭幕。他在文中给出了完整 prompt 和 Playwright 脚本,可复用。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图与参考照片转化为更个性化、更精致的图像,更好地反映用户意图。
Google DeepMind 发布 Nano Banana 2 Lite 图像生成模型和 Gemini Omni Flash 视频生成与编辑模型。
推荐理由:原文给出两款新模型的延迟与成本,以及视频对话式编辑能力,读者可据此评估如何将图像生成与视频创作串进同一流水线。