-
本地跑一个文生视频模型:CogVideoX 代码与 2B 模型都是 Apache 2.0
想在本地跑文生视频?CogVideoX 提供 2B 与 5B 多个版本,代码与 2B 模型均为 Apache 2.0 许可,支持 diffusers 与量化推理。
-
Opus Clip:一条长视频自动切出 10 条短视频,还能一键发到各平台
Opus Clip 把一条长视频自动切成多条短视频,提供 ClipAnything 全类型切片、ReframeAnything 智能重构图与 Virality Score 爆款评分。
-
剪映:把智能抠像、AI 补帧与音色克隆,全塞进同一个剪辑器里
剪映专业版在 Windows 上提供 AI 剪辑能力,新增支持 NVIDIA RTX 50 系 GPU 硬件加速与 4:2:2 硬件编解码,三编码器导出速度提升 1.5 倍。
-
D-ID:一张照片就能开口说话,还能把视频翻成 120 多种语言
D-ID 支持用一张人脸照片生成会说话的数字人,覆盖 120 多种语言,并提供视频翻译、声音克隆与可实时对话的 Visual Agents,成片时长上限为 5 分钟。
-
Synthesia:一张照片生成数字分身,培训视频一键翻成 140 多种语言
Synthesia 面向企业培训场景提供 240 多个数字人与 160 多种语言,支持用一张照片生成个人数字分身,还能把已有视频一键翻译成 140 多种语言并保持口型同步。
-
数字人总在换脸?HeyGen Avatar V 让同一个你在 175 种语言里保持一致
一款面向出镜内容的 AI 视频平台:Avatar V 数字分身只需 15 秒素材,Video Agent 一句话出成片,视频翻译带唇形同步并覆盖 175 种以上语言。
-
通义万相 Wan:开源视频模型从 8.19GB 显存的 1.3B 一路走到 27B 双专家 MoE
通义万相 Wan2.2 用双专家 MoE 把总参数扩到 27B、每步只激活 14B,5B 的 TI2V 模型以 720P 24fps 输出并能跑在消费级显卡上。
-
Google Veo 3.1:原生音频与 1080p、4K 输出,官方页列出四项能力领先
Google DeepMind 的视频模型 Veo 3.1 把音效、环境声与对白纳入同一次生成,输出支持 1080p 与 4K 分辨率,并提供场景延伸、首尾帧、运镜控制与对象增删等创作能力。
-
PixVerse:V6 支持 15 秒 1080p 与原生音频,官方页显示榜单 ELO 为 1,343
PixVerse 的 V6 模型能在同一次生成里产出 15 秒 1080p 视频,自带多镜头逻辑与对白、音效、环境音等原生音频,还支持在生成前先定 16:9 或 9:16 等画幅。
-
Vidu:Q3 支持音视频同步输出,对话、旁白、音效与音乐四类音轨一次生成
Vidu 把实时能力放进 S2:S2-Avatar 支持实时语音对话与复杂动作控制、输出 720P+,S2-Editing 支持风格渲染、角色替换、背景替换与虚拟换衣。
-
海螺视频:官方称 H3 的 2K 单价不到主流模型三分之一
海螺视频主推的 MiniMax H3 能把文本、图像、视频与音频放进同一段上下文,生成带原生立体声的视频,最长 15 秒、2K 分辨率,官方称其 2K 每秒价格不到主流模型的三分之一。
-
可灵 AI:Kling 3.0 系列原生支持音频,官方称已上线原生 4K 视频生成
可灵 AI 把视频、图片与音效生成收进同一个创作台:Kling 3.0 系列原生支持音频,官方称已通过 3.0 模型上线原生 4K 视频生成,API 按秒计费。
-
Luma:Ray 3.2 支持单条 16 个关键帧的 AI 视频平台
Luma 把自己定位成「你的创意伙伴」:Ray 3.2 视频模型支持单条 16 个关键帧、原生 HDR 与 16 位 EXR 导出,配合 AI Agent 从概念走到成片。
-
Pika:图生视频与一键特效都在一个平台,免费档每月 80 积分
Pika 把自己定位成「把想法变成视频」的 AI 创作平台:图生视频、一键搞怪特效、AI Agent 与 API 会员都在同一个站点,免费档每月 80 个积分。
-
Runway:Gen-4.5 驱动的 AI 视频创作平台,生成与后期一个工作台搞定
Runway 把 AI 视频生成、图像编辑与后期制作收进同一个云端工作台,免费版送 125 个一次性积分可直接上手试用,付费方案从每月 12 美元起,支持随时取消。
-
第 1 / 1 页