可灵 4.0 首发实测:升级 10-bit HDR 输出与原生 30 秒叙事能力
爱范儿对即将上线的新一代视频生成模型 Kling 4.0 进行了首发实测,该版本重点强化了复杂运镜稳定性与叙事可控性。模型原生支持最长 30 秒生成与 21:9 画幅,提供 10-bit HDR 规格输出以适配专业调色流程,并支持 9 种语言的口型与多声道音频同步。
爱范儿对即将上线的新一代视频生成模型 Kling 4.0 进行了首发实测,该版本重点强化了复杂运镜稳定性与叙事可控性。模型原生支持最长 30 秒生成与 21:9 画幅,提供 10-bit HDR 规格输出以适配专业调色流程,并支持 9 种语言的口型与多声道音频同步。
Google DeepMind 推出 Gemini Omni 1.1 Flash,通过 Gemini API 与 Google AI Studio 为开发者提供更精细的生成式视频控制能力。
推荐理由:新版本引入了基于上下文的场景扩展与首尾帧控制,展示了开发者在长视频叙事与分辨率超分中的具体调用方式。
Google DeepMind 推出图像生成模型 Nano Banana 2 Lite 与视频生成编辑模型 Gemini Omni Flash,现已上线 Google AI Studio 与 Gemini API。
推荐理由:官方给出了高吞吐图像模型与多模态视频模型的延迟和定价,为构建轻量端到端多媒体流水线提供了参考。
Google DeepMind 发布 Gemini Omni 模型家族,主打从任意输入生成内容,首款模型 Gemini Omni Flash 率先支持视频。Omni 可组合图像、音频、视频和文本输入生成视频,并支持用自然语言多轮对话编辑视频,同时生成画面基于 Gemini 的世界知识,对重力、动能和流体动力学有更好的直观理解。
推荐理由:Gemini Omni 把视频生成与多轮对话剪辑合到同一模型中,读者可了解其输入方式与首批上线渠道。