OpenAI 推出 ChatGPT Images 2.5
OpenAI 推出 ChatGPT Images 2.5。新版本支持将用户的想法、草图和参考照片转化为更具个性化、更精致且更能体现原意的图像。
OpenAI 推出 ChatGPT Images 2.5。新版本支持将用户的想法、草图和参考照片转化为更具个性化、更精致且更能体现原意的图像。
Google DeepMind 推出图像生成模型 Nano Banana 2 Lite 与视频生成编辑模型 Gemini Omni Flash,现已上线 Google AI Studio 与 Gemini API。
推荐理由:官方给出了高吞吐图像模型与多模态视频模型的延迟和定价,为构建轻量端到端多媒体流水线提供了参考。
Google DeepMind 发布 Gemini Omni 模型家族,主打从任意输入生成内容,首款模型 Gemini Omni Flash 率先支持视频。Omni 可组合图像、音频、视频和文本输入生成视频,并支持用自然语言多轮对话编辑视频,同时生成画面基于 Gemini 的世界知识,对重力、动能和流体动力学有更好的直观理解。
推荐理由:Gemini Omni 把视频生成与多轮对话剪辑合到同一模型中,读者可了解其输入方式与首批上线渠道。