谷歌Gemini Omni模型发布,一句话让AI修改视频
谷歌发布全新多模态模型GeminiOmni,旨在打破媒介壁垒,实现“从任何输入生成任何输出”。用户可通过对话直接编辑视频,例如替换角色或更改场景背景,有望大幅降低创意制作门槛。同时,基于该架构的轻量级产品GeminiOmniFlash已上线谷歌多个应用,其API服务也已在规划中,未来将向第三方开放集成。
今天凌晨,谷歌2026年I/O开发者大会如期而至。不出所料,AI依然是绝对的主角,而这次站在舞台中央的,是名为Gemini Omni的全新模型。

谷歌对它的描述相当引人注目:“能从任何输入生成任何输出”。这听起来野心勃勃,具体怎么理解呢?简单来说,它试图打破不同媒介之间的壁垒。比如,你可以用对话的方式,直接编辑一段视频:一句话替换掉里面的角色,或者改变整个场景的背景。这种“对话式编辑”的能力,如果真能流畅实现,无疑会大幅降低创意制作的门槛。

与此同时,谷歌也迅速推出了基于Omni架构的首个产品——Gemini Omni Flash。根据大会公布的信息,这款轻量级模型即日起已经在Gemini App、Google Flow以及YouTube Shorts等自家生态中上线。对于开发者而言,更值得关注的是其API服务也已在规划中,这意味着不久后,第三方应用也能集成这种多模态生成能力。

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。
















