TechTrends360 科技前沿

聚焦全球科技前沿资讯:AI、芯片、互联网大厂动态,每日更新

人工智能

谷歌I/O发布Gemini 3.5与世界模型Omni

谷歌在 I/O 2026 开发者大会上发布了 Gemini 3.5 模型家族,并同步推出多模态”世界模型”Gemini Omni。这是谷歌 2026 年最重要的模型更新,标志着其 AI 战略全面转向智能体时代。

Gemini 3.5:为智能体而生的模型

Gemini 3.5 被定位为”前沿智能与行动的结合”,专为编码、智能体任务和复杂工作流优化。谷歌称,该模型完成长周期智能体任务的速度大幅提升,成本常常不到其他前沿模型的一半。

发布后,Gemini 3.5 Flash 成为 Gemini App 与谷歌搜索 AI Mode 的默认模型,并在全球范围可用。随后谷歌还为其加入了内置的计算机操作(computer-use)能力,开发者可以构建直接操控浏览器、桌面与手机界面的智能体。

Gemini Omni:能”理解物理”的世界模型

更具野心的是 Gemini Omni——一个”任何输入生成任何输出”的世界模型。首阶段聚焦高质量视频生成:Omni 理解重力、流体力学等物理规律,能生成符合物理直觉的真实场景。用户甚至可以创建与自己形象、声音一致的 AI 分身,用于视频与短片创作。

这被视为谷歌对视频生成赛道的正面进攻,直接对标 OpenAI 的 Sora 与其他视频模型。世界模型被认为是通往具身智能与通用智能的关键路径,谷歌显然不想缺席。

影响展望

Gemini 3.5 的”快加便宜”策略直指 OpenAI 的定价体系,可能引发新一轮模型价格战。而 Gemini Omni 则把竞争维度从”文本智能”拉向”物理世界理解”。2026 年的大模型竞赛,正在从聊天机器人转向能干活、能理解真实世界的智能体与世界模型。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注