Google 在 I/O 大会上正式发布了全新的 Gemini 3.5 模型系列,首个面世的是 Gemini 3.5 Flash 版本。该模型的设计目标是实现更极致的速度与更低的运行成本,作为 Gemini 3.5 Pro 的轻量化先行者,它能够处理更高频的任务。博主指出,相比于尚未全面开放的 Pro 版本,Flash 模型在保持高效的同时提供了出色的性价比,是开发者部署应用时的首选。这一模型的出现体现了 Google 对模型分层化管理的策略,旨在满足不同应用场景下的实时处理需求。
Gemini Omni 模型是本次大会最受关注的创新成果,它具备极强的多模态理解与生成能力。该模型旨在通过任何输入源进行灵活创作,目前已经支持深度分析并编辑视频内容。未来的升级计划将进一步打破壁垒,实现音频、图像与视频之间的随意转换与输入。这种跨模态的技术突破不仅提升了交互效率,还赋予了 AI 模型更加拟人化的感知能力,使用户能够通过多种自然语言之外的方式与人工智能高效协作。
Gemini Spark 是 Google 对标行业内前沿 Agent(智能代理)的重磅回应,标志着 AI 从被动响应向主动执行的质变。不同于传统的文本生成模型,Spark 可以根据用户的目标,自主在网络环境或应用中执行复杂任务。与需要本地部署的竞争对手不同,Gemini Spark 完全在 Google 的云端服务器上运行。这意味着即便用户离线或设备关机,AI 代理依然能够在云端持续工作,为用户提供不间断的自动化服务支持。