北京时间7月2日凌晨,Google在年度I/O大会上正式发布了Gemini 3大模型。这是继Gemini 2.5之后的又一次代际飞跃,在多项基准测试中全面超越OpenAI GPT-5和Anthropic Claude 4 Opus。

核心升级亮点

重要特性详解

100万token上下文让Gemini 3可以一次性分析整个代码仓库、整本教科书或数小时的会议记录。在测试中,Gemini 3能够从500页的技术文档中精准定位信息,准确率接近100%。

多模态原生能力超越了传统的拼接式多模态方案。用户可以直接上传一段1小时的视频,Gemini 3能自动提取关键帧、识别对话、生成摘要,甚至分析场景中的情感变化。

Agent模式是本次发布的另一大亮点。Gemini 3内置了自主代理能力,可以规划、执行和修正多步任务——从预订行程到自动部署代码,无需人工干预。

定价与可用性

Gemini 3即日起通过Google AI Studio和Vertex AI开放API访问:

消费者端,Gemini 3将逐步集成到Google搜索、Gmail、Google Docs等全线产品中。Google One AI Premium订阅用户(9.99/月)已可优先体验。

业界反响

AI社区对此反应热烈。知名AI研究员Andrej Karpathy评论称:Gemini 3的100万token上下文不是营销噱头,是真正的实用创新。它重新定义了理解的含义。

分析师指出,Google这次在模型能力、成本效率和应用生态三个维度同时发力,AI军备竞赛进入了一个新阶段。对于开发者而言,Gemini 3的低定价和强大的Agent能力将大幅降低AI应用开发门槛。