谷歌发布新模型 - 公司发布三款新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 及网络安全特供版 Cyber [2] - 新模型均属Flash系列,主打成本低、速度快、适合规模化运行智能体(Agent)[3] Gemini 3.6 Flash 模型性能与定价 - 该模型在代码、AI科研及多模态能力上均有提升 [9] - 编码基准DeepSWE得分从37%提升至49%,多模态基准OSWorld得分从78.4%提升至83.0% [10] - 知识截止时间更新至2026年3月 [10] - 输出token消耗比上一代Gemini 3.5 Flash减少17%,在部分编码场景下可减少65% [13][14] - 定价为每百万token输入1.5美元,输出7.5美元,较3.5 Flash更便宜 [16] Gemini 3.5 Flash-Lite 模型性能与定价 - 该模型是3.5系列中速度最快、性价比最高的版本 [19] - 双A指数显示其每秒可输出350个token [20] - 在智能体(Agent)工作流场景下,性能相较前代Flash-Lite模型有大幅提升 [21] - 定价为每百万token输入0.3美元,输出2.5美元 [22] - 在部分编码和智能体任务上表现甚至超越非Lite版的Gemini 3 Flash [23] - 该模型目前不向公众开放,仅面向政府和可信伙伴进行限量试点 [25] 市场反馈与竞争对比 - 有用户反馈,在实际使用中,Gemini 3.6 Flash的成本高于GPT-5.6 Sol medium,但智力表现更低 [26] - 在谷歌发布新模型期间,竞争对手Anthropic发布了Fable 5,xAI发布了Grok 4.5,OpenAI迭代了GPT-5.6的三个小版本 [38] Gemini 3.5 Pro 状态与影响 - 公司在5月的I/O大会上承诺一个月内交付Gemini 3.5 Pro,但目前已过去两个月仍未发布 [5][6][29][30] - 据彭博社报道,该模型因编码能力不达标被内部搁置,团队在6月底更新训练数据的尝试结果“令人失望” [31][32] - 有传闻称公司曾推翻基座重新训练,目标7月17日上线,但目前该模型仍处于合作伙伴测试阶段 [32] - 公司当前可用的旗舰模型仍是今年2月发布的Gemini 3.1 Pro,旗舰产品线已断档近半年 [39] - 市场担忧Gemini 3.5 Pro若继续延迟发布,可能面临一发布即过时的风险 [40] 产品线管理与未来规划 - 公司产品线命名体系混乱,同时维护Nano、Flash、Flash-Lite、Pro、Ultra、Cyber六条线,且版本号不一致 [37] - 公司宣布已启动Gemini 4的预训练,并称其为“史上最雄心勃勃”的一次 [7][34] - 外界猜测Gemini 4可能涉及全新的训练架构、更大规模的数据飞轮或多模态能力的代际跃迁 [35]
Gemini 4已开练!谷歌三连上新,主打又便宜又快