摘要:谷歌在财报公布前推出三款新一代Gemini AI模型,涵盖高性能、高性价比与安全专用版本,性能指标全面超越前代。模型发布后股价微跌,但市场关注其商业化潜力。

币圈界报道:
谷歌三款新Gemini模型亮相,聚焦效率与垂直应用
Alphabet于周二正式发布三款面向企业级部署的前沿AI模型,发布时间点精准嵌入季度财报披露前夕,引发资本市场密切关注。交易数据显示,GOOGL股价报收于349.66美元,小幅下滑0.66%。
核心模型性能跃升,输出效率优化达17%
此次推出的旗舰模型Gemini 3.6 Flash在多项基准测试中实现突破性进展。其在编码任务、知识推理及多模态处理方面均优于前代3.5 Flash,尤其在令牌生成效率上实现17%的降低。定价为每百万输入令牌1.50美元,输出端为7.50美元。
DeepSWE基准得分从3.5 Flash的37%跃升至49%,MLE Bench性能由49.7%提升至63.9%,OSWorld-Verified的系统利用率也从78.4%上升至83.0%。这些数据凸显其在复杂任务中的综合优势。
轻量高效型模型主打速度与成本控制
Gemini 3.5 Flash-Lite专为高频次、低延迟场景设计,单秒可生成350个输出令牌,成为高吞吐量应用的理想选择。其输入端定价仅为每百万令牌0.30美元,输出端为2.50美元,具备极强的经济竞争力。
相较于早期3.1 Flash-Lite,该模型在代理工作流和编程任务中表现显著增强。Terminal-Bench 2.1测试得分为54%,远超此前31%;SWE-Bench Pro成绩达54.2%,领先于旧版3 Flash模型的49.6%。
首批采用者包括Palo Alto Networks与Ramp,两家公司均强调其在扩展自动化流程时展现出的响应速度与运营成本优势。
安全专用模型定向开放,强化政府合作生态
Gemini 3.5 Flash Cyber是基于3.5 Flash架构优化的网络安全专用模型,专用于漏洞识别与代码修复。其运行于谷歌CodeMender代理体系内,通过多个协同代理完成深度安全评估。
出于对技术潜在双重用途的审慎考量,访问权限目前仅限政府机构与经审核的合作方,采取分阶段试点方式推进部署。
在CyberGym基准测试中,该模型被谷歌评为“达到行业前沿水平”。此举进一步加剧了谷歌与OpenAI、Anthropic在安全领域解决方案上的竞争态势。
旗舰模型与下一代研发同步推进
尽管Gemini 3.5 Pro仍处于合作伙伴评估阶段,原定6月发布计划已延期,尚未公布确切上线时间。与此同时,谷歌已启动Gemini 4的预训练工作,显示其长期技术布局持续推进。
当前,3.6 Flash与3.5 Flash-Lite已可通过Google AI Studio、Android Studio、Gemini Enterprise及Gemini应用即时调用。其中,Flash-Lite还将集成至谷歌搜索系统,拓展实际应用场景。
声明:本站所有文章内容,均为采集网络资源,不代表本站观点及立场,不构成任何投资建议!如若内容侵犯了原著者的合法权益,可联系本站删除。
