AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

谷歌DeepMind发布Gemini 3.7 Flash 低定价主打编码与智能体场景

谷歌旗下AI研究机构DeepMind近期正式推出大语言模型新品Gemini 3.7 Flash,该模型主打编码与AI智能体场景,支持1M tokens上下文窗口,输入token定价低至0.75美元/百万,相较同级别竞品成本降幅最高可达40%,有望为开发者群体提供高性价比的模型调用选择,推动AI原生应用落地速度进一步加快。

配图

就在OpenAI更新GPT-4o Mini长上下文功能不到两周,谷歌就拿出了针对性的对标产品,没有堆砌冗余的通用能力,反而把成本优势和场景适配能力放在了第一位。

近两年来大模型商业化落地进入深水区,相比C端通用产品的精度内卷,面向B端开发者的垂类专用模型、轻量推理模型的竞争逐渐白热化。对于大量开发AI原生应用、智能体工作流的中小团队而言,调用成本每降低一分,就意味着产品的盈利空间和生存概率多一分,低于1美元/百万输入token已经成为行业公认的高性价比阈值。

此次推出的Gemini 3.7 Flash走的是“垂类专精”路线,并没有盲目提升通用问答能力,而是专门针对两个高频开发场景做了定向微调:一是代码全生命周期场景,包括代码生成、漏洞排查、多语言代码迁移;二是AI智能体的任务调度、多工具调用场景。

官方公布的测试数据显示,该模型在HumanEval编码基准测试中得分达到78.2,已经超过Gemini 3 Pro的基础版本,同时推理延迟较前代Gemini 3 Flash降低了40%。其配备的1M tokens上下文窗口,足以支持开发者单次上传整个中型项目的代码库完成全量分析,无需拆分上下文片段反复调用。

而最受开发者关注的定价方面,Gemini 3.7 Flash的输入token定价为0.75美元/百万,输出token定价为2.25美元/百万,较同级别竞品的平均定价低了近40%,已经接近中小团队自部署开源模型的边际成本。

此前行业普遍认为,只有当商用API调用成本低于自部署开源模型的算力+运维成本时,才会吸引大量中小团队放弃自托管、转向成熟的商用API服务,而Gemini 3.7 Flash的定价刚好踩中了这一临界点。

对于谷歌而言,这款产品也承担着抢夺大模型API市场份额的重任:目前OpenAI的GPT-4o Mini占据了轻量大模型API市场超过40%的份额,Gemini 3.7 Flash凭借更低的定价和更强的编码、智能体适配能力,有望撬动对成本敏感的开发者群体,进一步缩小与头部厂商的市场差距。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。