问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
谷歌旗下AI研究机构DeepMind近期正式推出大语言模型新品Gemini 3.7 Flash,该模型主打编码与AI智能体场景,支持1M tokens上下文窗口,输入token定价低至0.75美元/百万,相较同级别竞品成本降幅最高可达40%,有望为开发者群体提供高性价比的模型调用选择,推动AI原生应用落地速度进一步加快。

就在OpenAI更新GPT-4o Mini长上下文功能不到两周,谷歌就拿出了针对性的对标产品,没有堆砌冗余的通用能力,反而把成本优势和场景适配能力放在了第一位。
近两年来大模型商业化落地进入深水区,相比C端通用产品的精度内卷,面向B端开发者的垂类专用模型、轻量推理模型的竞争逐渐白热化。对于大量开发AI原生应用、智能体工作流的中小团队而言,调用成本每降低一分,就意味着产品的盈利空间和生存概率多一分,低于1美元/百万输入token已经成为行业公认的高性价比阈值。
此次推出的Gemini 3.7 Flash走的是“垂类专精”路线,并没有盲目提升通用问答能力,而是专门针对两个高频开发场景做了定向微调:一是代码全生命周期场景,包括代码生成、漏洞排查、多语言代码迁移;二是AI智能体的任务调度、多工具调用场景。
官方公布的测试数据显示,该模型在HumanEval编码基准测试中得分达到78.2,已经超过Gemini 3 Pro的基础版本,同时推理延迟较前代Gemini 3 Flash降低了40%。其配备的1M tokens上下文窗口,足以支持开发者单次上传整个中型项目的代码库完成全量分析,无需拆分上下文片段反复调用。
而最受开发者关注的定价方面,Gemini 3.7 Flash的输入token定价为0.75美元/百万,输出token定价为2.25美元/百万,较同级别竞品的平均定价低了近40%,已经接近中小团队自部署开源模型的边际成本。
此前行业普遍认为,只有当商用API调用成本低于自部署开源模型的算力+运维成本时,才会吸引大量中小团队放弃自托管、转向成熟的商用API服务,而Gemini 3.7 Flash的定价刚好踩中了这一临界点。
对于谷歌而言,这款产品也承担着抢夺大模型API市场份额的重任:目前OpenAI的GPT-4o Mini占据了轻量大模型API市场超过40%的份额,Gemini 3.7 Flash凭借更低的定价和更强的编码、智能体适配能力,有望撬动对成本敏感的开发者群体,进一步缩小与头部厂商的市场差距。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。