问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
近日有行业动向显示,科技巨头谷歌正在筹备推出性能大幅升级的新一代Gemini大模型,目标直指OpenAI旗下核心产品ChatGPT的现有市场优势。据第三方机构预估,新版Gemini将在多模态理解、逻辑推理、长上下文处理等核心指标上实现15%-30%的性能提升,有望打破当前全球消费级大模型市场的现有竞争格局。
当前全球消费级生成式AI市场的头部竞争正进入白热化阶段。StatCounter此前发布的数据显示,2024年上半年ChatGPT占据了全球生成式AI工具近42%的用户访问份额,谷歌旗下Gemini系列则以18%的占比位居第二,两者的市场份额差距仍在持续拉大。
OpenAI今年5月推出的GPT-4o,凭借实时音视频交互、极低的响应延迟获得了大量付费用户,截至2024年二季度,ChatGPT的付费订阅用户数已经突破2500万,而谷歌Gemini Advanced的付费用户数仅为其1/5左右。
第三方测试数据显示,GPT-4o在通用推理、多模态生成的20项主流测试中,平均得分领先Gemini Advanced约12个百分点,技术体验上的差距也让谷歌的AI生态吸引力持续落后于OpenAI。为了扭转这一劣势,谷歌过去半年已经投入超过30亿美元用于大模型的研发迭代,新版Gemini就是这轮投入的核心产出。
据行业知情人士透露,新版Gemini采用了优化后的MoE(混合专家模型)架构,参数量较当前的Gemini Advanced提升了近40%,同时大幅优化了边缘侧部署的效率,除了云端服务之外,还能在高端移动设备上本地运行更复杂的AI任务,比如实时多语言同声翻译、轻量化3D内容生成等。
新版Gemini的长上下文窗口最高支持到200万token,相当于一次可以处理近1500万字的文本内容,远超当前GPT-4o的128万token默认上下文窗口,对于需要处理长文档、大型代码库的专业用户来说,体验提升会非常明显。
业内预计谷歌会在今年10月的Made by Google硬件发布会上正式公开新版Gemini,同时将部分高级能力免费开放给所有谷歌账号用户,这也可能倒逼OpenAI调整ChatGPT的付费策略,让更多普通用户享受到更先进的AI服务。
从长期来看,大模型的性能竞赛已经从单纯的参数比拼转向“性能+落地场景”的综合竞争,拥有搜索、硬件、办公全场景生态的谷歌,和专注AI技术研发的OpenAI之间的博弈,还会持续推动整个行业的技术迭代,进一步降低生成式AI的使用门槛。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。