问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
法国AI初创企业Mistral AI于2026年6月23日正式推出全新文档识别模型OCR4,该模型覆盖10个语族共170种语言,在权威基准测试OmniDocBench中斩获93.07分,经人类评审验证其输出质量优于GPT 5.5 Pro、Gemini 3.1 Pro Preview等头部竞品,最低API调用定价为每千页2美元。

长期以来,光学字符识别(OCR)始终是企业数字化流程中的核心刚需环节,但过往通用大模型切入该场景时,往往面临小语种覆盖有限、结构化输出能力不足、调用成本过高等痛点,也给垂直专用模型留出了充足的市场空间。
作为欧洲头部AI初创企业,Mistral AI此前凭借多款高性价比通用大模型已经在全球市场站稳脚跟,本次推出的OCR4并未走大参数路线,而是定位为专注文档识别的轻量化专用模型。该模型支持10个语族共计170种语言,覆盖了全球绝大多数主流商用及小众语种,解决了跨境企业多语言文档处理的核心痛点。
在权威文档识别基准测试OmniDocBench中,OCR4拿到了93.07分的成绩,而在更贴近实际使用场景的人类评审环节,其输出准确性、格式还原度均超过GPT 5.5 Pro、Gemini 3.1 Pro Preview等头部通用大模型的OCR能力。
和通用大模型仅能输出识别文本不同,OCR4的配套能力更加适配企业级需求:在输出识别内容的同时,还可以同步提供文本边框定位、文档区域分类、识别结果置信度评分三类附加数据,无需二次处理即可直接接入下游工作流。目前OCR4已经支持RAG语义分块、智能体结构化数据输入、企业连接器内容结构化等多种下游场景,覆盖了文档数字化的绝大多数需求。
定价方面,OCR4的基础API调用价格为每千页4美元,选择批处理模式可享受50%折扣,折合每千页仅2美元,面向更高需求的文档AI专项服务定价为每千页5美元,相较头部厂商同类型服务价格低30%以上,对中小客户的吸引力十分明显。
随着AI商业化进入深水区,行业已经逐渐摆脱此前“唯参数论”的误区,客户更看重特定场景下的性能、成本与稳定性。垂直专用模型因为参数规模更小、推理成本更低、针对特定场景的优化程度更高,正在成为AI落地的主流方向之一。
本次Mistral AI推出OCR4,本质上也是头部大模型厂商从通用能力向垂直场景延伸的信号,未来会有更多针对单一任务优化的专用模型上线,进一步降低AI的使用门槛。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。