该模型于6月23日在OmniDocBench测试中获93.07分,提供边框与置信度输出,基础API定价为每千页4美元。
法国人工智能初创企业Mistral AI于当地时间6月23日正式推出OCR 4文档内容识别模型。该模型专为文档处理场景设计,具备横跨10个语族的170种语言支持能力。在权威基准测试OmniDocBench中,其表现取得93.07分的成绩,输出结果在人类评估环节显示优于GPT 5.5 Pro及Gemini 3.1 Pro Preview等同类竞品。这一发布标志着该企业在垂直领域模型开发上取得了具体进展。
OCR 4被定义为小型且聚焦的架构,旨在平衡效率与功能。除常规文本提取外,模型输出包含边框坐标、区域分类标签以及置信度评分,这些数据可直接服务于下游任务处理。其设计目标涵盖RAG语义分块、智能体结构化基本单元构建以及连接器结构化内容生成等应用场景。通过提供结构化的中间数据,该模型试图降低开发者在文档解析流程中的二次加工成本。
在市场定价策略上,Mistral AI设定了基础API调用费用为每千页4美元。针对批量处理需求,系统提供50%的费率优惠。此外,针对更广泛的文档人工智能服务,定价标准为每千页5美元。作为欧洲AI领域的代表性企业,Mistral AI此前已建立开源与闭源并行的产品体系。此次OCR 4的推出将其业务版图从通用大语言模型延伸至文档智能处理赛道,使其在基础工具层直接与OpenAI、Google等国际科技巨头展开竞争,反映出行业对高精度、低成本文档解析技术的持续需求。