模型

Mistral OCR 4 简调

Mistral 的文档理解模型,输出文本、位置框、区块类别和置信度,面向企业检索与文档自动化。

Mistral OCR 4 ocr document-intelligence rag enterprise-search Mistral 的文档理解模型,输出文本、位置框、区块类别和置信度,面向企业检索与文档自动化。

Frontmatter

结构化元信息

实体类型
模型
主分类
模型
产品状态
已上线
开放状态
部分开源
产品形态
modelapisaas
能力标签
多模态文本检索
目标用户
开发者企业
交付方式
API自托管私有化部署
区域
europe
模型策略
自研专用模型
部署方式
API、Document AI 与企业自托管
技术披露
有限公开
是否实测
未测试
融资阶段
not-applicable
信息截至
2026-07-31
最后复查
2026-07-31

Mistral OCR 4

1. 调研缘由

Mistral OCR 4 在 2026 年 6 月发布,代表 OCR 产品从“转成文字”转向输出可供检索、引用和人工复核的结构化文档数据。[S1]

2. 简介与产品工作流

OCR 4 可处理 PDF、DOC、PPT 和 OpenDocument 等企业文档,输出抽取文本、bounding boxes、区块类别和内联置信度。开发者可经 API 调用,或通过 Mistral Studio 的 Document AI 使用同一引擎。[S1]

典型流程是上传文档,取得结构化区块与位置/置信度,再送入检索、字段抽取或人工复核流程。[S1]

3. 团队与资本背景

OCR 4 由 Mistral AI 发布,属于其文档理解与企业搜索产品线,不是独立融资项目。[S1]

4. 技术基础与生态位

官方称 OCR 4 支持 170 种语言、可在单个容器中自托管,并是 Mistral Search Toolkit 的摄取组件。[S1]

它位于文档理解和检索基础设施层;公开页未披露完整模型参数与训练数据,本文不作推断。

5. 市场与外部信号

官方列出的 API 价格为每千页 4 美元,Batch API 折后为每千页 2 美元,Document AI 为每千页 5 美元。[S1]

6. 公开评价与主要分歧

正面评价(官方): 官方报告其在人类偏好测试和 OlmOCRBench 中的表现,并同时说明自动基准存在标注与字符串比对局限。[S1]

主要批评/质疑(独立来源): 本次未纳入第三方复现,官方评测不应代替本地文档集测试。

存在分歧之处: 自托管可降低数据出域风险,但企业可用性与价格仍需按销售与部署条件确认。[S1]

7. 同类对比(与头部/高知名度同类项目)

主要对标项目: Mistral OCR 3、通用多模态模型、企业 Document AI 服务。

维度OCR 4通用多模态模型企业 Document AI
输出文本、位置框、区块类别、置信度。[S1]视产品而定。视产品而定。
部署API、Document AI、自托管。[S1]多为 API。多为云端或私有部署。
主要用途文档摄取、RAG、结构化流程。[S1]通用理解。文档处理。

8. 信息缺口与后续观察

  • 复杂版式、低资源语言和表格的实际误差率需在自有文档上测试。
  • 自托管的硬件与企业合同边界未在发布页完整公开。

9. 归纳洞察 ★

OCR 4 把位置、类别和置信度一起返回,说明企业文档自动化更需要可追溯的中间数据,而不只是干净文本。

10. 来源与更新时间

  • 信息截至(as_of): 2026-07-31
  • 最后复查(last_checked): 2026-07-31
  • 最后更新(last_updated): null
来源索引

可追溯来源

  1. [S1]Tier1Mistral AI:Introducing OCR 4访问日期:2026-07-31