Mistral OCR 4 简调
Mistral 的文档理解模型,输出文本、位置框、区块类别和置信度,面向企业检索与文档自动化。
Mistral OCR 4 ocr document-intelligence rag enterprise-search Mistral 的文档理解模型,输出文本、位置框、区块类别和置信度,面向企业检索与文档自动化。
Mistral OCR 4
1. 调研缘由
Mistral OCR 4 在 2026 年 6 月发布,代表 OCR 产品从“转成文字”转向输出可供检索、引用和人工复核的结构化文档数据。[S1]
2. 简介与产品工作流
OCR 4 可处理 PDF、DOC、PPT 和 OpenDocument 等企业文档,输出抽取文本、bounding boxes、区块类别和内联置信度。开发者可经 API 调用,或通过 Mistral Studio 的 Document AI 使用同一引擎。[S1]
典型流程是上传文档,取得结构化区块与位置/置信度,再送入检索、字段抽取或人工复核流程。[S1]
3. 团队与资本背景
OCR 4 由 Mistral AI 发布,属于其文档理解与企业搜索产品线,不是独立融资项目。[S1]
4. 技术基础与生态位
官方称 OCR 4 支持 170 种语言、可在单个容器中自托管,并是 Mistral Search Toolkit 的摄取组件。[S1]
它位于文档理解和检索基础设施层;公开页未披露完整模型参数与训练数据,本文不作推断。
5. 市场与外部信号
官方列出的 API 价格为每千页 4 美元,Batch API 折后为每千页 2 美元,Document AI 为每千页 5 美元。[S1]
6. 公开评价与主要分歧
正面评价(官方): 官方报告其在人类偏好测试和 OlmOCRBench 中的表现,并同时说明自动基准存在标注与字符串比对局限。[S1]
主要批评/质疑(独立来源): 本次未纳入第三方复现,官方评测不应代替本地文档集测试。
存在分歧之处: 自托管可降低数据出域风险,但企业可用性与价格仍需按销售与部署条件确认。[S1]
7. 同类对比(与头部/高知名度同类项目)
主要对标项目: Mistral OCR 3、通用多模态模型、企业 Document AI 服务。
| 维度 | OCR 4 | 通用多模态模型 | 企业 Document AI |
|---|---|---|---|
| 输出 | 文本、位置框、区块类别、置信度。[S1] | 视产品而定。 | 视产品而定。 |
| 部署 | API、Document AI、自托管。[S1] | 多为 API。 | 多为云端或私有部署。 |
| 主要用途 | 文档摄取、RAG、结构化流程。[S1] | 通用理解。 | 文档处理。 |
8. 信息缺口与后续观察
- 复杂版式、低资源语言和表格的实际误差率需在自有文档上测试。
- 自托管的硬件与企业合同边界未在发布页完整公开。
9. 归纳洞察 ★
OCR 4 把位置、类别和置信度一起返回,说明企业文档自动化更需要可追溯的中间数据,而不只是干净文本。
10. 来源与更新时间
- 信息截至(as_of): 2026-07-31
- 最后复查(last_checked): 2026-07-31
- 最后更新(last_updated): null
可追溯来源
- [S1]Tier1Mistral AI:Introducing OCR 4访问日期:2026-07-31