Mistral OCR (25.05)

Mistral OCR (25.05) 是一款用于文档理解的光学字符识别 API。Mistral OCR (25.05) 擅长理解复杂的文档元素,包括交错的图像、数学表达式、表格和高级布局,例如 LaTeX 格式。该模型能够更深入地理解包含图表、图形、方程式和图形的科学论文等富文档。

Mistral OCR (25.05) 是一款理想的模型,可与将多模态文档(例如幻灯片或复杂的 PDF)作为输入的 RAG 系统搭配使用。

您可以将 Mistral OCR (25.05) 与其他 Mistral 模型搭配使用,以重新设置结果格式。这种组合可确保提取的内容不仅准确,而且以结构化且连贯的方式呈现,从而适用于各种下游应用和分析。

在 Model Garden 中查看模型卡片

模型 ID mistral-ocr-2505
发布阶段 GA
支持的输入和输出
  • 输入:
    文档
  • 输出:
    文本
使用类型
版本
  • Mistral OCR (25.05)
    • 发布阶段:正式版
    • 发布日期:2025 年 5 月 14 日
支持的区域

模型可用性

  • 美国
    • us-central1
  • 欧洲
    • europe-west4

机器学习处理

  • 美国
    • Multi-region
  • 欧洲
    • Multi-region
配额限制

us-central1:

  • QPM:30
  • 每个请求的页面数:30(1 页 = 100 万个输入 token 和 100 万个输出 token)
  • 上下文长度:30 页
  • 请求大小上限:对于流式传输为 30 MB,对于一元为 10 MB

europe-west4:

  • QPM:30
  • 每个请求的页面数:30(1 页 = 100 万个输入 token 和 100 万个输出 token)
  • 上下文长度:30 页
  • 请求大小上限:对于流式传输为 30 MB,对于一元为 10 MB

价格 请参阅价格。