Mistral OCR (25.05)

Mistral OCR (25.05) ist eine API zur optischen Zeichenerkennung für das Dokumentverständnis. Mistral OCR (25.05) kann komplexe Dokumentelemente wie verschachtelte Bilder, mathematische Ausdrücke, Tabellen und erweiterte Layouts wie LaTeX-Formatierung besonders gut erkennen. Das Modell ermöglicht ein besseres Verständnis von umfangreichen Dokumenten wie wissenschaftlichen Arbeiten mit Diagrammen, Grafiken, Gleichungen und Abbildungen.

Mistral OCR (25.05) ist ein ideales Modell für die Verwendung in Kombination mit einem RAG-System, das multimodale Dokumente (z. B. Folien oder komplexe PDFs) als Eingabe verwendet.

Sie können Mistral OCR (25.05) mit anderen Mistral-Modellen kombinieren, um die Ergebnisse neu zu formatieren. Diese Kombination sorgt dafür, dass die extrahierten Inhalte nicht nur korrekt, sondern auch strukturiert und kohärent präsentiert werden, sodass sie für verschiedene Downstream-Anwendungen und Analysen geeignet sind.

Modellkarte in Model Garden ansehen

Modell-ID mistral-ocr-2505
Startphase GA
Unterstützte Ein- und Ausgaben
  • Eingaben:
    Dokumente
  • Ausgaben:
    Text
Nutzungstypen
Versionen
  • Mistral OCR (25.05)
    • Einführungsphase: GA
    • Veröffentlichungsdatum:14. Mai 2025
Unterstützte Regionen

Modellverfügbarkeit

  • USA
    • us-central1
  • Europa
    • europe-west4

ML-Verarbeitung

  • USA
    • Multi-region
  • Europa
    • Multi-region
Kontingentlimits

us-central1:

  • QPM: 30
  • Seiten pro Anfrage: 30 (1 Seite = 1 Million Eingabetokens und 1 Million Ausgabetokens)
  • Kontextlänge: 30 Seiten
  • Maximale Anfragesgröße: 30 MB für Streaming, 10 MB für Unary

europe-west4:

  • QPM: 30
  • Seiten pro Anfrage: 30 (1 Seite = 1 Million Eingabetokens und 1 Million Ausgabetokens)
  • Kontextlänge: 30 Seiten
  • Maximale Anfragesgröße: 30 MB für Streaming, 10 MB für Unary

Preise Weitere Informationen finden Sie unter Preise.