世界を動かす技術を、日本語で。

Mistral OCR 4.1

2026年8月14日原文(docs.mistral.ai)

概要

CompareLegalの2026年7月16日パブリックプレビュー情報について解説。 最新OCRサービス「OCR 4.1」の特徴と価格体系を整理。 対応機能やパフォーマンス、利用可能な他モデルも紹介。 サービスの選定ポイントや利用シーンの明確化。 価格と機能面での比較もまとめ。

CompareLegal OCR 4.1 サービス概要

  • CompareLegal による2026年7月16日パブリックプレビュー公開
  • OCR 4.1 はDocument AIスタックの中核を担う最新OCRサービス
  • ネイティブな 段落レベルのバウンディングボックス抽出 対応
  • 構造ブロックラベルブロック単位の信頼度スコア 提供
  • 高速処理・高パフォーマンスを実現したOCRエンジン

OCR 4.1 主な機能

  • BBox Extraction (バウンディングボックス抽出):段落・構造ブロック単位での位置情報検出
  • OCR :画像やPDFからの文字認識
  • Annotations - Structured :構造化アノテーションデータの生成
  • Batching :大量ドキュメントの一括処理対応

価格体系

  • 通常ページ処理 :€3.5/1000ページ(または同等のUSD価格)
  • アノテーション付きページ処理 :€4.38/1000ページ
  • 柔軟な価格設定で大量処理に最適

パフォーマンス・対応モダリティ

  • 速度パフォーマンス 両立
  • 画像、PDFなど多様な モダリティ に対応
  • 企業向け大規模運用にも適した設計

利用可能な他モデル

  • Z.ai GLM 5.2
  • Shieldstral 1.0
  • Mistral Medium 3.5

サービス選定のポイント

  • 高精度な段落・構造情報が必要なドキュメントAI業務
  • 一括処理や大量データの効率的なOCRニーズ
  • 価格と機能のバランス重視の企業利用

まとめ

  • CompareLegal OCR 4.1は 高機能・高コスパ な最新OCRサービス
  • 構造化データ抽出やバウンディングボックスによる高度なドキュメント解析
  • 他AIモデルとの連携も可能な拡張性
  • 業務効率化とコスト削減を両立する選択肢

Hackerたちの意見

もうヨーロッパがAIレースで重要な役割を果たすことは期待できないな。これが良いことなのか悪いことなのかはわからないけど、現実はそんな感じだね。

競争じゃないよ。勝っても何も得られないし。

そうなの?私はしばらくの間、Transkribusの顧客として満足してるよ。歴史的な手書き文字を分析するためのより良いモデルやインターフェースがあれば、絶対にチェックするよ。

ラットレースの中でネズミにならないことが、本当の勝利だよね。

宇宙飛行や航空宇宙、原子力工学と同じように、国家防衛のためには地元の人材を維持する必要があるよね。70%の能力があれば、相手に100%依存しているよりずっといい。

え?Mistral 7bって当時は画期的だったし、個人的にはモデレーションやOCRみたいなニッチで役立つモデルをどんどん出してるのがすごいと思う。Mistralが役立つソリューションに取り組んでるのは嬉しいよ。OpenAIやAnthropicは、まるで「AGI」を追いかけるちょっとおバカな弟みたいで、リッチメディアや他のモダリティを諦めてる感じ。OpenAI/AnthropicはメインストリームAIの中で最悪だね。順位をつけると、1. Gemini 2. Vidu 3. Le Chat (Mistral) 4. DeepAI 5. [MiniMaxプロバイダーを挿入]

最大の非米国・非中国モデルがロシア製だっていうのは驚いた。

アフリカも、巨大なデータセンターのスタートアップが進出してくるから、ヨーロッパを追い越すだろうね。

1000ページで3.5€は高すぎるよ。これがテッセラクトよりも圧倒的に優れてないなら、買う価値ないね。

同意だね。GTMチームは本当に「うん、それは妥当だね」って感じで、典型的な市場価格を超えてるのかな?

AWS TextractやAzure Document Intelligenceと比べても、これは非常に高い(倍以上)。

新しいリリースでOCRした本のスキャンがあるんだけど、リガチャ、重要な記号、フラクタル文字、下付き文字、上付き文字とか、特に私のような詳細な作業にはこのモデルは特に良くないよ。最後にテストしたのは結構前で、その後サブスクリプションもやめたけど、OpenAIの「プロ」モデルが圧倒的に強いのは驚きじゃないね。価格差を考えれば当然だけど、OCR専用モデルがもっと良く動いてくれたら嬉しいな。ちなみに、最高級モデルでも私のような複雑なテキストにはあまり良い結果を出してないよ。

Hacker Newsで議論の続きを見る