Intelligence OCR — 画像からのIOC抽出
画像、スクリーンショット、PDFを対象とした多言語OCRです。IOCに特化した固有表現抽出(NER)により、ドメイン、IP、ハッシュ、BTC/ETHアドレス、CPF(ブラジルの個人納税者番号)を取り出します。
概要
抽出したエンティティは正規化のうえインデックス化され、検索、グラフ上での相関分析、アラートにそのまま利用できます。
主な機能
- 180以上の言語に対応
- IOCに特化した固有表現抽出
- 全文インデックス
- 抽出結果の確信度スコア
- バウンディングボックスのエクスポート
ユースケース
- フォーラムのスクリーンショットからIOCを抽出する
- レポートPDFをインデックス化する
- Telegramのキャプチャ画像を分析する
- 画像を対象としたOSINT
連携
- Tesseract、Google Vision、Azure CV
- STIX 2.1形式でのエクスポート
SLA・保証
ページ単位で即時OCR