OCR エンジンは選択した言語モデルをブラウザ内で読み込んでから画像を解析します。画像内の文字に近い言語を選ぶと、名前、アクセント、かな、漢字などの出力が安定します。
くっきりした高コントラスト画像で、文字がまっすぐ写っているものほど良い結果になります。認識中も画像は端末内に残りますが、ぼやけた写真、傾いたスキャン、装飾的なフォントでは手作業での修正が必要になることがあります。