【文字認識】OCRソフト(3文字目)【 自炊 】

702名無しさん@お腹いっぱい。
垢版 |
2025/12/25(木) 09:58:36.11ID:TOqZu5lG0
初見。OCRソフトが欲しい。アドバイス下さい。

・紙の本を電子化してOCRを掛けるのが主目的。理系学術書(従って数式多数)が過半数。他はPC関係の図表の多い書籍。
・現状、Acrobat 9を使っている。文章のレイアウトがちょっとでも非定型となると即座に精度悪化。数式なんておよそ認識しない。
・Amazonで読取革命v17が7870円だったが、★2.9。ソースネクストでFineReader v15が27500円。Acrobat最新版は高すぎ。
703名無しさん@お腹いっぱい。
垢版 |
2025/12/25(木) 10:24:38.64ID:KlbY4T//0
読取革命はマジでクソゴミだからやめとけ
704名無しさん@お腹いっぱい。
垢版 |
2025/12/25(木) 11:29:51.80ID:ac9LOP4P0
Thanks 質問者と別人だけど
705名無しさん@お腹いっぱい。
垢版 |
2025/12/25(木) 18:33:25.03ID:3uDKEtEP0
数式をTeXで認識したいとかなら、なんかモデルあったはず。
それとは別に図版多いならYomitokuが強かったような
706名無しさん@お腹いっぱい。
垢版 |
2025/12/25(木) 18:36:31.31ID:3uDKEtEP0
数式混じりの日本語の本で、図版入っているやつ
私もスキャンしてOCRしたいんだけど、最終形態としてどうするのがいいんだろうか。
単なるテキストにすると、数式辛いし図版飛ぶし
図だけjpgで持っとくとしても、どの部分に入ってたかとかmdにするとかかなぁ
数式はTeX形式にするとしても、ふつうの人間はそのままで読めないという
結局レンダリングするなら、画像でよくねとかも思う
2025/12/25(木) 19:36:32.32ID:TlC6gcR80
画像と透明テキストのpdfはどうかな
>>625~のbunkoOCRのpdf作成に期待してる
図表や数式を誤OCRしてても目で見る分には正しい画像だから問題ない気がする
レスを投稿する

16歳の水野カイトが封印の刀を見つけ、時間が裂けて黒い風と亡霊の侍が現れ、霊の時雨と契約して呪われた刀の継承者となる場面

ニューススポーツなんでも実況