ソース読んでみたけど、一発で出力のdpi設定できなさそう。
canvasの設定で、ちゃんと換算して設定しないとだめっぽ。githubにissue立てるか、
Twitterアカウントに突撃して報告したら直してくれそうではある。
reportlab.pdfgen の Canvasを使ってるみたいだけど、このライブラリは72dpi前提で
簡単には変わらないっぽい。画像のサイズの方をPixelから実サイズに調整する必要があって
けっこうめんどくさそう。
後から変換するソフトとか(あれば)調整した方が早そう
探検
【文字認識】OCRソフト(3文字目)【 自炊 】
698名無しさん@お腹いっぱい。
2025/12/15(月) 13:40:14.61ID:HkUrNMAy02025/12/15(月) 18:23:34.34ID:i7n4OxSM0
詳しくありがとうございます。私には難しそうなので、印刷する必要がある場合はどうなるのか考えて継続して使えるか検討してみます。縮小印刷したら普通に印刷できそうな気もする。
bunkoOCRならこういう問題は生じないと思うので、必要あればiPad airでOCRも検討です。遅いし電池が減るけど、、、。Windowsの新版に期待。
bunkoOCRならこういう問題は生じないと思うので、必要あればiPad airでOCRも検討です。遅いし電池が減るけど、、、。Windowsの新版に期待。
2025/12/16(火) 05:20:20.23ID:hS1pgzP70
2025/12/24(水) 11:13:31.85ID:7/TyzqGE0
それによるとdots ocrとQwen 8Bが優秀ってことかな
702名無しさん@お腹いっぱい。
2025/12/25(木) 09:58:36.11ID:TOqZu5lG0 初見。OCRソフトが欲しい。アドバイス下さい。
・紙の本を電子化してOCRを掛けるのが主目的。理系学術書(従って数式多数)が過半数。他はPC関係の図表の多い書籍。
・現状、Acrobat 9を使っている。文章のレイアウトがちょっとでも非定型となると即座に精度悪化。数式なんておよそ認識しない。
・Amazonで読取革命v17が7870円だったが、★2.9。ソースネクストでFineReader v15が27500円。Acrobat最新版は高すぎ。
・紙の本を電子化してOCRを掛けるのが主目的。理系学術書(従って数式多数)が過半数。他はPC関係の図表の多い書籍。
・現状、Acrobat 9を使っている。文章のレイアウトがちょっとでも非定型となると即座に精度悪化。数式なんておよそ認識しない。
・Amazonで読取革命v17が7870円だったが、★2.9。ソースネクストでFineReader v15が27500円。Acrobat最新版は高すぎ。
703名無しさん@お腹いっぱい。
2025/12/25(木) 10:24:38.64ID:KlbY4T//0 読取革命はマジでクソゴミだからやめとけ
704名無しさん@お腹いっぱい。
2025/12/25(木) 11:29:51.80ID:ac9LOP4P0 Thanks 質問者と別人だけど
705名無しさん@お腹いっぱい。
2025/12/25(木) 18:33:25.03ID:3uDKEtEP0 数式をTeXで認識したいとかなら、なんかモデルあったはず。
それとは別に図版多いならYomitokuが強かったような
それとは別に図版多いならYomitokuが強かったような
706名無しさん@お腹いっぱい。
2025/12/25(木) 18:36:31.31ID:3uDKEtEP0 数式混じりの日本語の本で、図版入っているやつ
私もスキャンしてOCRしたいんだけど、最終形態としてどうするのがいいんだろうか。
単なるテキストにすると、数式辛いし図版飛ぶし
図だけjpgで持っとくとしても、どの部分に入ってたかとかmdにするとかかなぁ
数式はTeX形式にするとしても、ふつうの人間はそのままで読めないという
結局レンダリングするなら、画像でよくねとかも思う
私もスキャンしてOCRしたいんだけど、最終形態としてどうするのがいいんだろうか。
単なるテキストにすると、数式辛いし図版飛ぶし
図だけjpgで持っとくとしても、どの部分に入ってたかとかmdにするとかかなぁ
数式はTeX形式にするとしても、ふつうの人間はそのままで読めないという
結局レンダリングするなら、画像でよくねとかも思う
2025/12/25(木) 19:36:32.32ID:TlC6gcR80
2025/12/26(金) 07:03:25.73ID:xqkq3/EC0
bunkoocrのwindows板って最新になってないんだっけ?
iosでやれってことか
iosでやれってことか
709名無しさん@お腹いっぱい。
2025/12/26(金) 19:06:20.17ID:d42PNyW00 ごめんまだwindowsのやつ作業できてない。お正月に作業してみるわ
2025/12/27(土) 00:21:40.07ID:assWHIWY0
>>709
楽しみにしてます
楽しみにしてます
711名無しさん@お腹いっぱい。
2026/01/07(水) 21:39:31.93ID:Uui5N1w20 bunkoOCR、雑誌記事とか順番がややこしくなくても、単純な段組の小説でも何故か文章の順番がめちゃくちゃになることがあるなあ
どうも章番号があるところで変な処理がががる感じがする
アラビア数字だと何があるんだろうか?
単純に右から処理してくれるだけでいいんだが、どうすりゃいいんだろ
どうも章番号があるところで変な処理がががる感じがする
アラビア数字だと何があるんだろうか?
単純に右から処理してくれるだけでいいんだが、どうすりゃいいんだろ
712名無しさん@お腹いっぱい。
2026/01/07(水) 21:40:00.55ID:Uui5N1w20 >>711
ios版ね
ios版ね
713名無しさん@お腹いっぱい。
2026/01/07(水) 23:01:26.10ID:01gd07n90 気付いたので、今直してるところです。
単純に右からでいいんですけど、いろいろとややこしい処理になってるのが敗因
正月休みは、「なんの進捗もありませんでしたーーー!!」だったので、もうちょいかかりそう
単純に右からでいいんですけど、いろいろとややこしい処理になってるのが敗因
正月休みは、「なんの進捗もありませんでしたーーー!!」だったので、もうちょいかかりそう
714名無しさん@お腹いっぱい。
2026/01/08(木) 22:27:36.76ID:uq55VzS50 >>713
ありがとうございます。
精度の高さが商用の製品と比べても段違いなのでとても重宝しています。
パラメータを色々いじってみてたのですが上手くいかなかったので、アップデートしていただけるのは助かります。
忙しいと思いますが、よろしくお願いします。
ありがとうございます。
精度の高さが商用の製品と比べても段違いなのでとても重宝しています。
パラメータを色々いじってみてたのですが上手くいかなかったので、アップデートしていただけるのは助かります。
忙しいと思いますが、よろしくお願いします。
レスを投稿する
ニュース
- 【日中】中国「民生利用は影響受けない」 “輸出規制強化” めぐり…日本企業には依然不安の声 ★2 [煮卵★]
- アメリカでサッカー人気が加速…野球を上回って同国3番目の人気スポーツに [王子★]
- 【警視庁】15歳少女のアダルトビデオを撮影・販売 イベント会社社長を逮捕 GACKTさんファンクラブ運営も [鉄チーズ烏★]
- 米国ホワイトハウス声明 「中国とロシアを排除する」 グリーンランド領有について説明 ★2 [お断り★]
- 中国籍48歳男がファストフード店で店員にヘッドロック、暴行加える…2階席が利用できないことに激高し暴言吐き大暴れ [七波羅探題★]
- 【カーリング】ロコ・ソラーレに相手が注意「それはダメでしょ!」 試合中にチクリ「二度とやらないで」 [muffin★]
- "あ"と打って「愛」や「ありがとう」が予測変換で出る人は豊かな人生を送ってるらしいww
- 【朗報】グリーンランドの住民、1600万円貰ってアメリカ人になるwwwwwwwwwwww [455031798]
- 夜🌃のまったり進行おじゃる丸🎎実況スレ🏡
- 【ガンプラ】ジークアクス見て面白かったから人生初のガンプラ作る!
- 白人女性「美形です。デカパイです。」→これに興奮できない理由 [569712471]
- 【悲報】ホロライブ・さくらみこ、グリーンチャンネル(有料)復唱について声明を発表
