>>673
画像の部分だけを処理したい場合は、「PDFから画像を抽出する」の方を選んで
画像の部分だけを処理して、エクスポートのボタンから
「全てのページ」「PDF(元の画像を保持する、ふりがなを無視する)」で出力すると
テキストで元々ある部分はそのままにされて、画像の部分にだけ透明テキスト埋め込みになるはずです。
Windows版に反映しようとしている途中に、ロジックにバグが見つかり
直している途中で、別のタスクが割り込んできてちょっと時間が取れていません。
お待たせして申し訳ない。
探検
【文字認識】OCRソフト(3文字目)【 自炊 】
674名無しさん@お腹いっぱい。
2025/10/18(土) 01:32:44.93ID:sL8FEi0V0675名無しさん@お腹いっぱい。
2025/10/18(土) 01:35:17.01ID:sL8FEi0V0 並列度はわざと落として、iPadとかでkillされないように調整してたのを元に戻すの忘れてますね。
次いじるときに調整できるようにするか、もっと並列度あげておきます。
次いじるときに調整できるようにするか、もっと並列度あげておきます。
676名無しさん@お腹いっぱい。
2025/10/21(火) 19:15:01.75ID:oUl8PwmQ0 いくつか試したのでレポ
DeepSeek OCR
一応日本語読める。いくつかのサンプルで試したところ、画像によっては途中でLLMが崩壊してしまうこともある。
英語は精度よさそうだけど、日本語の精度はちょいちょいミスがある感じがする。
dots.ocr
日本語も対応してて精度も良いんだけど、LLMに起因する「嘘」が時々混じるのが残念ポイント
少々の誤差を許容できるなら、精度よさそうでいい感じ
DeepSeek OCR
一応日本語読める。いくつかのサンプルで試したところ、画像によっては途中でLLMが崩壊してしまうこともある。
英語は精度よさそうだけど、日本語の精度はちょいちょいミスがある感じがする。
dots.ocr
日本語も対応してて精度も良いんだけど、LLMに起因する「嘘」が時々混じるのが残念ポイント
少々の誤差を許容できるなら、精度よさそうでいい感じ
2025/10/21(火) 21:09:05.68ID:4p/wAbxG0
bunkoOCRやyomitokuとどっちが精度が高いのよ
それが問題だ
PaddleOCRも新しいの出したよね
特化型vsリソース食いのごり押しVLMの戦い
それが問題だ
PaddleOCRも新しいの出したよね
特化型vsリソース食いのごり押しVLMの戦い
678名無しさん@お腹いっぱい。
2025/10/22(水) 00:35:00.94ID:Q8EWz51f0 PaddleOCR
日本語の縦書きで試してみた。
合っているところはほぼ合ってるけど、なぜか認識に失敗しているところが所々ある。
認識結果が所々飛ぶイメージ。ふりがなは律儀に認識してるけど、多分座標で自前で何とかしないとだめっぽ。
認識結果は失敗の出方に特性があって評価が難しいけど、独断と偏見でいうと
dots.ocr > PaddleOCR > DeepSeek OCR
の順に精度がよさそう。ただし、自前で環境構築するのはどれもちょい面倒。
Dockerイメージあるならそれ使った方が楽できる。
なお、独断と偏見によるとbunkoOCRやyomitokuの方が日本語性能はずっと高そう。
多言語対応すると、個別の性能はチューンされきってない感じがしますね。
日本語の縦書きで試してみた。
合っているところはほぼ合ってるけど、なぜか認識に失敗しているところが所々ある。
認識結果が所々飛ぶイメージ。ふりがなは律儀に認識してるけど、多分座標で自前で何とかしないとだめっぽ。
認識結果は失敗の出方に特性があって評価が難しいけど、独断と偏見でいうと
dots.ocr > PaddleOCR > DeepSeek OCR
の順に精度がよさそう。ただし、自前で環境構築するのはどれもちょい面倒。
Dockerイメージあるならそれ使った方が楽できる。
なお、独断と偏見によるとbunkoOCRやyomitokuの方が日本語性能はずっと高そう。
多言語対応すると、個別の性能はチューンされきってない感じがしますね。
2025/10/22(水) 10:45:15.53ID:QmjHWyGj0
参考になった。ありがとう
今DoclingやVLM OCRとか流行りだけど期待のDeepseek OCRしょぼーんやな
ローカルLLMとかも性能向上そろそろ限界かな
今DoclingやVLM OCRとか流行りだけど期待のDeepseek OCRしょぼーんやな
ローカルLLMとかも性能向上そろそろ限界かな
2025/10/22(水) 19:38:07.66ID:YZI2zzo60
精度90%って高そうだけど10文字に1文字はずっこけるってことだから使えんよな
95%は20文字に1文字はずっこけ これもきっつ
98%は50文字に1文字はずっこけ ここら辺になると実用的やな
95%は20文字に1文字はずっこけ これもきっつ
98%は50文字に1文字はずっこけ ここら辺になると実用的やな
681名無しさん@お腹いっぱい。
2025/10/22(水) 22:11:37.43ID:q0StTNJ80 もう全部DeepSeekOCRでいいや
bunko も yomitoku もバイバイ
bunko も yomitoku もバイバイ
682名無しさん@お腹いっぱい。
2025/10/23(木) 18:57:28.03ID:zLYIM62O0 DeepSeek 中国製だから漢字圏では勝ってしまう可能性大有り
683名無しさん@お腹いっぱい。
2025/10/23(木) 22:55:35.97ID:Sj2lpXBu0 >>682
なお字体
なお字体
2025/10/23(木) 23:59:05.09ID:F491YrjO0
依然としてbunkoOCRがトップ
685名無しさん@お腹いっぱい。
2025/10/24(金) 06:27:27.27ID:Cv7etXwJ0 欧米製:Tesseract、EasyOCR
中国製:dots.ocr、PaddleOCR、DeepSeek OCR
日本製:bunkoOCR、yomitoku、NDL OCR
フリーのOCRをまとめてみたが実行・利用するにはプログラミング知識(可能ならGPUも)が必須なのが多い印象
フロントエンドができればTesseractやbunkoOCR以外も少しは普及しそう
中国製:dots.ocr、PaddleOCR、DeepSeek OCR
日本製:bunkoOCR、yomitoku、NDL OCR
フリーのOCRをまとめてみたが実行・利用するにはプログラミング知識(可能ならGPUも)が必須なのが多い印象
フロントエンドができればTesseractやbunkoOCR以外も少しは普及しそう
2025/10/24(金) 06:59:00.70ID:5Fw7+vc80
日本製は日本語だけ?
せねて、英語やフランス語とか西洋だけでもいけるといい
せねて、英語やフランス語とか西洋だけでもいけるといい
2025/10/24(金) 07:00:55.18ID:5Fw7+vc80
まか、日本製はモデルサイズが圧倒的に小さくて日本語性能優秀ってのが特徴であるが
2025/10/29(水) 10:41:12.98ID:kULpbrQP0
pythonとかわかんね。これならdeepseek ocr簡単に使えるの? https://github.com/TimmyOVO/deepseek-ocr.rs https://egg.5ch.net/test/read.cgi/software/1711002779/l50
689名無しさん@お腹いっぱい。
2025/11/03(月) 03:43:04.79ID:xDQZqNcO0 DeepSeek-OCRはvLLM版じゃないと本気出してくれなさそう
ってことらしい。また試すか
ってことらしい。また試すか
690名無しさん@お腹いっぱい。
2025/11/06(木) 06:29:20.69ID:RXGQOp/A0 YomiTokuがCPUでも高速に動くように進化したらしい
2025/11/16(日) 19:48:56.44ID:UMKxDmno0
bunkoOCRで三桁の数字がバラバラになってしまうのが結構あった
123が132や231になったり二桁や四桁は問題ないけど
123が132や231になったり二桁や四桁は問題ないけど
692名無しさん@お腹いっぱい。
2025/11/16(日) 20:13:58.10ID:+ptPvWyC0 なんで3桁だけなんやろ
ちょっとテストしてみるわ。よければサンプルいただけますか
ちょっとテストしてみるわ。よければサンプルいただけますか
2025/11/16(日) 20:32:03.06ID:UMKxDmno0
>>544のとこに送っておきました
694名無しさん@お腹いっぱい。
2025/11/16(日) 21:08:13.64ID:+ptPvWyC0 >>693
ありがとうございます。
手元の最新の開発中バージョンでは、101のところが上手くいっているみたいなので、早くリリースできるようにします。
割注と縦中横の判定をいじって上手くいくようになった気がする
ありがとうございます。
手元の最新の開発中バージョンでは、101のところが上手くいっているみたいなので、早くリリースできるようにします。
割注と縦中横の判定をいじって上手くいくようになった気がする
2025/12/13(土) 21:24:20.24ID:CooDqDh20
yomitokuでpdfファイル入力、PDF出力したら、17.5 x 24.5 cm, 400 dpiが、97.3 x 136 cm, 72 dpiになった。ディスプレイで見るぶんには問題ないが、やや気持ち悪い。仕様でしょうか?
696名無しさん@お腹いっぱい。
2025/12/15(月) 00:19:00.46ID:HkUrNMAy0 使ってるライブラリの、デフォルトdpiが72なんだと思う。ソースのdpiを引き継ぐようにすればよさそう
2025/12/15(月) 13:09:53.21ID:i7n4OxSM0
読み取り解像度は指定できるけど、ソースのdpiが引き継げそうなやり方はなさそう?に思いました。
698名無しさん@お腹いっぱい。
2025/12/15(月) 13:40:14.61ID:HkUrNMAy0 ソース読んでみたけど、一発で出力のdpi設定できなさそう。
canvasの設定で、ちゃんと換算して設定しないとだめっぽ。githubにissue立てるか、
Twitterアカウントに突撃して報告したら直してくれそうではある。
reportlab.pdfgen の Canvasを使ってるみたいだけど、このライブラリは72dpi前提で
簡単には変わらないっぽい。画像のサイズの方をPixelから実サイズに調整する必要があって
けっこうめんどくさそう。
後から変換するソフトとか(あれば)調整した方が早そう
canvasの設定で、ちゃんと換算して設定しないとだめっぽ。githubにissue立てるか、
Twitterアカウントに突撃して報告したら直してくれそうではある。
reportlab.pdfgen の Canvasを使ってるみたいだけど、このライブラリは72dpi前提で
簡単には変わらないっぽい。画像のサイズの方をPixelから実サイズに調整する必要があって
けっこうめんどくさそう。
後から変換するソフトとか(あれば)調整した方が早そう
2025/12/15(月) 18:23:34.34ID:i7n4OxSM0
詳しくありがとうございます。私には難しそうなので、印刷する必要がある場合はどうなるのか考えて継続して使えるか検討してみます。縮小印刷したら普通に印刷できそうな気もする。
bunkoOCRならこういう問題は生じないと思うので、必要あればiPad airでOCRも検討です。遅いし電池が減るけど、、、。Windowsの新版に期待。
bunkoOCRならこういう問題は生じないと思うので、必要あればiPad airでOCRも検討です。遅いし電池が減るけど、、、。Windowsの新版に期待。
2025/12/16(火) 05:20:20.23ID:hS1pgzP70
2025/12/24(水) 11:13:31.85ID:7/TyzqGE0
それによるとdots ocrとQwen 8Bが優秀ってことかな
702名無しさん@お腹いっぱい。
2025/12/25(木) 09:58:36.11ID:TOqZu5lG0 初見。OCRソフトが欲しい。アドバイス下さい。
・紙の本を電子化してOCRを掛けるのが主目的。理系学術書(従って数式多数)が過半数。他はPC関係の図表の多い書籍。
・現状、Acrobat 9を使っている。文章のレイアウトがちょっとでも非定型となると即座に精度悪化。数式なんておよそ認識しない。
・Amazonで読取革命v17が7870円だったが、★2.9。ソースネクストでFineReader v15が27500円。Acrobat最新版は高すぎ。
・紙の本を電子化してOCRを掛けるのが主目的。理系学術書(従って数式多数)が過半数。他はPC関係の図表の多い書籍。
・現状、Acrobat 9を使っている。文章のレイアウトがちょっとでも非定型となると即座に精度悪化。数式なんておよそ認識しない。
・Amazonで読取革命v17が7870円だったが、★2.9。ソースネクストでFineReader v15が27500円。Acrobat最新版は高すぎ。
703名無しさん@お腹いっぱい。
2025/12/25(木) 10:24:38.64ID:KlbY4T//0 読取革命はマジでクソゴミだからやめとけ
704名無しさん@お腹いっぱい。
2025/12/25(木) 11:29:51.80ID:ac9LOP4P0 Thanks 質問者と別人だけど
レスを投稿する
ニュース
- 【おこめ】「新米5キロ3000円台」の衝撃…迫りくるコメ価格「暴落のXデー」、関係者が危険視する“3つのタイミング”とは? [ぐれ★]
- 首を折られた豊臣秀吉像 愛媛県警の警察官らが関与か 出張で愛知を訪れる 容疑固まり次第、書類送検へ [ポンコツ★]
- 【おこめ】「新米5キロ3000円台」の衝撃…迫りくるコメ価格「暴落のXデー」、関係者が危険視する“3つのタイミング”とは? ★2 [ぐれ★]
- 【文春】《本人直撃》「日本は核保有すべき」発言をしたのは“核軍縮担当”の首相補佐官だった! 高市首相が更迭しない理由は… ★3 [少考さん★]
- 【野球】藤浪晋太郎「仏教、神道系が95%の日本人がXmasで浮かれてんじゃねぇよ」「孤独な日本男児の皆さん」 恒例行事にファン好感 [冬月記者★]
- 男性の死因は「出血性ショック」室内では空気清浄機が稼働 母親の交際相手か…西東京市の母子4人死亡との関連は [夜のけいちゃん★]
- 【高市悲報】ヤフコメ、ついに「日本は核保有すべき」というコメントばかりになってしまう… [314039747]
- 【三重】???「岸田ぁ!(パァン」県警「書類送検!」地検「不起訴」 [696684471]
- 【悲報】維新議員国保逃れ、自民幹部「自民党の中にもいる、政治家がでたらめをやっているとばれたら政局になりかねない」 [115996789]
- __ロサンゼルス教員組合、イスラエルへの武器供与に賛成した議員を支持しない [827565401]
- 無職転生って下ネタさえ無ければフリーレン級の国民的アニメになってたよな [858219337]
- アニソンで売れたバンド
