2026-08-10

21:46:19

一日再OCRのテスト検証評価判断に費やしました。夕食の時間、とりあえず味噌汁の出汁に昆布を放り込んでからお米を研ぎます。んー、小松菜安かったから買ってたな、豚肉ある、しらすの釜揚げ、先日買ったレシピ本を見てゆずポン生姜焼きにします。アレンジで玉ねぎ、先に弱火でよく炒めます。生姜ひとかけらすって使い切ります。ぺこの受けはよくてご飯を食べきります。

21:08:24

再OCRの精度を上げるために色々足掻いてみます。登大遊さんの「DN_SuperBook_PDF_Converter」と同じ処理を施して試すテスト、コントラストを上げたり二値化したり倍の大きさにしたりフィルターかけたり。結果、32px相当まで文字拡大してスムージングだけ効きました。実測結果なので想像と違うけど受け入れて設計を進めます。人がいかにイメージと言うか印象で判断しようとするかを自分に突きつけられます。で、結果割と普通に読めるリフローePubが生成されてちょっと驚きます。YomiTokuよりVisionAPIやDocumentsAIの方が結果が良いのも実測結果です。YomiTokuでもそれなりにいけるけど、時代物はあきらめです。最初の頃のjisui2epubと比べると結構実用的になり始めています。まだまだだけど、とりあえずなんとか使えなくもないです。