技術2026年1月20日(火)約4分VLMベースOCRの台頭 - DeepSeek-OCRとハイブリッド活用の可能性従来のOCRとVLM(Vision Language Model)ベースOCRの違いを解説。DeepSeek-OCRの紹介と、両者を組み合わせたハイブリッド手法の可能性を考察する。AIOCRDeepSeekVLM
技術2025年12月7日(日)約6分【OCR】2025年のウェブ実装の限界と知見まとめブラウザOCR、サーバーOCR、クラウドAPI、AIまで。日本語OCRをウェブで実装しようとして得た知見と各手法の限界をまとめるOCRJavaScriptTesseract.jsNDLOCRTransformers.jsAIDockerGoogle Cloud VisionPaddleOCR日本語OCRブラウザ実験
技術2025年12月6日(土)約2分@paddlejs-models/ocr はブラウザで動かない(2025年時点)PaddleOCRのJavaScript実装をブラウザで使おうとして失敗した記録JavaScriptOCRPaddleOCRトラブルシューティング実験
技術2025年12月1日(月)約3分NDLOCRの段組認識問題をヒストグラム解析で力技解決4段組縦書き書籍のOCRで、Layout Parserが使えずPyMuPDFとヒストグラム解析で段を切り出した話NDLOCROCRPythonPyMuPDF実験
技術2025年12月1日(月)約4分NDLOCR Docker イメージビルドの成功手順まとめNDLOCRのDockerイメージビルドでハマったポイントと解決策DockerNDLOCROCRWindowsAICUDA実験