Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.040 — 2026-08-13
NEWS 约 1 分钟

150M模型专攻中日韩漫画OCR

hayai-ocr-v2以1.5亿参数专攻中日韩漫画文字,作者称更小、更快且识别更好。

IMAGE — r/LocalLLaMA 日榜

漫画里的字并不像文档那样整齐:对白可能竖排,拟声词压在画面上,还夹着对白框和复杂背景。hayai-ocr-v2就是为这种场景训练的OCR——把图片文字转成可搜索、复制和处理文本的工具,面向CJK,也就是中文、日文和韩文漫画。

它约有150M(1.5亿)个参数,规模不大。作者为它配了定制解码器和SigLIP2-NaFlex视觉编码器:前者负责生成文字序列,后者先把漫画图片转成机器可处理的特征。作者自述,它比PaddleOCR-VL-For-Manga更小、快十倍以上,识别表现也更好。这让它值得关注:专用小模型可能比体量更大的通用方案更适合漫画整理、翻译和数字化。不过,目前材料没有给出具体测试分数、硬件条件和完整数据集说明;作者还特别提醒,预训练与微调结果来自不同评测集,不能直接横向比较。


供稿材料 SOURCES — 1

← 返回 2026-08-13 · 开源板块