#44 · 主分类: 计算机视觉

LaTeX-OCR

dataset deep-learning im2latex im2markup im2text image-processing image2text latex latex-ocr machine-learning math-ocr ocr python pytorch transformer vision-transformer vit

pix2tex: 使用ViT将方程图像转换为LaTeX代码。

项目最后更新:01/18/25

GitHub Stars

16.5K

Forks数量

1.3K

贡献者数量

23

许可证

MIT

收录理由

写论文或笔记时,最烦的就是把别处看到的公式重新敲一遍,既费时又容易出错。LaTeX-OCR(pix2tex)直接省掉这一步:对着公式截个图或拍张照,它就能用视觉Transformer编码器加Transformer解码器,把图像转成可直接编译的LaTeX代码。装好pip包后,你有好几种用法:命令行工具能处理图片文件和剪贴板内容;PyQt5图形界面可以框选屏幕区域,识别结果用MathJax渲染后自动复制到剪贴板;还带一个小型API和Docker镜像,方便嵌进自己的工具链。它还会对输入图像做预处理,自动选个合适的分辨率,所以拍糊了的照片或手写公式也能应付。输出就是纯LaTeX,直接粘进文档或笔记流程就行。训练脚本也开源了,如果预训练权重不覆盖你常用的公式风格,可以拿自己的数据微调。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目