#180 · 主分类: 计算机视觉

Texo

computer-vision deep-learning distillation-model formula formulanet hydra latex latex-ocr machine-learning math math-formula-recognition ocr ocr-recognition python pytorch pytorch-lightning transformers unimernet vision-encoder-decoder

一个极简的SOTA LaTeX OCR模型,仅20M参数,可在浏览器中运行。提供完整训练流程,便于自行复现。

项目最后更新:08/17/26

GitHub Stars

893

Forks数量

51

贡献者数量

2

许可证

AGPL-3.0

收录理由

把公式照片转成可用的 LaTeX 代码,听起来是个很窄的活儿,但凡是常用 Markdown 记笔记、整理讲义、或者维护数学密集知识库的人,都会频繁碰到这个需求。Texo 用了一个刻意做小的模型来解决:仅 2000 万参数,小到推理可以在消费级 GPU 上跑,甚至直接在浏览器里运行。它从更大的公式识别模型蒸馏而来,仓库里带完整的训练流程和数据集,团队可以针对自己的符号习惯或手写风格重新训练或微调,而不是把它当成一个冻结的黑盒。在 UniMERNet 测试集上,蒸馏后的权重在体积小一个量级的情况下,性能仍接近更大的模型。这种透明度和轻量化组合,让它在给产品加数学 OCR 功能时,成为一个不依赖重型服务的务实默认选择。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目