#180 · 主分类: 计算机视觉
Texo
一个极简的SOTA LaTeX OCR模型,仅20M参数,可在浏览器中运行。提供完整训练流程,便于自行复现。
项目最后更新:08/17/26
GitHub Stars
893
Forks数量
51
贡献者数量
2
许可证
AGPL-3.0
收录理由
把公式照片转成可用的 LaTeX 代码,听起来是个很窄的活儿,但凡是常用 Markdown 记笔记、整理讲义、或者维护数学密集知识库的人,都会频繁碰到这个需求。Texo 用了一个刻意做小的模型来解决:仅 2000 万参数,小到推理可以在消费级 GPU 上跑,甚至直接在浏览器里运行。它从更大的公式识别模型蒸馏而来,仓库里带完整的训练流程和数据集,团队可以针对自己的符号习惯或手写风格重新训练或微调,而不是把它当成一个冻结的黑盒。在 UniMERNet 测试集上,蒸馏后的权重在体积小一个量级的情况下,性能仍接近更大的模型。这种透明度和轻量化组合,让它在给产品加数学 OCR 功能时,成为一个不依赖重型服务的务实默认选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。