商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 百度:发布并开源端到端OCR模型,仅5天GitHub Star突破1万

百度:发布并开源端到端OCR模型,仅5天GitHub Star突破1万

  发布于2026-08-22 阅读(0)

扫一扫,手机访问

百度近期搞了个大动作——正式发布并开源了一款端到端OCR模型,名叫Unlimited OCR。消息一出,模型发布次日就直接登顶GitHub Daily Trending榜和Python榜;仅仅5天,GitHub Star数就飙到1万以上。

不止于此,在HuggingFace全球模型总趋势榜和多模态模型趋势榜上,它也双双拿下第一。GitHub和HuggingFace四个榜单全部登顶,这个成绩确实很亮眼。

Unlimited OCR专门为长文档解析场景设计,总参数规模3B,但推理时激活参数只用了大约570M——属于比较高效的架构。

公开评测结果也很能说明问题:在OmniDocBench v1.6基准测试中,它取得了93.92%的综合成绩,直接刷新了端到端OCR领域的最新纪录。可以说,这次开源给文档解析领域带来了一股实实在在的推力。

本文转载于:https://www.163.com/dy/article/L0JVCG7T0550WHYR.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注